자체 빌드 이미지 3종(cloudnative-pg/cnpg-postgresql/etcd) + 대응 헬름 차트 도입
security-catalog 프로젝트에서 첫 실사용 자체 빌드 이미지 3종을 포팅한다 — 전부
상위 태그·베이스 OS 교체로 해소 안 되는 CVE(Go 모듈 정적 링크 또는 미수정 CRITICAL/
HIGH)를 자체 빌드(소스 컴파일 또는 SUSE BCI 재설치)로 대응한다:
- images/cloudnative-pg: CNPG operator, release-1.30 소스 컴파일 + bci-micro
- images/cnpg-postgresql: PostgreSQL 18.4, bci-base + zypper 재설치
- images/etcd: etcd v3.7.1, 소스 컴파일(x/text 강제 업그레이드) + bci-micro
함께 추가:
- manifests/helm/{cloudnative-pg,cnpg-cluster,etcd} — 위 이미지를 참조하는 카탈로그 차트
- scripts/deploy-test/*.sh, .claude/deploy-test-procedure.md — CVE 0건과 별개로
"실제로 뜨는가"를 검증하는 배포 스모크 테스트
- .claude/pitfalls.md — 자체 빌드/배포 테스트 중 실측한 함정 모음
검토 중 발견해 반영한 수정:
- cloudnative-pg 차트의 image 블록을 etcd와 동일한 registry/repository/tag 3필드+
따옴표 포맷으로 통일 — 기존 포맷(repository에 registry+repo 결합, 따옴표 없음)은
patch-catalog-tag.py 의 split 패처가 tag만 갱신하고 repository는 그대로 남기는
조용한 부분 치환을 일으켜, 향후 레지스트리 마이그레이션 시 깨진 참조를 만들 수 있었다
- cnpg-cluster 차트의 SLES 커버리지 코멘트를 최신 실측(trivy가 SLES 15.7을 정상
커버함, 2026-07-29 재측정)에 맞게 정정 — 폐기된 "측정 불가/OVAL 우회 필요" 결론이
남아있었다
- CLAUDE.md/MEMORY.md 의 "images/ 디렉토리 없음" 서술을 갱신하고, 레지스트리
마이그레이션(docker.io/wbsong111 → docker.io/paasup)·decisions/analysis 문서 이관·
리소스 프로파일 추가를 다음 작업으로 기록
이 3개 이미지는 아직 dip-catalog 자체 CI(build-image.yml)로 빌드·게이트·push 를
실행해본 적이 없다 — 현재 참조 태그는 security-catalog 쪽에서 이미 검증된 것이다.
Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
This commit is contained in:
@@ -0,0 +1,53 @@
|
||||
# 이 환경에서 반복적으로 문제가 된 것들
|
||||
|
||||
security-catalog 프로젝트에서 CNPG/etcd 자체 빌드·배포 테스트 작업 중 실제로 겪은 함정을
|
||||
포팅했다. [CLAUDE.md](../CLAUDE.md) 에서 분리했다 — 매 세션 필요한 내용이 아니라 해당
|
||||
작업(자체 빌드 이미지, CNPG/etcd 배포 테스트)을 할 때만 참고한다.
|
||||
|
||||
## 스캐너 결과를 그대로 믿지 말 것
|
||||
|
||||
세 가지 실패 양상을 모두 겪었다. 게이트(`scripts/pipeline/cve-gate.py`)가 이것들을
|
||||
잡도록 만들어져 있다.
|
||||
|
||||
| 양상 | 실측 |
|
||||
| --- | --- |
|
||||
| **벤더 하향 등급** | NVD 9.8 을 Debian 이 LOW(`CVE-2019-1010022`), Ubuntu 가 MEDIUM(`CVE-2026-8376`) 으로 둠 |
|
||||
| **데이터 커버리지 부재** | Debian sid 기반 이미지가 149 패키지에 findings 0건 — 거짓 clean |
|
||||
| **벤더 미평가 은폐** | Ubuntu 의 "Needs evaluation" CVE 는 보고되지 않음. `--detection-priority comprehensive` 로도 안 나옴 |
|
||||
|
||||
> dip-catalog 의 `scan-sbom.sh` 는 두 번째 양상(데이터 커버리지 부재)을 구분하는 자가진단
|
||||
> (`CoverageProbe`)이 아직 없다 — `doc/sbom-pipeline.md` 참고.
|
||||
|
||||
## 이미지 태그의 베이스 OS 를 확인할 것
|
||||
|
||||
같은 앱 버전이라도 태그에 따라 베이스 OS 가 다르고 EOL 이 임박한 것이 섞여 있다.
|
||||
오퍼레이터가 배포판 수명 테이블을 갖고 있으면 기동 로그에 남는다
|
||||
(CNPG: `internal/cmd/manager/instance/run/osdb.go`).
|
||||
|
||||
## `kubectl get cluster` 는 쓰면 안 된다
|
||||
|
||||
dev 클러스터에 `clusters` 단축명을 쓰는 CRD 가 3개 있다(CNPG 배포 테스트 대상 클러스터
|
||||
기준).
|
||||
|
||||
- `clusters.postgresql.cnpg.io` (CloudNativePG)
|
||||
- `clusters.management.cattle.io` (Rancher)
|
||||
- `clusters.cluster.x-k8s.io` (CAPI)
|
||||
|
||||
`kubectl get cluster` 는 CNPG 가 아닌 리소스를 조회해 **빈 결과를 반환한다.**
|
||||
스크립트·런북에서는 항상 FQN 을 쓴다.
|
||||
|
||||
```sh
|
||||
kubectl -n <ns> get clusters.postgresql.cnpg.io <name>
|
||||
```
|
||||
|
||||
## 오퍼레이터 차트는 cluster-scoped 잔여물을 남긴다
|
||||
|
||||
`helm uninstall` 후에도 CRD 와 webhook 설정이 남는다. CNPG 는 webhook `failurePolicy: Fail`
|
||||
이므로 **오퍼레이터를 먼저 지우면 CR 을 삭제할 수 없게 된다.**
|
||||
정리 순서: CR → 오퍼레이터 → webhook 설정 → CRD.
|
||||
|
||||
## 선언적 리소스의 `status` 를 근거로 쓰지 말 것
|
||||
|
||||
CNPG `Database` CRD 는 spec generation 이 바뀔 때만 reconcile 한다. 확장이 DB 에서
|
||||
사라져도 `status.applied` 는 계속 `true` 다. 검증은 항상 실제 DB 에 질의해서 한다
|
||||
(security-catalog 프로젝트에서 실측 — 상세 배포 테스트 기록은 dip-catalog 에 아직 없음).
|
||||
Reference in New Issue
Block a user