security-catalog 프로젝트에서 첫 실사용 자체 빌드 이미지 3종을 포팅한다 — 전부
상위 태그·베이스 OS 교체로 해소 안 되는 CVE(Go 모듈 정적 링크 또는 미수정 CRITICAL/
HIGH)를 자체 빌드(소스 컴파일 또는 SUSE BCI 재설치)로 대응한다:
- images/cloudnative-pg: CNPG operator, release-1.30 소스 컴파일 + bci-micro
- images/cnpg-postgresql: PostgreSQL 18.4, bci-base + zypper 재설치
- images/etcd: etcd v3.7.1, 소스 컴파일(x/text 강제 업그레이드) + bci-micro
함께 추가:
- manifests/helm/{cloudnative-pg,cnpg-cluster,etcd} — 위 이미지를 참조하는 카탈로그 차트
- scripts/deploy-test/*.sh, .claude/deploy-test-procedure.md — CVE 0건과 별개로
"실제로 뜨는가"를 검증하는 배포 스모크 테스트
- .claude/pitfalls.md — 자체 빌드/배포 테스트 중 실측한 함정 모음
검토 중 발견해 반영한 수정:
- cloudnative-pg 차트의 image 블록을 etcd와 동일한 registry/repository/tag 3필드+
따옴표 포맷으로 통일 — 기존 포맷(repository에 registry+repo 결합, 따옴표 없음)은
patch-catalog-tag.py 의 split 패처가 tag만 갱신하고 repository는 그대로 남기는
조용한 부분 치환을 일으켜, 향후 레지스트리 마이그레이션 시 깨진 참조를 만들 수 있었다
- cnpg-cluster 차트의 SLES 커버리지 코멘트를 최신 실측(trivy가 SLES 15.7을 정상
커버함, 2026-07-29 재측정)에 맞게 정정 — 폐기된 "측정 불가/OVAL 우회 필요" 결론이
남아있었다
- CLAUDE.md/MEMORY.md 의 "images/ 디렉토리 없음" 서술을 갱신하고, 레지스트리
마이그레이션(docker.io/wbsong111 → docker.io/paasup)·decisions/analysis 문서 이관·
리소스 프로파일 추가를 다음 작업으로 기록
이 3개 이미지는 아직 dip-catalog 자체 CI(build-image.yml)로 빌드·게이트·push 를
실행해본 적이 없다 — 현재 참조 태그는 security-catalog 쪽에서 이미 검증된 것이다.
Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
2.6 KiB
이 환경에서 반복적으로 문제가 된 것들
security-catalog 프로젝트에서 CNPG/etcd 자체 빌드·배포 테스트 작업 중 실제로 겪은 함정을 포팅했다. CLAUDE.md 에서 분리했다 — 매 세션 필요한 내용이 아니라 해당 작업(자체 빌드 이미지, CNPG/etcd 배포 테스트)을 할 때만 참고한다.
스캐너 결과를 그대로 믿지 말 것
세 가지 실패 양상을 모두 겪었다. 게이트(scripts/pipeline/cve-gate.py)가 이것들을
잡도록 만들어져 있다.
| 양상 | 실측 |
|---|---|
| 벤더 하향 등급 | NVD 9.8 을 Debian 이 LOW(CVE-2019-1010022), Ubuntu 가 MEDIUM(CVE-2026-8376) 으로 둠 |
| 데이터 커버리지 부재 | Debian sid 기반 이미지가 149 패키지에 findings 0건 — 거짓 clean |
| 벤더 미평가 은폐 | Ubuntu 의 "Needs evaluation" CVE 는 보고되지 않음. --detection-priority comprehensive 로도 안 나옴 |
dip-catalog 의
scan-sbom.sh는 두 번째 양상(데이터 커버리지 부재)을 구분하는 자가진단 (CoverageProbe)이 아직 없다 —doc/sbom-pipeline.md참고.
이미지 태그의 베이스 OS 를 확인할 것
같은 앱 버전이라도 태그에 따라 베이스 OS 가 다르고 EOL 이 임박한 것이 섞여 있다.
오퍼레이터가 배포판 수명 테이블을 갖고 있으면 기동 로그에 남는다
(CNPG: internal/cmd/manager/instance/run/osdb.go).
kubectl get cluster 는 쓰면 안 된다
dev 클러스터에 clusters 단축명을 쓰는 CRD 가 3개 있다(CNPG 배포 테스트 대상 클러스터
기준).
clusters.postgresql.cnpg.io(CloudNativePG)clusters.management.cattle.io(Rancher)clusters.cluster.x-k8s.io(CAPI)
kubectl get cluster 는 CNPG 가 아닌 리소스를 조회해 빈 결과를 반환한다.
스크립트·런북에서는 항상 FQN 을 쓴다.
kubectl -n <ns> get clusters.postgresql.cnpg.io <name>
오퍼레이터 차트는 cluster-scoped 잔여물을 남긴다
helm uninstall 후에도 CRD 와 webhook 설정이 남는다. CNPG 는 webhook failurePolicy: Fail
이므로 오퍼레이터를 먼저 지우면 CR 을 삭제할 수 없게 된다.
정리 순서: CR → 오퍼레이터 → webhook 설정 → CRD.
선언적 리소스의 status 를 근거로 쓰지 말 것
CNPG Database CRD 는 spec generation 이 바뀔 때만 reconcile 한다. 확장이 DB 에서
사라져도 status.applied 는 계속 true 다. 검증은 항상 실제 DB 에 질의해서 한다
(security-catalog 프로젝트에서 실측 — 상세 배포 테스트 기록은 dip-catalog 에 아직 없음).