Files
service-catalog/.claude/pitfalls.md
T
wbsong111 6597059a15 scan-sbom.sh: CoverageProbe 커버리지 자가진단 이식 + 관련 파이프라인 버그 수정
security-catalog 프로젝트에서 자체 빌드 이미지 3종을 실제로 로컬 빌드·게이트
검증하는 과정에서 발견한 문제들:

- extract-helm-images.sh 가 `image:` 필드만 잡고 `imageName:`(CNPG Cluster CRD 관례)
  은 놓쳐, cnpg-cluster 차트의 이미지가 SBOM·스캔·게이트 어디에도 안 나타났다.
- patch-catalog-tag.py 의 split 포맷 패처가 registry 필드가 따로 없고 repository 에
  registry+repo 를 합쳐 쓰는 차트(cloudnative-pg 오퍼레이터, 업스트림 템플릿이
  image.registry 를 아예 참조하지 않음)에서 tag 만 조용히 갱신하고 repository 는
  그대로 남겨 깨진 참조를 만들 수 있었다.
- CoverageProbe(센티널 패키지 주입 재스캔으로 "0건"과 "측정 안 됨"을 구분)가
  이식되지 않아, 전 심각도 0건인 자체 빌드 이미지가 실제로는 깨끗한데도 게이트가
  "데이터 커버리지 이상"으로 오탐 처리했다 — security-catalog 의 scan-sbom.sh 를
  이식해 해소. cve-gate.py 는 이미 이 키를 읽도록 구현돼 있어 소비 쪽 변경은 없다.

rpm(SUSE)·deb(Debian)·apk(Alpine) 세 센티널 경로와 병렬 스캔 회귀를 로컬에서
확인했고, 이식 후 cloudnative-pg·cnpg-postgresql 게이트가 실제로 FAIL→PASS 로
바뀌는 것도 확인했다.

Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
2026-08-03 15:30:57 +09:00

2.7 KiB

이 환경에서 반복적으로 문제가 된 것들

security-catalog 프로젝트에서 CNPG/etcd 자체 빌드·배포 테스트 작업 중 실제로 겪은 함정을 포팅했다. CLAUDE.md 에서 분리했다 — 매 세션 필요한 내용이 아니라 해당 작업(자체 빌드 이미지, CNPG/etcd 배포 테스트)을 할 때만 참고한다.

스캐너 결과를 그대로 믿지 말 것

세 가지 실패 양상을 모두 겪었다. 게이트(scripts/pipeline/cve-gate.py)가 이것들을 잡도록 만들어져 있다.

양상 실측
벤더 하향 등급 NVD 9.8 을 Debian 이 LOW(CVE-2019-1010022), Ubuntu 가 MEDIUM(CVE-2026-8376) 으로 둠
데이터 커버리지 부재 Debian sid 기반 이미지가 149 패키지에 findings 0건 — 거짓 clean
벤더 미평가 은폐 Ubuntu 의 "Needs evaluation" CVE 는 보고되지 않음. --detection-priority comprehensive 로도 안 나옴

dip-catalog 의 scan-sbom.sh 는 두 번째 양상(데이터 커버리지 부재)을 구분하는 자가진단 (CoverageProbe)을 이식했다(2026-08-03) — doc/sbom-pipeline.md 참고.

이미지 태그의 베이스 OS 를 확인할 것

같은 앱 버전이라도 태그에 따라 베이스 OS 가 다르고 EOL 이 임박한 것이 섞여 있다. 오퍼레이터가 배포판 수명 테이블을 갖고 있으면 기동 로그에 남는다 (CNPG: internal/cmd/manager/instance/run/osdb.go).

kubectl get cluster 는 쓰면 안 된다

dev 클러스터에 clusters 단축명을 쓰는 CRD 가 3개 있다(CNPG 배포 테스트 대상 클러스터 기준).

  • clusters.postgresql.cnpg.io (CloudNativePG)
  • clusters.management.cattle.io (Rancher)
  • clusters.cluster.x-k8s.io (CAPI)

kubectl get cluster 는 CNPG 가 아닌 리소스를 조회해 빈 결과를 반환한다. 스크립트·런북에서는 항상 FQN 을 쓴다.

kubectl -n <ns> get clusters.postgresql.cnpg.io <name>

오퍼레이터 차트는 cluster-scoped 잔여물을 남긴다

helm uninstall 후에도 CRD 와 webhook 설정이 남는다. CNPG 는 webhook failurePolicy: Fail 이므로 오퍼레이터를 먼저 지우면 CR 을 삭제할 수 없게 된다. 정리 순서: CR → 오퍼레이터 → webhook 설정 → CRD.

선언적 리소스의 status 를 근거로 쓰지 말 것

CNPG Database CRD 는 spec generation 이 바뀔 때만 reconcile 한다. 확장이 DB 에서 사라져도 status.applied 는 계속 true 다. 검증은 항상 실제 DB 에 질의해서 한다 (security-catalog 프로젝트에서 실측 — 상세 배포 테스트 기록은 dip-catalog 에 아직 없음).