Add VictoriaMetrics observability stack + sync catalog for monitoring test
- VM stack 10 charts: victoria-metrics-cluster/auth, victoria-logs-cluster, victoria-metrics-agent/alert, opentelemetry-collector, kube-state-metrics, prometheus-node-exporter, alertmanager, perses (JWT/OIDC, Infisical-ready) - ArgoCD ApplicationSet (syncWave) + per-chart dip-values overlays - doc/victoria-metrics-architecture.md, define-chart-resources updates - includes pending working-tree changes (mlflow, kubeflow, apisix, CLAUDE.md) Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
This commit is contained in:
@@ -0,0 +1,27 @@
|
||||
# prometheus-node-exporter 배포
|
||||
|
||||
노드 시스템 메트릭(`node_*`: CPU/메모리/디스크/네트워크)을 노출하는 DaemonSet. vmagent가 스크레이핑하여 VictoriaMetrics로 전송한다.
|
||||
|
||||
## 1. 배포 방법
|
||||
|
||||
```sh
|
||||
helm upgrade node-exporter ./ -f custom-values.yaml --install -n monitoring
|
||||
```
|
||||
|
||||
## 2. custom-values.yaml 설정 설명
|
||||
|
||||
- `tolerations: [{operator: Exists}]` — 컨트롤플레인 포함 **모든 노드**에 배치.
|
||||
- 리소스 요청/제한 오버라이드.
|
||||
|
||||
vmalert의 노드 헬스 알림(NodeHighCPU/NodeHighMemory)과 Perses k8s-node-overview 대시보드가 이 메트릭에 의존한다.
|
||||
|
||||
## 3. 의존 관계
|
||||
|
||||
- **스크레이프 주체**: vmagent (job: `node-exporter`, namespace `monitoring`의 `metrics` 포트 keep)
|
||||
|
||||
## 4. 검증
|
||||
|
||||
```sh
|
||||
kubectl get pods -n monitoring -l app.kubernetes.io/name=prometheus-node-exporter -o wide
|
||||
# 노드 수와 파드 수가 일치하는지 확인
|
||||
```
|
||||
Reference in New Issue
Block a user