Alertmanager 연동 상태
Prometheus에서 Alertmanager를 찾지 못했습니다
Alertmanager 컨테이너 상태와 monitoring/prometheus/prometheus.yml의 alerting.alertmanagers 설정을 확인하세요.
Notification Policy
심각도별 전달 채널과 담당·재알림 주기
| 심각도 | 조건 | 전달 채널 | 담당 | 재알림 |
|---|---|---|---|---|
| Critical | 서비스 전체 Down, DB HA 장애, Disk 95% 이상 | 메신저 + 문자 | 온콜 담당자 | 15분마다 |
| High | 5xx 급증, HPA 확장 불가 | 담당팀 메신저 채널 | 서비스 담당팀 | 30분마다 |
| Warning | CPU · Memory 지속 상승, Consumer Lag 증가 | 모니터링 채널 | 당번 엔지니어 | 120분마다 |
| Info | 배포 완료, ConfigMap · Secret 변경 | 타임라인 기록 | - | - |
동일 Incident에 대한 중복 알림은 재알림 주기 내에서 하나로 묶여 전달됩니다.