Infrastructure

Kubernetes · Network · Kafka · DB · Storage · 관측 파이프라인

Storage

PV/PVC · Longhorn Volume

PVC 개수

14

Longhorn Replica 건강도

39/ 42

일부 저하

WAL 증가 속도

9.9MB/min

PV 사용률정상 · 62%

백업 현황

서버·시스템별 마지막 백업 시각과 상태

실패 1 · 지연 0
시스템상태마지막 백업크기주기 (기대)보관 기간
PostgreSQL (Primary)정상41분 전45GB1시간마다14
Longhorn Volume Snapshot정상1시간 21분 전311.3GB4시간마다7
Harbor Registry정상7시간 9분 전187.4GB1일마다30
Jenkins (JCasC + Jobs)정상16시간 40분 전3GB1일마다30
Redis (RDB Snapshot)정상25분 전2.2GB1시간마다3
Prometheus/Loki/Tempo Config심각88시간 50분 전1GB1일마다30

LIVE 표시 행은 실제 백업 파일(mtime·크기)을 읽은 값이고, 나머지는 아직 실제 백업 시스템이 없어 시뮬레이션입니다.

관측 파이프라인 상태

Prometheus · Loki · Tempo · Alloy — 관측 시스템 장애를 서비스 장애와 구분

컴포넌트Ingestion 성공률Dropped/minWAL 오류Disk 사용률Query LatencyRetention
Prometheus98.29%8160%231ms30
Loki99.69%3063%314ms14
Tempo98.94%6144%294ms7
Alloy98.46%3056%251ms30