Marathon ServiceRunning Record ServiceAI AssistantCourse Recommendation AICrew ServiceNotification ConsumerCommunity FeedPayment Gateway
Demand Forecast
실측·예측 RPS와 예측 오차
예측 정확도
5.9%MAPE
↗MAE 2.2 req/s과잉 예측 횟수
0회
↗최근 30분 이내예측 구간
5·10·15분
모델 버전
v3.2.joblib
실측 RPS vs 예측 RPS
5·10·15분 예측 (모델: 시계열 회귀)
실측 RPS
예측 RPS
Replica Decision
실제 replica · AI 권장 replica · Shadow Mode 근거
현재 / AI 권장 replica
2 → 2
현재 replica: 시뮬레이션다음 예상 Scale-out
예정 없음
Pod당 처리 가능 RPS
10req/s (k6 벤치마크)
과도 확장 Pod-minute
0
↗낭비 적음실제 replica vs AI 권장 replica
Shadow Mode — HPA는 실제 replica만 반영
실제 replica
AI 권장 replica
적용 시 예상 CPU · p95
AI 권장 replica로 확장했을 경우의 시뮬레이션
CPU
Memory
p95는 아래 “p95 지연시간” 차트를 함께 참고하세요. SLO(800ms) 초과 구간은 확장 필요 신호입니다.
p95 지연시간
서비스 SLO 대비
Scale-out · Scale-in 이벤트
최근 1시간 내 스케일 이벤트가 없습니다.
Capacity Guard
온프렘 자원 한도 — AI 권장이 실제 배치 가능량을 넘지 않도록 보호
On-prem Capacity Guard
- 즉시 배치 가능 Pod (requests 기준)
- 6개
- Pending 상태 Pod
- 0개
- CPU 여유 (Pod 환산)
- 5개
- Memory 여유 (Pod 환산)
- 7개
- Pod anti-affinity 충족 가능
- 가능
- 최대 확장 가능 replica
- 4개
Storage 여유와 노드별 CPU · Memory 여유는 Infrastructure → Kubernetes / Compute에서 확인할 수 있습니다.
확장 불가능 서비스
AI 권장 replica가 즉시 배치 가능량을 초과하는 서비스
현재 용량 부족으로 확장이 막힌 서비스가 없습니다.