Predictive Autoscaling

Demand Forecast · Replica Decision · Capacity Guard

Demand Forecast

실측·예측 RPS와 예측 오차

예측 정확도

6.6%MAPE

MAE 1.6 req/s

과잉 예측 횟수

0

최근 30분 이내

예측 구간

5·10·15분

모델 버전

v3.2.joblib

실측 RPS vs 예측 RPS

5·10·15분 예측 (모델: 시계열 회귀)

실측 RPS
예측 RPS
02040-29m-18m-7m4m15m

Replica Decision

실제 replica · AI 권장 replica · Shadow Mode 근거

현재 / AI 권장 replica

2 → 3

현재 replica: 시뮬레이션

다음 예상 Scale-out

예정 없음

Pod당 처리 가능 RPS

23req/s (k6 벤치마크)

과도 확장 Pod-minute

0

낭비 적음

실제 replica vs AI 권장 replica

Shadow Mode — HPA는 실제 replica만 반영

실제 replica
AI 권장 replica
024-60m-45m-30m-15m지금

적용 시 예상 CPU · p95

AI 권장 replica로 확장했을 경우의 시뮬레이션

CPU
Memory
050100-60m-45m-30m-15m지금70% 기준선

p95는 아래 “p95 지연시간” 차트를 함께 참고하세요. SLO(800ms) 초과 구간은 확장 필요 신호입니다.

p95 지연시간

서비스 SLO 대비

05001000-60m-45m-30m-15m지금SLO 800ms129.5ms

Scale-out · Scale-in 이벤트

최근 1시간 내 스케일 이벤트가 없습니다.

Capacity Guard

온프렘 자원 한도 — AI 권장이 실제 배치 가능량을 넘지 않도록 보호

On-prem Capacity Guard

즉시 배치 가능 Pod (requests 기준)
6
Pending 상태 Pod
0
CPU 여유 (Pod 환산)
5
Memory 여유 (Pod 환산)
5
Pod anti-affinity 충족 가능
가능
최대 확장 가능 replica
6

Storage 여유와 노드별 CPU · Memory 여유는 Infrastructure → Kubernetes / Compute에서 확인할 수 있습니다.

확장 불가능 서비스

AI 권장 replica가 즉시 배치 가능량을 초과하는 서비스

현재 용량 부족으로 확장이 막힌 서비스가 없습니다.