Smart Sizing 시작하기
Smart Sizing은 워크로드별 설정이 필요 없습니다. Wave가 설치되는 즉시 모든 Deployment, StatefulSet, DaemonSet, Argo Rollout, DeploymentConfig에서 지표 수집이 자동으로 시작됩니다.
사전 요구사항
- 메트릭 에이전트가 실행 중인 Wave가 설치되어 있어야 합니다 (Quick Start).
- In-place Pod Resize를 사용하려면 Kubernetes 1.27 이상이 필요합니다. 그 외 기능은 지원되는 모든 버전에서 동작합니다.
1단계: Wave Sizing 열기
사이드바에서 Wave Sizing을 엽니다. 세 개의 페이지로 구성되어 있습니다:
- Overview: 클러스터 전체 절감액, 사이징 상태, 우선순위별 할 일 목록.
- Recommendations: 모든 컨테이너의 현재 값과 추천 CPU/메모리.
- Report: 공유 가능한 클러스터 적정 사이징 요약 (Smart Sizing Report 참고).
새로 설치했다면 워크로드는 warming up 상태로 표시됩니다. 첫 추천은 24~48시간 이내에 나타나며, 사용량 기반 모델은 7일치 데이터가 쌓이면 안정화됩니다.
2단계: Overview 페이지에서 우선순위 파악하기
Sizing Console은 먼저 조치할 항목의 우선순위를 정해줍니다:
- Top Opportunities: 예상 월 절감액 기준으로 순위를 매긴 과다 프로비저닝 컨테이너.
- Reliability Risks: 스로틀링이나 OOMKill 위험이 있는 과소 프로비저닝 컨테이너. 이 항목을 먼저 처리하세요.
행을 클릭하면 해당 워크로드의 Smart Sizing 탭으로 바로 이동합니다.
3단계: 워크로드 추천 값 검토하기
워크로드 상세 페이지에서 Smart Sizing 탭을 엽니다. 각 컨테이너 카드는 현재 request/limit, 추천 값, 사용량 차트를 보여줍니다. 읽는 방법은 Smart Sizing Tab in Workload를 참고하세요.
탭 이름이 Smart Sizing with HPA 또는 Smart Sizing with Autopilot으로 표시된다면, 해당 워크로드는 성능 모델을 사용하며 추천이 나오려면 서로 다른 레플리카 수에서 최소 5개의 데이터 포인트가 필요합니다. Overview를 참고하세요.
4단계: Resize Now로 수동 적용하기
컨테이너에서 Resize Now를 클릭하면 추천 값을 즉시 적용합니다. In-Place Pod Resize(재시작 없음, K8s 1.27+) 또는 Edit CRD(매니페스트 변경, 롤링 재시작) 중에서 선택합니다. 자세한 내용은 Resize Now를 참고하세요.
중요하지 않은 워크로드 하나부터 시작해 적용한 뒤, 몇 주기 동안 지켜보세요:
- CPU 스로틀링이 낮게 유지되고 OOMKill이 발생하지 않는지 확인합니다.
- Recommendations 페이지의 상태 배지가 OK로 바뀌는지 확인합니다.
첫 리사이즈는 컨테이너의 원래 값을 캡처합니다. 언제든 Restore Original로 롤백할 수 있습니다.
5단계: Realtime Resizing으로 넘어가기
워크로드에 대한 추천을 신뢰하게 되면, Wave가 자동으로 사이징을 유지하도록 맡길 수 있습니다:
- Smart Sizing 탭에서 Realtime Resizing을 클릭하고 In-place 또는 Manifest를 선택합니다 (기본값은 Off).
- 자동 적용을 원하는 각 컨테이너에서 Container Settings를 열고 Apply recommendations automatically를 활성화합니다.
먼저 운영상 주의할 점을 읽어보세요: Realtime Resizing.
6단계: 모니터링
- 각 워크로드의 Smart Sizing 탭에 있는 Apply History는 모든 자동 적용을 이전 값 → 새 값과 결과와 함께 기록합니다.
- Sizing Console의 KPI (Potential Monthly Savings, Just-Right Rate, Reliability Risk)는 클러스터 전체의 진행 상황을 보여줍니다.
문제 해결
| 증상 | 원인 |
|---|---|
| 추천이 없고 배지에 WARMING UP이 표시됨 | 아직 데이터가 충분하지 않습니다. 24~48시간을 기다리세요 |
| HPA/Autopilot 워크로드에 추천이 없음 | 성능 모델은 서로 다른 레플리카 수에서 5개 이상의 데이터 포인트가 필요합니다. 트래픽이 적은 워크로드는 시간이 더 걸립니다 |
| In-place 옵션이 비활성화됨 | 클러스터가 In-place Pod Resize를 지원하지 않습니다 (K8s < 1.27, 또는 1.27~1.32에서 기능 게이트가 꺼져 있음). 매니페스트 경로를 사용하세요 |
| 버튼이 비활성화되고 "Managed by CRD" 툴팁이 표시됨 | 콘솔이 CRD 모드 (GitOps)입니다. 해당 Wave CR을 대신 수정하세요 |