Kubernetes를 위한 제대로 된 운영 레이어

관측. 진단. 최적화. 제어. 리포트.Kubernetes 운영 라이프사이클 전체를.

조언하고 자동화합니다 — 모든 단계에서

Wave는 다섯 단계를 하나의 콘솔에서 운영합니다. 매일 클러스터를 분석하고, 원인을 찾고, 올바른 설정을 추천한 뒤 자동으로 적용합니다. Amazon EKSOpenShift가 남겨 두는 운영 공백을 메웁니다.

출시 예정 · 2026 Q4

GPU 운영, 그리고 AI 워크플로우.지금 쓰는 Kubernetes 위에서.

Wave GPU는 GPU와 GPU 워크로드를 보이게 만든 다음, 카드 한 장을 여러 워크로드가 나눠 쓰게 합니다. Wave AI Agent는 알림이 발생하거나 정해진 시각이 되면 AI 워크플로우를 실행합니다.

Wave GPU2026 Q4

Kubernetes GPU 운영 계층입니다. 어떤 워크로드가 어떤 카드에 올라가 있는지, 어떤 카드가 비어 있고 어떤 카드가 고장 났는지 확인한 뒤, Dynamia의 HAMi Enterprise로 카드 한 장을 나눠 씁니다.

지금 · 작업 하나가 카드를 차지
비어 있음 · 다른 워크로드가 쓸 수 없음
HAMi Enterprise + Wave GPU
123456

NVIDIA A10G 한 장에서 모델 6개, KServe 환경에서 측정한 값입니다. 카드 종류와 워크로드에 따라 달라집니다.

Wave GPU 살펴보기
Wave AI Agent2026 Q4

Wave 콘솔 안에서 도는 AI 워크플로우입니다. 트리거가 실행을 시작하고, 에이전트가 내장 클러스터 도구로 조사하며, 실행이 끝나면 리포트와 그 결론에 이른 추론 과정이 남습니다.

  1. 트리거
    알림 또는 스케줄
  2. AI 에이전트
    내가 정한 페르소나, 내가 고른 LLM
  3. 리포트
    근본 원인과 해결책
  4. 알림 전송
    Slack 또는 웹훅

4단계로 고정된 파이프라인입니다. 각 단계의 내용은 직접 설정하되, 단계 구성 자체는 바뀌지 않습니다.

모든 에이전트에 붙는 내장 도구
클러스터 메트릭Kubernetes 상태Wave 데이터베이스 · SQL 읽기
Wave AI Agent 살펴보기
Kubernetes 운영 라이프사이클

Kubernetes 운영은 하나의 순환입니다. Wave는 다섯 단계를 한 콘솔에서 모두 다룹니다.

  1. 01

    관측

    도구를 이어 붙이지 않고 모든 클러스터를 봅니다.

    클러스터 및 워크로드 대시보드

  2. 02

    진단

    증상이 아니라 원인을 찾습니다.

    Memory Leak Detection · Container Failure Diagnosis · Pod Scheduling Delay Detection

  3. 03

    최적화

    손으로 하지 않고 낭비를 줄이고 더 빠르게 확장합니다.

    Autopilot · Smart Sizing · Realtime Resizing

  4. 04

    제어

    최적화한 클러스터를 한계 안에서 유지합니다.

    Autopilot Scheduler · Wave Flow

  5. 05

    리포트 및 알림

    사람이 바로 처리할 수 있는 기록을 남깁니다.

    Smart Sizing Report · 장애 증거 수집 · Alerts

리포트와 알림이 다음 관측으로 이어집니다. 다섯 단계가 모두 같은 자료를 보고 움직입니다.

핵심 기능

팀이 가장 먼저 켜는 기능들

제품 영역별로 정리 — 스케일링부터 장애 진단까지.

리소스 최적화

컴퓨트 라이트사이징 · 스케일링 · 프로비저닝

콘솔 데모

설치 전에 콘솔을 먼저 경험해 보세요

사이징 권장 사항, Autopilot 스케일링, K8s 진단을 시뮬레이션 데이터로 브라우저에서 직접 클릭해 보세요.

콘솔 데모 살펴보기 →
console.waveautoscale.com
작동 방식

무엇을 읽고, 어떻게 판단하고, 무엇을 바꾸는가.

위의 다섯 단계는 하나의 동작 방식 위에서 돌아갑니다. Wave는 메트릭과 로그, Kubernetes 상태를 함께 수집하고, 그 위에서 판단하고, 결과를 적용합니다.

읽기

Wave가 읽는 것

  • Pod 및 워크로드 메트릭
  • K8s 이벤트 및 API 상태
  • GPU 텔레메트리
  • PV / PVC 사용량
  • Pod 스케줄링 상태
  • Istio 메시 텔레메트리
  • + 그 외 다양한 시그널

루프마다 주기가 다릅니다. 초 단위부터 일 단위까지, 각자의 일정으로 동작합니다.

판단

Wave가 판단하는 방식

  • 워크로드 성능 모델 (ML)
  • Smart Sizing 모델 (ML)
  • 시계열 예측 (ML)
  • 규칙 기반 임계값 및 쿨다운
  • LLM + 스킬NEW
  • + 그 외 다양한 두뇌

작업에 맞는 두뇌를 선택합니다. 이벤트 기반 진단을 위한 LLM도 포함됩니다.

변경

Wave가 바꾸는 것

  • 레플리카 조정
  • CPU / 메모리 요청 리사이즈
  • 노드 프로비저닝
  • PVC 확장
  • Istio 트래픽 셰딩
  • 변경 사항 추천
  • Slack 알림 / SRE 페이지
  • + 그 외 다양한 액션

적용, 추천, 또는 알림. Wave의 자율성 수준에 맞게 선택합니다.

구성 요소AutopilotSmart SizingKarpenterFlowDiagnosisAI Agent 포함 NEW

신뢰할 수 있는 주요 파트너

AWS EKS Service Ready Partner
Red Hat Partner Program tier 2026 — Ready
HPE
CNCF
시작하기

3단계로 운영 환경까지

EKS, GKE, AKS, OpenShift, 자체 운영 Kubernetes 1.26+ 환경에서 동작합니다.

1

라이선스 키 신청

200 vCPU 미만 클러스터는 무료입니다. 두 가지 설치 방식은 몇 초 안에 이메일로 키를 발급합니다. 나머지는 담당자가 안내드립니다.

무료 키 신청하기 →
2

Helm으로 설치

키와 스토리지 클래스가 담긴 values 파일 하나, helm install 한 줄. 에어갭(폐쇄망) 클러스터도 지원합니다.

$ helm repo add wave-autoscale-helm \ https://release.waveautoscale.io/helm-chart$ helm install wave-autoscale-helm \ wave-autoscale-helm/wave-autoscale-helm \ -f values-ghcr.yaml \ -n wave-autoscale --create-namespace
3

콘솔 접속

포트 포워딩 후 로그인하면 Wave가 워크로드를 자동으로 탐색합니다. Autopilot은 처음에 관찰 전용 모드로 실행할 수 있습니다.

$ kubectl port-forward -n wave-autoscale \ svc/wave-autoscale-svc 3025:3025# open http://localhost:3025
기본 로그인 · admin / waveautoscale
FAQ

자주 묻는 질문에 대한 명확한 답변

이미 HPA를 사용하고 있는데, 왜 필요한가요?

HPA는 자원 사용량이 임계치를 넘는지만 볼 뿐, 실제 워크로드 성능은 보지 않습니다. Wave Autopilot은 ML 기반 워크로드 성능 모델링으로 약 10초 안에 스케일링을 결정합니다. HPA보다 약 2배 빠르고, 임계치 튜닝이 필요 없습니다.

KEDA와 같은 것이 아닌가요?

아닙니다. KEDA는 이벤트 기반 워크로드(Kafka, 큐)에 특화되어 있어 목적이 다릅니다. KEDA는 HPA·Wave Autopilot과 보완 관계이지 대체재가 아닙니다. Wave Autopilot은 장기 실행 서비스를 워크로드 성능에 따라 스케일링하는 별개의 문제를 해결합니다.

리소스 사이징 측면에서 VPA와 어떻게 다른가요?

VPA는 CPU 백분위 통계만 사용하기 때문에 고정된 CPU 할당이 산발적 요청 급증에 대응하지 못합니다. Wave Smart Sizing은 CPU 백분위와 실시간 워크로드 수요를 함께 반영해 최적 성공률을 유지합니다(예: 버스트 상황에서 1.5코어 대신 2.0코어 할당).

Wave Flow가 Istio를 대체하나요?

아닙니다. Wave Flow는 Istio 위에서 동작하며 우선순위 셰이핑, 가상 대기실, Envoy 필터·컨트롤 플레인 확장을 통한 가시성을 추가합니다. 기존 Istio 메시는 그대로 유지되며, Wave Flow는 모든 요청을 동일하게 처리하지 않고 과부하 상황에서도 부드럽게 동작하도록 만듭니다.

이미 Karpenter를 쓰는데, Wave Karpenter는 무엇을 더해주나요?

Karpenter는 빠르지만 그 자체로는 운영 준비가 충분하지 않습니다 — 콜드 스타트 지연, 제한된 가시성, 안전하지 않은 Spot 활용이 대규모 환경에서 문제를 일으킬 수 있습니다. Wave Karpenter는 Node Warmup 사전 프로비저닝, 통합 모니터링 대시보드, 워크로드 임계치 기반 안전한 Spot 배치를 더해 중단 없이 노드 비용을 약 70% 절감합니다.

Grafana를 이미 쓰고 있는데, Wave Diagnosis는 왜 필요한가요?

Grafana는 지표를 보여주지만 무엇이 문제인지는 직접 추측해야 합니다. 임계치 알림은 천천히 진행되는 문제를 인시던트가 되기 전까지 놓치곤 합니다. Wave Diagnosis는 5가지 ML 진단(7~60일 클러스터 자원 예측, 메모리 누수 탐지, CPU 사용 분석, 파드 스케줄링 지연 탐지, 유휴 노드 탐지)을 제공해 사후 대응에서 사전 대응으로 전환할 수 있게 합니다.

에어갭/온프레미스 환경에서 동작하나요?

네. Wave는 외부 의존성 없이 클러스터 안에서만 동작합니다. 프라이빗 컨테이너 레지스트리를 포함한 에어갭 환경을 완전히 지원합니다. AWS EKS Service Ready Partner이자 Red Hat Certified Partner이며, 베어메탈 Kubernetes에서도 동작합니다.

Kubernetes를 제대로 운영할 준비가 되셨나요?

여러분의 클러스터에 대한 무료 Smart Sizing Report로 시작하세요. 신용카드 없이, 화이트글러브 온보딩이 포함됩니다.