Kimi K3는 세계 최초의 오픈 3T급 모델로, 코딩, 지식 작업, 추론에서 장기 과제를 처리하는 프런티어급 지능을 위해 만들어진 2.8T 파라미터 플래그십 모델이며, 네이티브 비전과 100만 token 컨텍스트 윈도우를 갖추고 있습니다. Kimi.com, Kimi Work, Kimi Code, Kimi API 전반에서 이용할 수 있습니다. 아래는 Kimi K3에 접근하는 올바른 방법을 선택하는 데 도움이 되는 Kimi 멤버십 플랜과 Kimi K3 API 요금에 대한 개요입니다.
Kimi K3 멤버십 플랜 및 사용량 등급
Kimi K3를 사용하는 가장 쉬운 방법은 Kimi 멤버십을 이용하는 것입니다. Kimi는 가벼운 일상 사용부터 집중적인 agent 워크플로까지, 필요에 맞게 확장되는 등급별 플랜을 제공합니다. 상위 등급일수록 더 많은 agent 크레딧, 더 높은 동시 처리량, Kimi K3 기반의 최대 100만 token 초장문 채팅 용량이 제공됩니다.
| Adagio | Moderato | Allegretto | Allegro | Vivace | |
|---|---|---|---|---|---|
| 연간 결제(월 환산 금액) | 월 $0 | 월 $15 | 월 $31 | 월 $79 | 월 $159 |
| Agent 동시 작업 | 작업 1개 | 작업 2개 | 작업 2개 | 작업 4개 | 작업 4개 |
| 에이전트 우선순위 대기열 | × | 4배 속도 | 4배 속도 | 4배 속도 | 4배 속도 |
| K3 초장문 채팅 지원(최대 1M 토큰) | × | × | × | ✓ | ✓ |
| 맞춤형 대시보드 | ✓ | ✓ | ✓ | ✓ | ✓ |
| 예약 작업 | 작업 2개 | 작업 10개 | 작업 15개 | 작업 20개 | 작업 25개 |
| 위젯 작업 | 작업 2개 | 작업 10개 | 작업 15개 | 작업 20개 | 작업 25개 |
| 플러그인 | 15종 이상 지원 | 15종 이상 지원 | 15종 이상 지원 | 15종 이상 지원 | 15종 이상 지원 |
| Swarm | × | ✓ | ✓ | ✓ | ✓ |
| Swarm로 실행하는 하위 작업 | × | 서브에이전트 2개 | 서브에이전트 4개 | 서브에이전트 8개 | 서브에이전트 8개 |
| Dream Memory | × | ✓ | ✓ | ✓ | ✓ |
| 자기 진화형 스킬 | × | ✓ | ✓ | ✓ | ✓ |
| 목표 | × | × | ✓ | ✓ | ✓ |
| Kimi Claw (웹, Android, PC) | × | × | ✓ | ✓ | ✓ |
| Claw와 그룹 채팅 | × | × | 그룹 채팅 10개 | 그룹 채팅 10개 | 그룹 채팅 10개 |
| 데이터베이스가 포함된 웹사이트 배포 | × | ✓ | ✓ | ✓ | ✓ |
위의 모든 가격은 연간 결제 기준입니다. 월간 결제도 가능하며 각각 월 $19, $39, $99, $199입니다. Allegro와 Vivace는 초장문 대화, 대규모 코드베이스, 문서 중심 리서치를 위해 최대 100만 token의 컨텍스트를 지원하는 K3의 초장문 채팅 용량을 제공합니다. 최신 플랜 세부 정보는 공식 멤버십 페이지를 참고하세요.
Kimi K3 API 요금
Kimi K3 API 요금은 token 기반 모델을 사용하며, 입력과 출력 처리 모두 100만 token(1,000,000 token) 단위로 청구되어 명확하고 예측 가능한 비용 관리가 가능합니다.
| 모델 | 단위 | 입력 가격 (캐시 히트) | 입력 가격 (캐시 미스) | 출력 가격 | 컨텍스트 윈도우 |
|---|---|---|---|---|---|
| kimi-k3 | 100만 token | $0.30 | $3.00 | $15.00 | 1,048,576 token |
Kimi K3는 장기 과제 코딩과 엔드투엔드 지식 작업을 위한 Kimi의 플래그십 모델입니다. 항상 추론을 수행하며, 추론 강도는 최상위 reasoning_effort 필드를 통해 설정됩니다. 이 모델은 자동 컨텍스트 캐싱, 도구 호출, JSON 모드, 구조화된 출력, 그리고 단일 요청 내 전체 100만 token 컨텍스트 윈도우를 지원합니다.
Kimi K3 API 과금 방식
Kimi K3 API는 요청마다 토큰 기반 가격 모델을 사용하며, 모델과의 모든 상호작용은 토큰을 소비하고 그 유형에 따라 과금됩니다. 이 모델에서 토큰은 일반적으로 입력 토큰, 캐시된 입력 토큰, 출력 토큰의 세 가지 유형으로 분류됩니다.
입력 토큰
입력 토큰은 모델에 전달되는 모든 것을 나타내며, 다음을 포함합니다:
사용자 프롬프트
시스템 지시사항
대화 기록 또는 컨텍스트 이러한 토큰은 모델이 응답을 생성하기 전에 처리해야 하는 컨텍스트의 양을 결정합니다. 100만 토큰 컨텍스트 윈도우를 통해 Kimi K3는 전체 코드베이스, 긴 문서, 확장된 다중 턴 기록을 한 번의 요청으로 받아들일 수 있습니다.
캐시된 입력 토큰
캐시된 입력 토큰은 이전에 처리된 컨텍스트가 재사용될 때 발생합니다.
동일하거나 유사한 컨텍스트가 재사용되면 100만 토큰당 3.00달러가 아닌 0.30달러로 과금되며, 이는 90% 절감된 금액입니다
이는 반복적인 워크플로우의 효율성을 크게 향상시킵니다
대규모 공유 컨텍스트가 반복적으로 전송되는 긴 컨텍스트 애플리케이션과 다중 턴 상호작용에서 특히 유용합니다
출력 토큰
출력 토큰은 요청에 대한 응답으로 모델이 생성하는 토큰입니다. 이는 다음과 같은 실제 AI 생성 콘텐츠를 나타냅니다:
텍스트 응답
코드 생성
구조화된 출력 출력 생성에는 추가적인 연산이 필요하므로, 일반적으로 입력 토큰보다 가격이 더 높게 책정됩니다.
결론
Kimi K3는 일반 사용자와 개발자 모두를 위한 유연한 가격 정책을 제공합니다. 전체 Kimi 경험을 위한 멤버십 플랜과, 자동 컨텍스트 캐싱으로 입력 비용을 90% 절감하는 토큰 기반 API가 그것입니다. 자신의 워크플로우에 맞는 방식을 선택하고, 오늘부터 Kimi K3를 시작해 보세요.