Kimi K3 是全球首个开放的 3T 级模型,拥有 2.8T 参数,专为长程编程、知识工作和推理等前沿智能任务打造,原生支持视觉能力,并具备 100 万 token 的上下文窗口。它已在 Kimi.com、Kimi Work、Kimi Code 以及 Kimi API 上线。以下是 Kimi 会员计划与 Kimi K3 API 定价概览,帮助你选择合适的接入方式。
Kimi K3 会员计划与使用等级
使用 Kimi K3 最简单的方式是开通 Kimi 会员。Kimi 提供分级的会员计划,可满足从日常轻度使用到高强度智能体工作流的各类需求。更高等级的计划可解锁更多智能体额度、更高并发以及由 Kimi K3 驱动的最多 100 万 token 超长对话容量。
| Adagio | Andante | Moderato | Allegretto | Allegro | |
|---|---|---|---|---|---|
| 按年计费(折合每月) | ¥0 | ¥39 / 月 | ¥79 / 月 | ¥159 / 月 | ¥559 / 月 |
| Agent 任务并行 | 1 个任务 | 1 个任务 | 2 个任务 | 2 个任务 | 4 个任务 |
| Agent 优先生成队列 | × | 4 倍速度 | 4 倍速度 | 4 倍速度 | 4 倍速度 |
| K3 超长对话容量(支持百万 Tokens) | × | × | × | × | ✓ |
| 定制化看板 | ✓ | ✓ | ✓ | ✓ | ✓ |
| 定时任务 | 2 个任务 | 6 个任务 | 10 个任务 | 15 个任务 | 20 个任务 |
| 小组件任务 | 2 个任务 | 6 个任务 | 10 个任务 | 15 个任务 | 20 个任务 |
| 项目数 | 2 个项目 | 20 个项目 | 20 个项目 | 20 个项目 | 100 个项目 |
| 项目存储空间 | 500MB | 20GB | 20GB | 20GB | 50GB |
| 精选插件 | 15+ 种可调用 | 15+ 种可调用 | 15+ 种可调用 | 15+ 种可调用 | 15+ 种可调用 |
| 集群功能 | × | × | ✓ | ✓ | ✓ |
| 集群功能运行子任务数 | × | × | 2 个子任务 | 4 个子任务 | 8 个子任务 |
| 梦境记忆 | × | × | ✓ | ✓ | ✓ |
| 自进化技能 | × | × | ✓ | ✓ | ✓ |
| 目标模式 | × | × | × | ✓ | ✓ |
| Kimi Claw(云端、安卓本地和桌面端) | × | × | × | ✓ | ✓ |
| Kimi Claw 群聊 | × | × | × | 10 个群聊 | 10 个群聊 |
| 发布带数据库的网站 | × | ✓ | ✓ | ✓ | ✓ |
以上价格均为年付价格。月付价格分别为每月 49 元、99 元、199 元和 699 元。Allegro 解锁 K3 的超长对话容量,支持最多 100 万 token 的上下文,适用于超长对话、大型代码库以及文档密集型研究。最新套餐详情请参见官方会员页面。
Kimi K3 API 定价
Kimi K3 API 定价采用基于 token 的模式,输入和输出均按每 100 万 token(1,000,000 个 token)计费,成本清晰、可预测。
| 模型 | 计费单位 | 输入价格(缓存命中) | 输入价格(缓存未命中) | 输出价格 | 上下文窗口 |
|---|---|---|---|---|---|
| kimi-k3 | 1M tokens | ¥2.00 | ¥20.00 | ¥100.00 | 1,048,576 tokens |
*此处 1M = 1,000,000,表格中的价格代表每消耗 1M tokens 的价格。
Kimi K3 是 Kimi 面向长程编程和端到端知识工作打造的旗舰模型。它始终具备推理能力,推理强度通过顶层的 reasoning_effort 字段设置。该模型支持自动上下文缓存、工具调用、JSON 模式、结构化输出,以及单次请求中完整的 100 万 token 上下文窗口。
Kimi K3 API 计费方式
Kimi K3 API 对每次请求采用基于 token 的定价模式,与模型的每次交互都会消耗 token,并按类型计费。在该模式下,token 通常分为三类:输入 token、缓存输入 token 和输出 token。
输入 token
输入 token 代表发送给模型的所有内容,包括:
用户提示词
系统指令
对话历史或上下文 这些 token 决定了模型在生成响应之前需要处理多少上下文。凭借 100 万 token 的上下文窗口,Kimi K3 可以在单次请求中接收整个代码库、长文档以及多轮对话的完整历史。
缓存输入 token
当之前处理过的上下文被复用时,就会产生缓存输入 token。
如果复用相同或相似的上下文,计费为每 100 万 token 2 元,而非 20.00 元,降低 90%
这显著提升了重复性工作流的效率
在长上下文应用和多轮交互中尤其有用,因为大量共享上下文会被反复发送
输出 token
输出 token 是模型响应请求时生成的内容,代表实际由 AI 生成的内容,例如:
文本响应
代码生成
结构化输出 由于生成输出需要额外的计算,其定价通常高于输入 token。
结语
Kimi K3 为普通用户和开发者提供灵活的定价方式:会员计划带来完整的 Kimi 体验,基于 token 的 API 则通过自动上下文缓存将输入成本降低 90%。选择适合你工作流的方式,立即开始使用 Kimi K3。