Kimi K3 是全球首个开放的 3T 级模型,这款 2.8T 参数的旗舰模型专为长程编程、知识工作和推理等前沿智能任务打造,具备原生视觉能力和 1M token 的上下文窗口。它已在 Kimi.com、Kimi Work、Kimi Code 及 Kimi API 上线。以下是 Kimi 会员套餐与 Kimi K3 API 价格的概览,帮助您选择合适的接入方式。
Kimi K3 会员套餐与用量层级
使用 Kimi K3 最简单的方式是通过 Kimi 会员。Kimi 提供分层套餐,可满足从日常轻度使用到高强度智能体工作流的不同需求。更高层级的套餐可解锁更多智能体额度、更高并发,以及由 Kimi K3 驱动的最高 1M token 超长对话容量。
| Moderato | Allegretto | Allegro | Vivace | |
|---|---|---|---|---|
| 按年付费(月均价) | 15 美元 / 月 | 31 美元 / 月 | 79 美元 / 月 | 159 美元 / 月 |
| 智能体并发任务数 | 2 个任务 | 2 个任务 | 4 个任务 | 4 个任务 |
| 智能体优先队列 | 4 倍速度 | 4 倍速度 | 4 倍速度 | 4 倍速度 |
| K3 超长对话容量(最高 100 万 token) | × | × | ✓ | ✓ |
| 可自定义仪表盘 | ✓ | ✓ | ✓ | ✓ |
| 定时任务 | 10 个任务 | 15 个任务 | 20 个任务 | 25 个任务 |
| Widget 任务 | 10 个任务 | 15 个任务 | 20 个任务 | 25 个任务 |
| 插件 | 支持 15+ 种类型 | 支持 15+ 种类型 | 支持 15+ 种类型 | 支持 15+ 种类型 |
| 集群 | ✓ | ✓ | ✓ | ✓ |
| 集群运行子任务 | 2 个子智能体 | 4 个子智能体 | 8 个子智能体 | 8 个子智能体 |
| 梦境记忆 | ✓ | ✓ | ✓ | ✓ |
| 自我进化技能 | ✓ | ✓ | ✓ | ✓ |
| 目标 | × | ✓ | ✓ | ✓ |
| Kimi Claw(网页版、安卓端、电脑端) | × | ✓ | ✓ | ✓ |
| 与 Claw 群聊 | × | 10 个群聊 | 10 个群聊 | 10 个群聊 |
| 部署带数据库的网站 | ✓ | ✓ | ✓ | ✓ |
以上价格均为年付价格。也可选择月付,价格分别为每月 $19、$39、$99 和 $199。Allegro 和 Vivace 可解锁 K3 的超长对话容量,支持最多 1M tokens 的上下文,适用于超长对话、大型代码库和大量文档的研究场景。最新的套餐详情请参见官方会员页面。
Kimi K3 API 价格
Kimi K3 API 采用按 token 计费的模式,输入和输出均按每 1M tokens(100 万 tokens)计费,成本清晰、可预测。
| 模型 | 单位 | 输入价格(缓存命中) | 输入价格(缓存未命中) | 输出价格 | 上下文窗口 |
|---|---|---|---|---|---|
| kimi-k3 | 1M token | $0.30 | $3.00 | $15.00 | 1,048,576 token |
Kimi K3 是 Kimi 面向长程编程和端到端知识工作的旗舰模型。它始终进行推理,推理强度可通过顶层的 reasoning_effort 字段设置。该模型支持自动上下文缓存、工具调用、JSON 模式、结构化输出,并可在单次请求中提供完整的 1M-token 上下文窗口。
Kimi K3 API 计费方式
Kimi K3 API 对每次请求采用按 token 计费的模式,与模型的每次交互都会消耗 token,并按 token 类型计费。在该模式下,token 一般分为三类:输入 token、缓存输入 token 和输出 token。
输入 token
输入 token 代表发送给模型的所有内容,包括:
用户提示词
系统指令
对话历史或上下文 这些 token 决定了模型在生成回复前需要处理的上下文量。凭借 1M-token 的上下文窗口,Kimi K3 可以在一次请求中容纳完整的代码库、长文档以及扩展的多轮对话历史。
缓存输入 token
当此前处理过的上下文被重复使用时,就会产生缓存输入 token。
如果重复使用相同或相似的上下文,将按每 1M tokens $0.30 计费,而非 $3.00,降幅达 90%
这大幅提升了重复性工作流的效率
这一机制在长上下文应用和多轮交互中尤为有用,此类场景通常会反复发送大量共享上下文
输出 token
输出 token 是模型响应请求时生成的内容,代表 AI 实际生成的内容,例如:
文本回复
代码生成
结构化输出 由于输出生成需要额外的算力,其定价通常高于输入 token。
结语
Kimi K3 为普通用户和开发者都提供了灵活的定价方案:面向完整 Kimi 体验的会员套餐,以及支持自动上下文缓存、可将输入成本降低 90% 的按 token 计费 API。选择适合你工作方式的方案,即刻开始使用 Kimi K3。