Kimi K3 价格详解:套餐与 API 费用

阅读时长:8 分钟2026-08-12
Kimi K3 价格

Kimi K3 是全球首个开放的 3T 级模型,这款 2.8T 参数的旗舰模型专为长程编程、知识工作和推理等前沿智能任务打造,具备原生视觉能力和 1M token 的上下文窗口。它已在 Kimi.com、Kimi Work、Kimi Code 及 Kimi API 上线。以下是 Kimi 会员套餐与 Kimi K3 API 价格的概览,帮助您选择合适的接入方式。

Kimi K3 会员套餐与用量层级

使用 Kimi K3 最简单的方式是通过 Kimi 会员。Kimi 提供分层套餐,可满足从日常轻度使用到高强度智能体工作流的不同需求。更高层级的套餐可解锁更多智能体额度、更高并发,以及由 Kimi K3 驱动的最高 1M token 超长对话容量。

ModeratoAllegrettoAllegroVivace
按年付费(月均价)15 美元 / 月31 美元 / 月79 美元 / 月159 美元 / 月
智能体并发任务数2 个任务2 个任务4 个任务4 个任务
智能体优先队列4 倍速度4 倍速度4 倍速度4 倍速度
K3 超长对话容量(最高 100 万 token)××
可自定义仪表盘
定时任务10 个任务15 个任务20 个任务25 个任务
Widget 任务10 个任务15 个任务20 个任务25 个任务
插件支持 15+ 种类型支持 15+ 种类型支持 15+ 种类型支持 15+ 种类型
集群
集群运行子任务2 个子智能体4 个子智能体8 个子智能体8 个子智能体
梦境记忆
自我进化技能
目标×
Kimi Claw(网页版、安卓端、电脑端)×
与 Claw 群聊×10 个群聊10 个群聊10 个群聊
部署带数据库的网站

以上价格均为年付价格。也可选择月付,价格分别为每月 $19、$39、$99 和 $199。Allegro 和 Vivace 可解锁 K3 的超长对话容量,支持最多 1M tokens 的上下文,适用于超长对话、大型代码库和大量文档的研究场景。最新的套餐详情请参见官方会员页面

Kimi K3 API 价格

Kimi K3 API 采用按 token 计费的模式,输入和输出均按每 1M tokens(100 万 tokens)计费,成本清晰、可预测。

模型单位输入价格(缓存命中)输入价格(缓存未命中)输出价格上下文窗口
kimi-k31M token$0.30$3.00$15.001,048,576 token

Kimi K3 是 Kimi 面向长程编程和端到端知识工作的旗舰模型。它始终进行推理,推理强度可通过顶层的 reasoning_effort 字段设置。该模型支持自动上下文缓存、工具调用、JSON 模式、结构化输出,并可在单次请求中提供完整的 1M-token 上下文窗口。

Kimi K3 API 计费方式

Kimi K3 API 对每次请求采用按 token 计费的模式,与模型的每次交互都会消耗 token,并按 token 类型计费。在该模式下,token 一般分为三类:输入 token、缓存输入 token 和输出 token。

输入 token

输入 token 代表发送给模型的所有内容,包括:

  • 用户提示词

  • 系统指令

  • 对话历史或上下文 这些 token 决定了模型在生成回复前需要处理的上下文量。凭借 1M-token 的上下文窗口,Kimi K3 可以在一次请求中容纳完整的代码库、长文档以及扩展的多轮对话历史。

缓存输入 token

当此前处理过的上下文被重复使用时,就会产生缓存输入 token。

  • 如果重复使用相同或相似的上下文,将按每 1M tokens $0.30 计费,而非 $3.00,降幅达 90%

  • 这大幅提升了重复性工作流的效率

  • 这一机制在长上下文应用和多轮交互中尤为有用,此类场景通常会反复发送大量共享上下文

输出 token

输出 token 是模型响应请求时生成的内容,代表 AI 实际生成的内容,例如:

  • 文本回复

  • 代码生成

  • 结构化输出 由于输出生成需要额外的算力,其定价通常高于输入 token。

结语

Kimi K3 为普通用户和开发者都提供了灵活的定价方案:面向完整 Kimi 体验的会员套餐,以及支持自动上下文缓存、可将输入成本降低 90% 的按 token 计费 API。选择适合你工作方式的方案,即刻开始使用 Kimi K3。

常见问题

Kimi K3 API 的价格如何计算?
Kimi K3 API 的价格根据 token 用量计算,按每 1M token(1,000,000 token)计费。输入 token 在缓存未命中时按每 1M token 3.00 美元计费,缓存命中时按每 1M token 0.30 美元计费。输出 token 按每 1M token 15.00 美元计费。所有价格均不含适用税费,税费将在结算时根据您的计费地区计算。
使用上下文缓存能节省多少成本?
当之前处理过的上下文被重复使用时,缓存的输入 token 将按每 1M token 0.30 美元计费,而非 3.00 美元,输入成本可降低 90%。这对于长上下文应用以及需要反复发送相同上下文的多轮交互场景尤其有用。
我应该使用 API 还是 Kimi 会员套餐?
如果您想在 Kimi 工作空间中直接使用 Kimi K3,并获得智能体能力和超长对话容量,可以选择 Kimi 会员套餐。如果您正在构建自定义工具、智能体或需要以编程方式访问并精细控制 token 消耗的生产应用,则应使用 API。
Kimi K3 单次请求支持多少 token?
Kimi K3 支持 1M token(1,048,576 token)的上下文窗口,能够在单次请求中处理完整代码库、长文档以及复杂的多步骤智能体任务。
哪些会员套餐包含 K3 超长对话容量?
Allegro 和 Vivace 套餐可解锁 K3 超长对话容量,支持最多 1M token 的上下文对话。其他会员权益,如智能体任务和集群,则会随套餐层级相应扩展,详见套餐对比表。
相关推荐
Kimi Work Dashboard:个性化 AI 仪表盘与小组件
Kimi Work Dashboard:个性化 AI 仪表盘与小组件
2026-08-12
Kimi Work:你桌面上的本地 AI agent
Kimi Work:你桌面上的本地 AI agent
2026-08-12
Kimi Code:面向终端与 IDE 的新一代 AI 代码智能体
Kimi Code:面向终端与 IDE 的新一代 AI 代码智能体
2026-08-12
Kimi Claw:一键部署 OpenClaw 云端,24 小时在线 AI 智能体
Kimi Claw:一键部署 OpenClaw 云端,24 小时在线 AI 智能体
2026-08-12
多智能体系统详解:定义、优势与应用
多智能体系统详解:定义、优势与应用
2026-08-12