Kimi K3 定价详解:套餐与 API 费用

阅读时长:8 分钟2026-07-25
Kimi K3 定价

Kimi K3 是全球首个开放的 3T 级模型,拥有 2.8T 参数,专为长程编程、知识工作和推理等前沿智能任务打造,原生支持视觉能力,并具备 100 万 token 的上下文窗口。它已在 Kimi.com、Kimi Work、Kimi Code 以及 Kimi API 上线。以下是 Kimi 会员计划与 Kimi K3 API 定价概览,帮助你选择合适的接入方式。

Kimi K3 会员计划与使用等级

使用 Kimi K3 最简单的方式是开通 Kimi 会员。Kimi 提供分级的会员计划,可满足从日常轻度使用到高强度智能体工作流的各类需求。更高等级的计划可解锁更多智能体额度、更高并发以及由 Kimi K3 驱动的最多 100 万 token 超长对话容量。

AdagioAndanteModeratoAllegrettoAllegro
按年计费(折合每月)¥0¥39 / 月¥79 / 月¥159 / 月¥559 / 月
Agent 任务并行1 个任务1 个任务2 个任务2 个任务4 个任务
Agent 优先生成队列×4 倍速度4 倍速度4 倍速度4 倍速度
K3 超长对话容量(支持百万 Tokens)××××
定制化看板
定时任务2 个任务6 个任务10 个任务15 个任务20 个任务
小组件任务2 个任务6 个任务10 个任务15 个任务20 个任务
项目数2 个项目20 个项目20 个项目20 个项目100 个项目
项目存储空间500MB20GB20GB20GB50GB
精选插件15+ 种可调用15+ 种可调用15+ 种可调用15+ 种可调用15+ 种可调用
集群功能××
集群功能运行子任务数××2 个子任务4 个子任务8 个子任务
梦境记忆××
自进化技能××
目标模式×××
Kimi Claw(云端、安卓本地和桌面端)×××
Kimi Claw 群聊×××10 个群聊10 个群聊
发布带数据库的网站×

以上价格均为年付价格。月付价格分别为每月 49 元、99 元、199 元和 699 元。Allegro 解锁 K3 的超长对话容量,支持最多 100 万 token 的上下文,适用于超长对话、大型代码库以及文档密集型研究。最新套餐详情请参见官方会员页面

Kimi K3 API 定价

Kimi K3 API 定价采用基于 token 的模式,输入和输出均按每 100 万 token(1,000,000 个 token)计费,成本清晰、可预测。

模型计费单位输入价格(缓存命中)输入价格(缓存未命中)输出价格上下文窗口
kimi-k31M tokens¥2.00¥20.00¥100.001,048,576 tokens

*此处 1M = 1,000,000,表格中的价格代表每消耗 1M tokens 的价格。

Kimi K3 是 Kimi 面向长程编程和端到端知识工作打造的旗舰模型。它始终具备推理能力,推理强度通过顶层的 reasoning_effort 字段设置。该模型支持自动上下文缓存、工具调用、JSON 模式、结构化输出,以及单次请求中完整的 100 万 token 上下文窗口。

Kimi K3 API 计费方式

Kimi K3 API 对每次请求采用基于 token 的定价模式,与模型的每次交互都会消耗 token,并按类型计费。在该模式下,token 通常分为三类:输入 token、缓存输入 token 和输出 token。

输入 token

输入 token 代表发送给模型的所有内容,包括:

  • 用户提示词

  • 系统指令

  • 对话历史或上下文 这些 token 决定了模型在生成响应之前需要处理多少上下文。凭借 100 万 token 的上下文窗口,Kimi K3 可以在单次请求中接收整个代码库、长文档以及多轮对话的完整历史。

缓存输入 token

当之前处理过的上下文被复用时,就会产生缓存输入 token。

  • 如果复用相同或相似的上下文,计费为每 100 万 token 2 元,而非 20.00 元,降低 90%

  • 这显著提升了重复性工作流的效率

  • 在长上下文应用和多轮交互中尤其有用,因为大量共享上下文会被反复发送

输出 token

输出 token 是模型响应请求时生成的内容,代表实际由 AI 生成的内容,例如:

  • 文本响应

  • 代码生成

  • 结构化输出 由于生成输出需要额外的计算,其定价通常高于输入 token。

结语

Kimi K3 为普通用户和开发者提供灵活的定价方式:会员计划带来完整的 Kimi 体验,基于 token 的 API 则通过自动上下文缓存将输入成本降低 90%。选择适合你工作流的方式,立即开始使用 Kimi K3。

常见问题

Kimi K3 API 定价是如何计算的?
Kimi K3 API 定价按 token 用量计算,以每 100 万 tokens(1,000,000 tokens)为单位计费。输入 token 在缓存未命中时按每 100 万 tokens 20 元人民币计费,缓存命中时按每 100 万 tokens 2 元人民币计费。输出 token 按每 100 万 tokens 100元人民币计费。
使用上下文缓存能节省多少费用?
复用已处理的上下文时,缓存输入 token 按每 100 万 token 2元计费,而非 20 元,输入成本降低 90%。这在长上下文应用和多轮交互中尤其有用,因为相同的上下文会被重复发送。
我应该使用 API 还是 Kimi 会员计划?
如果你想在 Kimi 工作空间中直接使用 Kimi K3,并获得智能体能力和超长对话容量,可以选择 Kimi 会员计划。如果你在构建自定义工具、智能体或需要程序化访问及精细控制 token 消耗的生产应用,则应使用 API。
Kimi K3 每次请求支持多少 token?
Kimi K3 支持 100 万 token(1,048,576 个 token)的上下文窗口,可在单次请求中处理整个代码库、长文档以及复杂的多步骤智能体任务。
哪些会员计划包含 K3 超长对话容量?
Allegro 计划解锁 K3 的超长对话容量,支持最多 100 万 token 上下文的对话。其他会员功能(如智能体任务和 Swarm 集群)均按等级递增,具体见套餐对比表。
相关推荐
Kimi Work 看板:个性化 AI 桌面组件
Kimi Work 看板:个性化 AI 桌面组件
2026-07-23
Kimi Work:你的桌面本地 AI agent
Kimi Work:你的桌面本地 AI agent
2026-07-22
Kimi Code:面向终端与 IDE 的新一代 AI 代码 agent
Kimi Code:面向终端与 IDE 的新一代 AI 代码 agent
2026-07-22
Kimi Claw:一键部署 OpenClaw Cloud,打造 7×24 小时 AI Agent
Kimi Claw:一键部署 OpenClaw Cloud,打造 7×24 小时 AI Agent
2026-07-22
多智能体系统详解:定义、优势与用途
多智能体系统详解:定义、优势与用途
2026-07-22