最新动态
记录 Kimi Code 各产品的新功能与核心修复,重点介绍最值得关注的变化。
kimi web 改为前台运行,kimi server 整体废弃
kimi web 现在在当前终端前台运行并自动打开浏览器,按 Ctrl+C 即可停止;旧的 kimi server 命令树已整体废弃,相关子命令均已移除,仅保留 kimi server kill 作为停止 0.28.0 之前后台服务的回退。→ kimi web
思考强度持久化更保守
模型切换后,思考强度设置现在仅保留低于该模型最高档(max)的档位,避免因旧 max 值不被支持而出现空白或无响应的选择器。→ 模型配置
此外:Web 模型切换器现在会提示切换模型或思考强度将使已有提示词缓存失效;修正了 YOLO 与 Auto 权限模式的描述,明确 YOLO 自动批准工具但仍可能提问,而 Auto 完全自主、不会提问。
我们迄今能力最强的模型 Kimi K3 正式发布并开源,现已接入 Kimi Code。
模型规模与架构
2.8 万亿参数,基于 KDA 混合线性注意力机制与 Attention Residuals 构建,是全球首个开源的 3 万亿级别模型。
长上下文与多模态
原生支持视觉理解,最高 100 万 token 上下文窗口,可处理大规模代码库与长程连贯推理。
编程与 Agent 优势
尤其擅长长程编程、游戏 / 3D 与知识类任务;在极少人工监督下即可持续完成长时间工程任务,在 Kernel 优化、GPU 编译器、芯片设计、科研编程等复杂场景中表现出色。
对比表现
整体能力稳居第一梯队,已稳定超过 Opus 4.8、GPT 5.5 等主流模型;在 Kernel 优化等高难度编程任务中,表现接近当前最强闭源模型。
会员权限
Moderato 及以上会员可调用 Kimi K3,Allegretto 及以上会员可解锁 100 万上下文。K3 支持 low / high / max 三档思考强度,可按任务复杂度自由切换。→ 模型配置
使用建议
切换模型会使已建立的上下文缓存失效,刚切换时消耗会偏高;建议开启新会话再使用 Kimi K3,效果更好、消耗更少。
coder 子 Agent 能力对齐主 Agent
coder 子 Agent 现在支持后台任务、待办列表、Plan 模式、Skill 调用与嵌套 Agent,可独立完成更复杂的编码工作流。→ Agent 与子 Agent
/model 与 /effort 切换缓存提示
切换模型或思考程度时会提示已有提示词缓存失效,并建议通过 /new 新开会话避免额外 token 开销。→ 斜杠命令
此外:修复了上下文大小指示器低估模型实际上下文用量的问题;恢复的会话没有新活动时不再被错误标记为刚更新。
内置文档问答 Skill
新增内置 /check-kimi-code-docs:直接依据官方文档回答 Kimi Code 的产品问题(CLI 用法、配置、会员、错误码),并在答案中附上来源链接,不确定的用法不必再离开终端翻文档。→ 内置 Skill 命令
此外:每步 LLM 调用的重试上限从 3 次提高到 10 次,供应商侧 429 / 过载等临时失败会在整轮失败前自动重试;print 模式(kimi -p)也不再跑完一轮就退出,只要还有未完成的后台任务就保持运行、把结果回馈给主 Agent 继续处理(print_background_mode 默认 steer,后台任务与子 Agent 默认不再超时)。
会话导出
Web 界面新增会话导出:运行 /export 或在会话的更多菜单中选择「导出会话」,即可将会话内容与故障排查日志打包为 ZIP 下载(上限 64 MiB),便于存档或反馈问题。→ 导出会话
前台命令超时后转入后台
前台 Bash 命令触及超时后不再被直接终止,而是自动转入后台继续运行,完成时回报结果,长耗时命令不会再半途丢失。如需恢复超时即终止的行为,将 [background] 的 bash_auto_background_on_timeout 设为 false。→ 内置工具 · Shell
此外:会话 fork 现在完整保留媒体附件、plan 文件、后台任务输出与 cron 任务,fork 失败也不再留下残缺副本;kimi web 默认切换到重构后的 Agent 引擎。
⚡ 高速版正式上线
Kimi Code 现提供普通版与高速版两档:同一模型、编码能力一致,高速版输出速度约为普通版的 5–6 倍。CLI 内输入 /model 一键切换,第三方工具将 model ID 配置为 kimi-for-coding-highspeed 即可。高速版需订阅 Allegretto 及以上档位会员。→ 如何切换模型
加油包(Extra Usage)上线
订阅额度用尽后,可用加油包余额继续发起请求,无视会员的月 / 周 / 小时额度限制——任意额度触顶时都能用,使用时只扣加油包余额,不影响会员额度刷新。仅订阅会员可开启,入口在 Kimi 主页 → 设置 → 会员计划 → 我的额度。→ 了解加油包
已归档会话
Web 界面新增「已归档会话」页面,可浏览并一键恢复已归档的会话,前往「设置 → 已归档」即可查看。
思考内容跨轮次保留
Kimi 模型开启 Thinking 时,现在默认在多轮之间保留推理内容,让模型延续此前的思路;如需关闭,可设置 [thinking] keep = "off"。→ 模型配置
压缩摘要一键查看
上下文压缩完成后,TUI 会显示本次压缩摘要;按 Ctrl-O 即可在压缩块中显示或隐藏摘要,与折叠工具输出共用同一快捷键。→ 交互与输入
此外:新增实验性的按需工具加载(select_tools),开启 tool-select 标志后,支持的模型会按需加载 MCP 工具而非每次发送全部,以保留供应商的 prompt cache;并修复了会话已存在于磁盘却在列表中缺失、或直接访问返回 404 的问题,服务器现在会在启动时重建会话索引。
自动压缩超大图片
上传的图片若超过模型限制,Kimi Code 会在送达模型前自动降采样并重新编码,降低视觉 token 成本,同时避免供应商因图片过大而报错。
模型配置覆盖
新增 [models."<alias>".overrides] 配置项,可覆盖供应商刷新后的模型元数据(如思考强度档位、默认 effort 等),让自定义模型配置在刷新后仍然生效。→ 模型配置
Web UI 全新设计系统
内置 web 界面采用新的设计系统,包括更新的配色、字体排版、间距、明暗调色板,以及更细腻的进入/退出与展开/折叠动画,整体视觉和交互更统一。
此外:新增 Cmd/Ctrl+K 会话搜索面板,可按标题、工作区和最近提示词快速定位会话;连续工具调用现在会归组为可折叠堆栈,diff 行数与图片/视频/音频结果都能更紧凑地展示。
视频输入与 Anthropic 兼容协议
Kimi Code 现已支持 Anthropic 兼容协议;配合 ReadMediaFile 工具,可将视频作为多模态内容发送给具备视觉能力的模型,能力随模型的 image_in / video_in 而定。→ 内置工具
Web 完成提示音与通知
内置 web UI 新增完成提示音、完成通知与问题通知,并在设置中分别提供开关。问题通知默认关闭,仅在你主动开启后,才会把问题文本推送到桌面。
自定义出站请求头
新增 KIMI_CODE_CUSTOM_HEADERS 环境变量,可为出站 LLM 请求自定义请求头(按行写 Name: Value),并会向非 Kimi 供应商发送 User-Agent 请求头。
此外:遇到供应商 413 上下文溢出时,现在会先压缩再重试以恢复,并默认将压缩输出限制在 128k token,避免触发供应商的 max_tokens 错误。
Shell 模式
在输入框中键入 ! 即可进入 Shell 模式,不离开对话就能运行终端命令,输出会写入上下文供后续轮次使用;对于长时间运行的命令,按 Ctrl+B 可将其移至后台。例如运行 !gh auth login 登录 GitHub CLI,无需新开终端。→ Shell 模式
将 Web 服务暴露到互联网
kimi web 新增 --host 选项,可将 web 服务器暴露到本机以外,并配套加固了 token 鉴权、限流等安全措施,便于在远程机器上访问会话界面。→ kimi web
全新的插件管理面板
/plugins 重新设计为单个标签页面板:Installed 管理已安装插件、Official 浏览 Kimi 官方 marketplace、Third-party 浏览第三方 marketplace、Custom 从 GitHub URL、zip 或本地路径安装,用 Tab / Shift-Tab 切换;安装第三方插件前会先弹出确认提示。→ Plugins
此外:修复了 Linux 上由原生剪贴板错误导致的启动崩溃;/reload 现在会刷新插件 Skill,使插件变更在当前会话即时生效,无需新开会话。
我们最新的代码模型 Kimi K2.7 Code 正式发布并开源,现已在 Kimi For Coding 中上线,新模型仅在 Thinking On(开启思考模式)状态下生效。
编码与智能体能力较 K2.6 全面提升
Program-Bench 提升 10.4%,MCP Mark Verified 提升 11.4%,SWE Marathon 提升 76.2%。
推理效率
改善过度思考问题,推理 token 用量较 K2.6 降低 30%。
长程编码
指令遵循能力提升,端到端编码任务成功率更高。
⚡ Kimi K2.7 Code 高速版(即将开始内测)
同一个模型,输出速度约为普通版的 5-6 倍。
Interrupt hook 事件
用户中断当前轮次时(例如按下 Esc),hooks 现在能收到专门的 Interrupt 事件——此时 Stop 不再触发,由它替代,外部工具不会再误以为轮次仍在运行。超时等程序性中断不会触发该事件。→ 事件一览
Kimi Datasource 新增法律法规数据
官方数据插件升级到 v3.2.0,新增中国法律法规与司法案例查询,现已覆盖股票行情、宏观经济、企业工商、学术文献、法律法规五大数据源。→ 插件介绍
此外:修复了 OpenAI 兼容 Chat Completions 下工具输出中的图像丢失问题;v0.13.1 起 /undo 不带参数会打开交互式选择器,按条挑选要撤销的提示词(→ 会话管理)。
自定义颜色主题
内置 dark / light 配色之外,现在可以用 JSON 文件定义自己的调色板——只写想改的颜色,其余沿用基准配色,文件名就是主题名。也可以直接运行 /custom-theme 让 Kimi 帮你选色、生成主题文件并写入 ~/.kimi-code/themes/。→ 自定义主题
/import-from-cc-codex 一键导入
从 Claude Code 和 Codex 导入选定的指令、Skills 和 MCP 设置,迁移到 Kimi Code 不用逐项手动重配。→ 内置 Skill 命令
此外:marketplace 列表会标出已安装 plugin 的可用更新,选中按 Enter 即可升级(→ Plugins);设备登录在浏览器无法打开时保持 URL 和验证码可见。
/swarm 多 Agent 并行任务
用 /swarm <任务> 启动群组模式——多个 Agent 并行拆解同一目标,带实时进度展示和速率限制自动重试,任务完成后自动退出群组模式。→ 斜杠命令
代理支持
现在完整识别 HTTP_PROXY、HTTPS_PROXY、ALL_PROXY、NO_PROXY 标准环境变量,SOCKS 代理也可用(socks5://、socks4:// 等 scheme)。本地回环地址始终直连,配置代理不会影响 localhost 上的 MCP 服务。→ 环境变量
Goal / 后台问题 / Sub-Skill 正式发布
这三项功能不再需要实验功能 flag,默认可用。微压缩(micro compaction)同步默认开启——自动清理较旧的大型工具结果,减少上下文占用;如需关闭,在 config.toml 中设置 experimental.micro_compaction = false。(该功能已于 v0.22.1 移除。)
此外:Homebrew 安装时自动用 brew upgrade kimi-code 更新;KIMI_CODE_HOME 设置后 Skills 和全局 Agent 指令从该目录加载;审批面板超长 shell 命令自动折行展示完整内容;多项 Goal 模式和 ACP 路由修复。
内置 Skill 直接变为斜杠命令
内置 Skill(如 update-config)现在直接出现在斜杠命令面板里,不再需要加 skill: 前缀——输入 / 即可看到,排在外部 Skill 前面。→ 斜杠命令
Sub-Skill 发现机制(实验)
新增实验性 Sub-Skill 系统,内置 sub-skill.review(审查现有 Skill)和 sub-skill.consolidate(将 Skill 整合为层级分组)。通过 KIMI_CODE_EXPERIMENTAL_SUB_SKILL=1 启用。→ Agent Skills
此外:YOLO 模式下启动 Goal 前会先确认并建议切换到 Auto 模式;子 Agent 超时后显示 resume 提示;Goal 队列修复多处 bug。
Goal 队列
用 /goal next <目标> 提前排好后续任务,当前 Goal 完成后自动衔接,不用守着等、不用手动触发。/goal next manage 打开交互管理器,随时调整顺序。→ 使用目标模式
实验功能面板(/experiments)
TUI 内输入 /experiments 打开可视化开关面板,勾选后自动写入 config.toml 并重载会话,无需手改配置文件。
新增内置 update-config Skill
现在可以让 Kimi 直接编辑它自己的配置文件了。
此外:/reload 修改配置后原地重载会话(→ 斜杠命令);kimi doctor 一条命令校验配置文件格式(→ kimi doctor);Windows 缺少 Git Bash 时启动前提前报错。
自主 Goal 模式(实验)
用 /goal <目标> 启动后,Kimi 会跨多个轮次持续推进同一个目标,直到完成或遇到需要你决策的阻塞。→ 自主 goal
后台结构化提问
Agent 遇到需要你做选择的问题时,会挂到后台继续处理其他步骤,不再因为一个小问题卡住整个流程。→ AskUserQuestion
kimi provider 子命令
在终端直接增删供应商,无需进入 TUI,适合脚本和 CI 场景。→ kimi provider
此外:后台自动更新默认开启,可在 tui.toml 中关闭;上下文压缩(/compact)时待办列表会附在摘要里,防止 Agent 忘记中断前的进度。
OpenAI 兼容推理模型开箱即用
DeepSeek、Qwen、One API 等带 thinking 的模型无需额外配置即可使用。→ openai 供应商
/logout 支持选择供应商
退出时弹出选择器,避免误退出其他供应商的登录态。
/connect 命令
从公共目录搜索供应商并一键配置,无需手写配置文件。(v0.7.0 起已升级为 /provider。)
Kimi Code CLI 新版首发,底层从 Python / uv 完整重写为 TypeScript / Node.js。这不是一次渐进式更新,而是一个新起点——核心架构、安装方式、配置格式全面升级。
与旧版 kimi-cli 的主要区别:
| 对比项 | 旧版 kimi-cli | 新版 Kimi Code CLI |
|---|---|---|
| 运行时 | Python + uv | Node.js(无 Python 依赖) |
| 安装 | uv tool install | 一行 curl 脚本或 npm install -g |
| 配置文件 | ~/.kimi/config.toml | ~/.kimi-code/config.toml(格式不兼容) |
| 终端界面 | 基础文本输出 | 全功能 TUI(对话视图 + 状态栏 + 审批面板) |
| 启动速度 | 较慢(Python 冷启动) | 更快(Node.js 原生二进制) |
| 多供应商支持 | 有限 | 内置 Anthropic / OpenAI / Gemini / Vertex 等 |
| Agent 子任务 | 不支持 | 内置 coder / explore / plan 三种子 Agent |
| Plugin 系统 | 不支持 | 支持(v0.4.0 起) |
| 定时任务 | 不支持 | 支持(v0.5.0 起) |
已有 kimi-cli 数据(配置、会话、MCP 声明)可通过 kimi migrate 一键迁移。→ 版本升级