Kimi Code:模型厂自己把 harness 做完,再用双协议开放给别人的壳
kimi-code
Moonshot AI 的开发者编码服务,入口 kimi.com/code,在这一批产品里位置特殊:多数 harness 是壳厂接模型,Kimi Code 是模型厂自己做壳,还把 API 同时按 OpenAI 与 Anthropic 两套协议开放(OpenAI 兼容 api.kimi.com/coding/v1 国内与 api.kimi.ai/coding/v1 海外;Anthropic 兼容 api.kimi.com/coding/ 与 api.kimi.ai/coding/),并专门为 Claude Code、OpenCode、Codex、Hermes Agent 写了接入指南——等于把自家模型开放给别人的壳。客户端三套并行:Desktop(2026-09-17 正式发布,macOS Apple Silicon/Intel 与 Windows,把 CLI 的 Agent 内核搬进图形界面)、CLI(kimi 命令,功能面最全,install.sh 会校验 checksum;Windows 依赖 Git for Windows 自带的 Git Bash,可用 KIMI_SHELL_PATH 指到非标准 bash.exe)、VS Code 扩展。模型面是三个模型四个 model ID:k3、k3-256k、kimi-for-coding、kimi-for-coding-highspeed,文档强调必须填 model ID 而不是版本名(写 K3 或 K2.8 Preview 会直接调用失败),HighSpeed 拼错时不报错而是静默回落;K2.7 Code HighSpeed 约 180 tokens/s(短上下文最高 260),5–6 倍速度换 3 倍额度,且只加速模型输出,工具调用与脚本执行不受影响,所以工具占大头的一轮体感提速有限。K2.7 Code 于 2026-06-12 发布并开源,官方对 K2.6 读数 Program-Bench +10.4%、MCP Mark Verified +11.4%、SWE Marathon +76.2%,推理 token 用量降 30%(官方说法是减少 overthinking)。边界:读数均出自官方或厂商转述、未独立复算;K3 技术报告未随权重公开;额度与会员档位强绑定(1M 档约为 256K 档两倍额度、HighSpeed 三倍);旧模型退役很快(kimi-k2 2026-05-25、kimi-latest 2026-01-28、kimi-k2.5 与 moonshot-v1 2026-08-31 停用)。置信度 C(厂商宣称)。
- 置信度
- 厂商宣称
- 只有官方模型卡/发布会,无独立复测
- 关键指标
- 内置模型面(K3 / K2.8 Preview / K2.7 Code HighSpeed)
- 厂商宣称 · 2026-09
- 成熟度
- 产品
- 研究 → 演示 → 产品 → 生产
我们的判断我们给它 C 档(厂商宣称)。可确认的硬事实不少:K3 权重已开源、2.8T 参数与「896 选 16」的专家配比写进了官方文档、四个 model ID 与两套兼容协议的 Base URL 可以直接调用复核、CLI 的版本线从 v0.4.0(2026-05-27 插件系统)到 v2.1.0(2026-09-23)逐条可查、危险命令护栏与工作区信任边界是可验证的运行时行为。但我们采信为指标的那条读数——K2.7 Code 对 K2.6 的 SWE Marathon +76.2%、Program-Bench +10.4%、MCP Mark Verified +11.4%、推理 token 降 30%——全部来自官方 changelog 里「外部基准评测」的转述,既没有给出对照 harness,也没有给出迭代次数与评测框架,我们更没有独立复算;K3 的技术报告至今未随权重公开。按契约 §13.5,这只能落 vendor-claim,不能因为「模型开源」就升档:开源的是权重,不是评测。
水位判断:Kimi Code 真正的战略位置不在客户端,而在它是唯一一家把「模型 + harness + 别人的 harness」三件事同时做成的中国厂商。三条证据互相印证:其一,Cursor 官方写明 Composer 2 与 Composer 2.5 建立在 Kimi K2.5 这个开放权重 checkpoint 之上——一个美国商业 IDE 的自研旗舰编码模型,底座来自这里;其二,Kimi Code 自己按 OpenAI 与 Anthropic 两套协议开放
/coding端点,并为 Claude Code、OpenCode、Codex、Hermes Agent 各写了一份接入指南,等于主动去当别人壳里的模型;其三,/import-from-cc-codex把从竞品搬家做成一条斜杠命令。这三件事合起来是一个明确的判断:2026 年编码模型的竞争里,底座可得性已经商品化,分发靠的是「能被别人的 harness 直接装进去」。工程侧值得同行抄的是工具层的防御性细节:Write/Edit 必须先 Read 且磁盘变更即拒绝(防陈旧覆盖)、Grep 即使
include_ignored=true也仍过滤.env与私钥、Bash 超时不杀而转后台 + SIGTERM/5s/SIGKILL 两阶段终止、cron 的确定性抖动与coalescedCount合并补发、Anthropic 兼容 provider 不读环境凭据。这些不是功能列表上的卖点,而是长程 agent 不出事的必要条件,而且都写在公开文档里。要如实说清的边界:全部能力读数出自厂商;K3 架构细节目前只有博客与文档、无技术报告可核;HighSpeed 官方自述「资源有限、体验可能波动」;额度与会员档位强绑定(1M 档约两倍额度、HighSpeed 三倍),按 API 单价做容量规划会算错;旧模型退役节奏快,绑定
kimi-k2.5之类的工作流要预留迁移成本。
它解决的问题:一个模型厂自己把 harness 做完,并且开放给别人装
Kimi Code 是 Moonshot AI 面向开发者的编码服务,入口在 kimi.com/code。它的位置在这一批产品里比较特殊:大多数 harness 是「壳厂接模型」,Kimi Code 是「模型厂自己做壳」,而且同时把 API 按 OpenAI 与 Anthropic 两套协议开放出去,让别人的壳也能装自己的模型。文档里给的四条 Base URL 写得很直白——OpenAI 兼容 https://api.kimi.com/coding/v1(国内)与 https://api.kimi.ai/coding/v1(海外),Anthropic 兼容 https://api.kimi.com/coding/ 与 https://api.kimi.ai/coding/;并且专门为 Claude Code、OpenCode、Codex、Hermes Agent 写了接入指南。
客户端形态是三套并行:Desktop(2026-09-17 正式发布,macOS Apple Silicon / Intel 与 Windows,把 CLI 的 Agent 内核搬进图形界面)、CLI(kimi 命令,功能面最全)、VS Code 扩展。CLI 用 curl -fsSL https://code.kimi.com/kimi-code/install.sh | bash 安装,脚本会校验 checksum;Windows 依赖 Git for Windows 自带的 Git Bash 作为 Shell 环境,可用 KIMI_SHELL_PATH 指到非标准路径的 bash.exe。
模型面:K3 / K2.8 Preview / K2.7 Code HighSpeed,四个 model ID
Kimi Code 当前提供三个模型、四个 model ID(k3、k3-256k、kimi-for-coding、kimi-for-coding-highspeed)。文档强调要填 model ID 而不是模型版本名——写 K3 或 K2.8 Preview 会直接调用失败;而 HighSpeed 的 ID 拼错时不报错,静默回落到标准档,表现为「开了高速但没变快」。
- K3:旗舰,2.8T 参数、1M 上下文、原生视觉理解。官方称它是全球第一个 3 万亿参数级的开源模型,权重已放出。架构上用了 Kimi Delta Attention(KDA,混合线性注意力)+ Attention Residuals,MoE 稀疏度进一步拉高,靠 Stable LatentMoE 框架从 896 个专家里激活 16 个;配合训练方法与数据配方,整体 scaling 效率约为 K2 的 2.5 倍。
k3-256k是 256K 上下文档,官方明确写「k3(1M)消耗的额度约为k3-256k的两倍」。 - K2.8 Preview(model ID
kimi-for-coding):2026-09-11 在 Kimi Code 内原地全量,ID 不变、客户端与第三方工具零配置改动。定位是「性能接近 K3、思考更高效」,1M 上下文对全部会员档开放,支持low/high/max三档 thinking effort(默认max)。关掉 thinking 时,对 K3 系列与 K2.8 Preview 的请求都由「K2.8 Preview 无思考」承接。 - K2.7 Code HighSpeed(
kimi-for-coding-highspeed):与 K2.7 Code 同模型,输出速度约 180 tokens/s,短上下文场景最高 260 tokens/s,约 5–6 倍速度、3 倍额度消耗。文档对它的边界说得诚实:HighSpeed 只加速模型输出,工具调用与脚本执行不受影响,所以当一轮里工具占大头时体感提速有限。
K2.7 Code 本身在 2026-06-12 发布并开源,官方给出的三项对 K2.6 读数是 Program-Bench +10.4%、MCP Mark Verified +11.4%、SWE Marathon +76.2%,同时推理 token 用量降低 30%(官方表述为「减少 overthinking」)。第三方 effort 映射也写清楚了:ultra/max/xhigh → max,high/medium → high,low/minimum/light → low,none → 关闭思考,其它未知值返回 HTTP 400。
工具面:内置工具是运行时的一部分,不是 MCP 挂件
Kimi Code CLI 的内置工具按七组公开,并且明确区分「与 MCP 工具的不同」:内置工具由运行时直接管理、生命周期绑定会话、不需要外部进程。审批语义统一——只读工具(Read/Grep/Glob/ReadMediaFile)默认自动放行,写入与执行类(Write/Edit/Bash)默认要审批。
- 文件:
Read支持line_offset(负数从尾部数)、column_offset、n_lines、max_chars,默认 10 万字符、单次可申请到 50 万;一行放不下会分片返回并给出Next Read参数,UTF-16 LE/BE 严格解码失败时返回可读文本并每页警告有损。Write/Edit要求本会话内先 Read 过该文件,且磁盘上的文件在读取后被改过就拒绝写入——这是防陈旧覆盖的硬约束。Grep走 ripgrep,.env与私钥等敏感文件自动过滤,即使include_ignored=true也仍然过滤。 - Shell:
Bash前台默认 60s、最长 5min;超时的前台命令默认不杀,转为后台任务(受 600s 后台默认超时约束),可用bash_auto_background_on_timeout=false恢复「超时即杀」。停止走两阶段终止:SIGTERM → 5 秒宽限 → SIGKILL。stdin 永远关闭,交互式命令立即收到 EOF。 - Web / 计划 / 状态:
WebSearch、FetchURL(HTML 抽正文而非返回整页);EnterPlanMode/ExitPlanMode构成受约束的 Plan 模式——进入后Write/Edit只能写当前计划文件,TaskStop被完全禁用,退出时可选给出 1–3 个备选方案让用户挑;TodoList维护跨步骤可见的子任务清单。 - 协作:
Agent(子 agent 默认 2 小时超时)、AgentSwarm(共享 prompt 模板 + items 数组批量派生,最多 128 个子 agent,默认无上限地爬坡:先起 5 个、之后每 700ms 加 1 个,可用KIMI_CODE_AGENT_SWARM_MAX_CONCURRENCY封顶)、AskUserQuestion(1–4 个结构化多选问题,可background=true挂到后台不阻塞主任务)、NotifyUser(回合中途的短进度播报,进 Updates 面板,Ctrl-P/Ctrl-N 翻页)、Skill(只能调type="inline"的 Skill,最大嵌套 3 层)。 - 后台与定时:
TaskList/TaskOutput(内联预览最近 32KB,完整日志落盘并返回output_path)/TaskStop/WaitFor(在当前回合内等待,最长 600s,Ctrl-S steering 可提前结束);CronCreate/CronList/CronDelete把 prompt 按 5 段 cron 表达式重新注入当前会话,单会话最多 50 个活跃定时任务。
定时任务这块的工程细节值得单独拎出来:为了防止所有用户整点齐发,调度器做确定性抖动——周期任务前移 min(周期的 10%, 15 分钟),恰好落在 :00/:30 的一次性任务前移最多 90 秒;调度器错过多次触发(比如笔记本睡眠)时醒来只补发一次,prompt 包在 <cron-fire> 信封里并带 coalescedCount;存活超过 7 天的周期任务会以 stale="true" 最后触发一次然后自动删除。
权限与长程控制:三档模式、危险命令护栏、Goal 与 Tower
2026-09-02 的 v0.40.0 把原来的 YOLO / Auto / Manual 改名为 Never Ask / Ask When Needed / Always Ask,同时内置危险命令护栏:shutdown、reboot、rm -rf 这类命令在 Never Ask 模式下直接拦截,其它模式必须确认(可用 [permission] dangerous_command_guard=false 关)。这是一次口径上的收敛:自动化程度提高的同时,把「不可逆操作」单独拎出来做硬边界。
长程控制面上有几件互相咬合的事:Goal 模式(/goal <目标> 跨回合推进直到完成或撞上需要人的决策点)、Goal 队列(/goal next 排队,当前目标完成后自动接下一个)、v0.43.0 把 Goal 的时间预算改成不计入会话关闭期间并取消 24 小时上限;Tower 多智能体编排(/tower <base-branch>)与 AgentSwarm 是两种不同的并行形态;/btw 开侧信道对话而不打断主回合;v0.6.0 直接移除了每回合 1000 步的上限。
上下文管理也有明确的机制:微压缩(micro compaction)默认开启,裁剪早期过大的工具结果;provider 返回 413 上下文溢出时先压缩再重试;压缩输出默认封顶 128k tokens 以免撞 provider 的 max_tokens;会话内累计媒体超过 20MB 时,最旧的图片与视频会被省略并给出警告;切换模型或切换 reasoning effort 都会让已建立的上下文缓存失效,官方建议换新会话而不是在长会话里来回切。
生态面:Plugins / Skills / Hooks / MCP / ACP,以及一条「搬家命令」
插件系统 2026-05-27 上线(v0.4.0),/plugins 是分页面板:Installed / Official(Kimi 维护)/ Third-party / Custom(GitHub URL、zip 或本地路径,安装前有确认提示)。官方插件里两个最有辨识度:Kimi Computer Use(2026-08-06 起支持 Windows x64,Windows 10 1903+ / Windows 11)与 Kimi WebBridge(让 agent 控制用户真实浏览器)。Kimi Datasource 是官方数据插件,覆盖五个数据域——股票市场、宏观经济、企业工商、学术文献、法律法规,2026-08-20 一次性加了 13 个数据源:中国政府数据(NDA/NBS)与标准(GB/HB/DB/TT)、八个国际组织数据集(WHO、FAO、UNSD、ECB、Eurostat、UNICEF、OECD、FRED)、新华财经与财新。
扩展面的四种标准接口都齐:MCP(stdio / streamable HTTP / 传统 SSE)、Agent Skills(含实验性的 Sub-Skill:sub-skill.review 审计既有 Skill、sub-skill.consolidate 合并成层级组)、Hooks(在 TurnStarted/UserPromptQueued/TaskStarted/SessionHeartbeat 之外还有专门的 Interrupt 事件——用户按 Esc 打断时触发它而不是 Stop,外部工具因此不会把被打断的回合误判成仍在运行)、ACP(kimi acp 子命令,让 Zed、JetBrains AI Chat 等编辑器直接驱动 Kimi 的会话与工具调用)。
还有一条很能说明竞争态势的命令:/import-from-cc-codex——一步把 Claude Code 与 Codex 的指令、Skills、MCP 配置导入 Kimi Code。迁移成本被做成了一条斜杠命令。
跨端与远程:Remote Control、kimi web、kimi vis
Remote Control 在 v0.42.0(2026-09-09)转正式,不再需要实验开关:用手机或另一台电脑接管本地会话。kimi web(v0.17.0,等价于 kimi server run --open)把当前会话搬进浏览器聊天界面,--host 可以把 web 服务暴露到本机之外,并用 token 鉴权与限流加固。kimi vis 是会话可视化器,支持 --port/--host/--no-open 与 kimi vis <sessionId> 深链。Shell 模式(输入 !)让终端命令不离开对话直接跑,输出写回上下文供后续回合使用,长命令 Ctrl+B 转后台。
Desktop 端把「过程可见」做成了产品语言:工具调用、思考、每一轮改动的文件全部呈现在界面上;敏感操作弹审批;内置浏览器停在右侧面板、标签页跟随会话、页面上下文与 Agent 共享,还支持截图标注、选中文本评论、@ 文件提及与网页元素拾取。
商业面与安全边界
Kimi Code 是 Kimi 会员权益的一部分,与会员订阅共享同一份额度,CLI / VS Code / Desktop / 第三方工具的调用都计入这一份。新套餐取消了周额度上限,只保留 5 小时滚动速率窗口;Go 档没有编码额度,Plus 及以上才能用 Kimi Code,K3 需要 Plus 及以上、K3 的 1M 上下文与 HighSpeed 需要 Pro 及以上。额度用尽后可开 Extra Usage 兜底(与 Kimi web 共享同一钱包,单次充值最低 ¥25、每日最多 10 次且不超过 ¥3,000、余额上限 ¥10,000,可设月度消费上限),官方给的量级示例是:一次简单请求约 ¥0.03,一次复杂多步任务约 ¥1.6。
安全侧有几条实打实的加固:v2.1.0 收紧工作区信任边界,文件工具不能再通过符号链接跳出工作目录,项目级配置只在工作区被信任后生效;v0.36.0 之后不受信任的工作区无法再植入同名的 fd/stty 可执行文件;v0.16.0 起 Anthropic 兼容 provider 不再读取环境里的 Anthropic shell 凭据与自定义 header,避免凭据意外外泄。
边界
K3 / K2.8 / K2.7 Code 的读数都出自官方或「外部基准评测」的厂商转述,我们没有独立复算;K3 的技术报告尚未随权重一起公开,架构细节目前以官方博客与文档为准;HighSpeed 官方自己写明「资源有限,体验可能波动,正在逐步扩容」;额度体系与会员档位强绑定,按 API 单价做容量规划会算错(1M 上下文档约为 256K 档的两倍额度、HighSpeed 为三倍);旧模型退役节奏很快——kimi-k2 系列 2026-05-25 停用、kimi-latest 2026-01-28 停用、kimi-k2.5 与 moonshot-v1 系列 2026-08-31 停用。