微学AI
06-25·AI领域创作者
Kimi代码Plan模式实用吗?
Kimi
Claude Opus 4.8
Kimi-K2.6
GPT-5.5
GPT-5.4
Qwen3.7
K2.6的Plan比K2.5理性多了
测了一圈国产模型之后,我对 Kimi Plan 的态度从"摆设"变成了"主力"。它背后是 1T 总参、32B 激活的 MoE 架构,384 个专家里每次只唤醒 8 个,工具调用准确率官方说接近 100%,搭配 Token Enforcer 校验 JSON Schema,所以 Plan 阶段它列出的步骤基本不会出现"调用了不存在的函数"这种幻觉。最让我惊艳的是 K2.6 在 SWE-Bench Pro 上拿到了 58.6 分,第一次把 GPT-5.4(57.7)和 Claude Opus 4.6(53.4)压在身下,Terminal-Bench 2.0 也跑出 66.7。我用它复刻了那个官方案例:让 Plan 模式规划"用 Zig 重写 Qwen3.5-0.8B 推理"——它给的方案分 14 轮迭代,每轮先算当前 throughput,再决定优化方向,最后实际跑出 193 tok/s,比 LM Studio 还快 20%。但 Plan 模式并非万能,遇到需要视觉判断的任务(截图报错分析 UI)时,它会反复在 plan 里写"我无法看到图片",这时候不如直接发图到多模态 Agent。另外它偶尔会"过度规划"——一个 50 行的脚本也要分五步走,反而拖慢节奏。我的经验是:改动超过 3 个文件、涉及核心业务逻辑、或者要动数据库 schema,强制开 Plan;纯文案、注释、补全类任务直接 Agent 模式秒过。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中