微学AI
07-14·AI领域创作者
Kimi-K2.6
Kimi K2降本增效,实际效果如何?
Claude Sonnet 4.6
Claude Opus 4.8
K2.6登顶文本榜,性价比屠夫
上周把团队 Agent 代码从 K2.5 切到 K2.6,第一晚账单就把我愣住了——同样的代码重构任务,输出 token 少近半,但任务完成度反而明显提升。这种"少干活多办事"的感觉,在国产模型上还是头一回。K2.6 在 XSCT Arena 文本理解榜拿到 91.1 分,超过 Claude Sonnet 4.6 的 90.2 分,登上 #1/20。最让我震撼的是 Hard 档 90.9 分,是整个榜单极限档最高分——题目越难,K2.6 反而越稳。它的价格 ¥4.00/M 输入、¥16.00/M 输出,只是 Sonnet 4.6 的五分之一、Opus 4.6 的十分之一,性价比指数 47.3,第一梯队里没人能打。架构上还是那套:1T 总参数+32B 激活+384 专家的 MoE,256K 上下文,MLA 注意力配 MoonViT 视觉编码器。但最大升级在"Agent OS"层:300 子 Agent 并行调度,连续自主运行 12 小时、协调 4000 步。官方演示里,K2.6 用 Zig 语言重写 Qwen3.5-0.8B 推理引擎,12 小时内吞吐量从 15 tokens/s 推到 193 tokens/s,比 LM Studio 还快 20%。但我的实测里 K2.6 的 Agent 工具调用是明显短板——ReLE 中文榜上这个维度从 K2.5 的 65.2% 反而掉到 63.2%。更扎心的是每千次调用 100.4 元,比 qwen3.5-plus 的 22.9 元贵了四倍,能力却几乎打平。如果不是 Coding 加长程执行的强需求,老用户真没必要急着升。不过"价格屠夫"的身份是坐实了——Claude Opus 单次调用要十几块的时候,K2.6 让你十次都不心疼。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中