戴佳伟是大帅逼
08-06·AI领域创作者
GPT-5.6 Sol
V4-Flash为何能小参数反超大模型?
130亿参数,凭什么掀翻1.6万亿?
7月31日,DeepSeek悄悄上线V4-Flash正式版,没有发布会、没有直播,但开发者社区直接炸了——这个"轻量版"在9项智能体基准中全面碾压自家1.6万亿总参数的V4-Pro预览版。数字有多反直觉?Flash总参数2840亿、激活仅130亿,Pro总参数1.6万亿、激活490亿,规模差了一个数量级。但Terminal-Bench 2.1上Flash拿82.7分,Pro预览版67.9分;Agent Last Exam上Flash得25.2分,逼近Claude Opus 4.8的25.7分,Pro预览版仅15.8分。最关键的是:架构和参数规模跟预览版一模一样,一个底层结构都没动,所有提升全来自后训练。这传递了三个信号:一,参数军备竞赛的边际收益在递减。 过去两年行业疯狂堆参数,万亿十万亿往上飙,但V4-Flash证明:选对训练方法、喂对高质量数据,轻量模型一样能打。二,Agent赛道上后训练比堆参数更值钱。 核心武器三招:智能体轨迹奖励塑形,用完整执行轨迹而非单轮问答训练;工具使用课程学习,从简到繁逐步引入工具组合;效率感知对齐,惩罚不必要的token消耗。每招都不需要更大模型,但每招都需要极致工程能力。三,成本差距正在重新定义竞争规则。 Flash每百万token输入0.14美元、输出0.28美元,缓存命中仅0.003美元。对比GPT-5.6 Sol的输入5美元、输出30美元,差了几十倍。开发者实测51万token的复杂任务,花了0.53元人民币。还有一层战略意义:全部核心算子基于Triton自研,脱离英伟达CUDA生态,国产GPU可直接部署,MIT协议完全开源。一句话:AI竞争的焦点正从"更大"转向"更聪明",后训练工程能力才是2026年真正的护城河。
发布于 海南
2
8
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn