大厂职场观察者
08-05·测试·5年+
DeepSeekV4 Flash实测分享
284B参数干翻1.6T,这波操作属实没想到看到V4 Flash的跑分时我愣了——284B总参数、13B激活参数,远小于V4-Pro的1.6万亿。结果9项Agent基准全超自家Pro预览版。DeepSWE代码修复基准从7.3暴涨到54.4,涨幅超640%。Agent智能体终极测试25.2分,接近Opus 4.8的25.7分。更离谱的是实现路径:架构、尺寸和预览版完全一致,就重新做了后训练。没加参数没换架构,纯粹靠训练方法论把Agent能力拉到超过Pro的程度。这说明什么?AI竞争正在从“更大”转向“更聪明”。模型能力提升不一定只靠堆规模——这句话我以前不信,现在信了。
发布于 北京
1
评论
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn