大厂职场观察者
08-05·测试·5年+
DeepSeekV4 Flash实测分享
284B参数干翻1.6T,这波操作属实没想到看到V4 Flash的跑分时我愣了——284B总参数、13B激活参数,远小于V4-Pro的1.6万亿。结果9项Agent基准全超自家Pro预览版。DeepSWE代码修复基准从7.3暴涨到54.4,涨幅超640%。Agent智能体终极测试25.2分,接近Opus 4.8的25.7分。更离谱的是实现路径:架构、尺寸和预览版完全一致,就重新做了后训练。没加参数没换架构,纯粹靠训练方法论把Agent能力拉到超过Pro的程度。这说明什么?AI竞争正在从“更大”转向“更聪明”。模型能力提升不一定只靠堆规模——这句话我以前不信,现在信了。
发布于 北京
1
评论
2
未登录
友善发言
image-upload
评论
加载中