满眼星河12138
08-03·AI领域创作者
GPT-5.6 Luna
DeepSeekV4 Flash实测分享
DeepSeek V4Flash实测分享
8月2日,DeepSeek V4 Flash正式版上线,我第一时间上手测了一轮。结论就一句话:这玩意儿确实能打,而且能打到让同行睡不着觉。Artificial Analysis发布当天就把Flash-0731放上了榜单,智能指数50分,比4月发布的Flash预览版高了10分,比自家V4-Pro预览版还高了6分。只比GPT-5.6 Luna低1分,GLM-5.2和Muse Spark 1.1都是51分,开源榜第一的Kimi K3是57分。最让我惊讶的是Agent智能体终极测试,Flash得分25.2,接近Opus-4.8的25.7,远高于V4-Pro预览版的15.8。一个轻量版模型,在Agent能力上碾压了自己的旗舰预览版,这操作确实够狠。284B总参数,MoE架构,激活参数更少,所以跑起来比想象中轻很多。接入Codex之后体验很流畅,不会随便断开,输出跟原生的一样。速度也是真快。有实测对比,GPT最强大模型跑了1分47秒,DeepSeek只花了40秒,价格差了十几倍到上百倍。一个模型,跑得比GPT快一倍多,价格只有几十分之一。开发者用脚投票是迟早的事。Flash在接入Hermes的实际使用中选择和调用skill的准确度总体还不错,可以根据工具返回结果调整后续步骤。DeepSeek的节奏一直是“慢但稳”。预览版等了几个月才等到Flash正式版,但正式版的稳定性确实比预览版好得多。V4 Flash正式版用更少的参数,干出了比Pro预览版更高的分数。一个靠性价比打天下的公司,正在用实力证明:便宜也能有实力,开源也能做到顶尖。
发布于 中国香港
分享
评论
未登录
友善发言
image-upload
评论
加载中