微学AI
08-05·AI领域创作者
GPT-5.6 Luna
DeepSeekV4 Flash实测分享
单任务成本比GPT-5.6低60%
V4-Flash-0731发布四天,调用量冲到2.33万亿Token,直接登顶全球榜首。这个数字背后是有账可算的。Artificial Analysis的报告说,V4-Flash的单任务成本比GPT-5.6 Luna低大约60%,智能指数只差1分。我自己也验证了。之前跑一批日报自动化,用某个海外旗舰模型,一个月API账单大概1200块。换V4-Flash跑了三天,估下来一个月不超过400块,日报质量没降,有些细节反而更准了。不是模型更聪明,是它更"老实"——Agent场景下,它用更少的步骤完成同样的任务。每次工具调用都花钱,步数少了,成本自然降了。但便宜不等于什么场景都好用。我试过让它做纯对话和摘要,跟旧版本差别不大,有些回答甚至过于简洁,像在敷衍。一旦涉及工具调用,差距就出来了。这个模型的定位很清晰:它不是来聊天的,是来干活的。用ChatGPT的思路去用,可能会觉得不过如此。但接进Agent框架,让它操作终端、调API、读写数据库,性价比就炸了。社区里有人做了A/B对比,Agent任务完成率Flash全面领先,纯文本生成质量Pro更稳。这说明DeepSeek在后训练阶段把资源集中投向了Agent能力,而不是做一个"什么都会一点"的通用模型。我觉得这条路走得对,与其跟GPT在通用对话上死磕,不如在自己擅长的方向上做到极致。唯一担心的是公测过后的定价。如果正式版涨太多,这个性价比神话可能就到此为止了。
发布于 福建
1
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn