格子灰
08-07·后端开发·10年+
国产旗舰模型扎堆,哪款最具性价比?
国产大模型这周集中炸场,选型这件事有答案了吗这一周看国产大模型的选型,头有点大。8月3日阿里发Qwen3.8-Max,2.4万亿参数,Arena全球第二;8月1日DeepSeek推V4 Flash正式版,13B活跃参数在Agent场景追平Claude Opus 4.8;再加上7月底的Kimi K3(2.8T)和GLM-5.2(744B),国产旗舰一周内同时出现四款。Artificial Analysis 8月5日的数据出来之后,这件事有了一个比较直白的答案,论综合智能,Kimi K3(57分)国产第一;Qwen3.8 Max(56分)紧跟。论自主任务执行,Qwen3.8 Max 55.4分,国产首次拿下Agentic全球第一。但论性价比,DeepSeek V4 Flash是断层。每任务成本0.03美元,同样Agentic 45.7分的Grok 4.5要0.36,差了12倍。SegmentFault实测给出的结论是,写代码选DeepSeek,做内容选通义千问,企业级交付选文心一言。如果只选一个,截止这周,大多数开发者的选择还是DeepSeek。
发布于 湖南
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn