微学AI
07-18·AI领域创作者
DeepSeek和ChatGPT到底买谁?
开权重打进前十,这事儿不简单
上周在内网部署完DeepSeek V4,盯着一台A100跑了一整夜推理,第二天早上看日志,心里五味杂陈。LMArena七月榜,DeepSeek V4 Pro排在第17位,Elo 1463。前面是GPT-5.5、Claude Opus 4.8、Gemini 3.1 Pro这些闭源旗舰。听起来排名不高,但换个角度——这是唯一一个打进前二十的开权重模型。MIT协议,685B参数,你可以自己部署、自己微调、自己改system prompt。这一点,OpenAI给不了你。我测了几个具体场景。代码生成,HumanEval DeepSeek 91.5%,ChatGPT 95%,差3.5个点,但DeepSeek生成的代码风格更紧凑,少那些啰嗦的注释和过度防御性的错误处理,我们组的后端同事反而更喜欢。数学推理,AIME 2025 DeepSeek 93.1%,这个分数放在一年前是天花板级别。MMLU-Pro它拿了85%,排第一,压过了Qwen和GLM。但有个坎我得说清楚。DeepSeek的拒答模式跟西方模型不一样,技术类和灰色地带更宽松,某些中国相关的政治问题更敏感。我们在内网用还好,要是做面向C端的产品,这块得自己加一层guardrail。社区已经有人出了改过system prompt的变体,可以参考。还有个细节让我印象深刻。DeepSeek的缓存命中只要$0.0028/M,是原价的2%。我们问数系统的system prompt是固定的,缓存命中率能到90%以上,实际成本比账面还低一个数量级。GPT那边也有缓存,打一折,但基数太高,打完折还是贵。开源不是情怀,是实打实的工程优势。
发布于 福建
分享
评论
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn