赛博摆渡人
08-05·技术支持·4年
GPT-5.6 Sol
GPT5.6和Claude编程对比
GPT-5.6真干不过Claude?
OpenAI把GPT-5.6放出来旗舰Sol。网上炸了,说Claude要被掀桌子。我一个做开发的朋友连夜拿公司项目试了圈,甩一句扎心的,别急,没那么简单。咱说清这俩比啥。编程硬基准SWE-Bench Pro,直接拿真实开源项目的真实bug、真实pull request让AI修,再用项目自己的测试验。说白了,就是老板甩个线上bug让你修的场景。跑分出来两边各扇一耳光。GPT-5.6 Sol规划编排猛,Agents Last Exam比Claude Fable 5高13分,Coding Agent Index 80对77.2压一头。可到SWE-Bench Pro真刀真枪修bug,Claude直接80%对64.6%,甩开十五个点。一句话,GPT-5.6赢规划,Claude赢执行。别问谁更强,问你手上是啥活。跨模块重构、agent并行跑脚本,GPT-5.6 Sol香,token省,每任务成本约Claude三分之一。但老codebase定位隐蔽bug、跨文件精准修改,Claude还是那个稳的兄弟。我们后端组一半人切Claude Code了,修生产bug少翻车。做开发都懂,它改出新bug半夜被运维叫起来回滚才要命。
坊间说那15个点差距,说明OpenAI漂亮图表是挑着发的。谁裸泳,等你拿自己项目跑一轮才知道
。
发布于 陕西
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn