SWE Pro 官报数值上,DeepSeek V4的官报在55%,GPT-5.5 官报 58.6%,但两者的实际debug手感,可能差了有10倍。
GPT-5.5能瞬间定位到问题代码,找出关键原因,1-2发就可以修复(70%的情况下 一发就可以修复),对用户的指令心领神会。
DeepSeek V4对自己写的代码,定位都不大清晰,原因分析不到位。视角卡住的问题,改三版,还是同样的问题,感觉改都没改,而且我也提了修改建议,教它如何去固定摄像机视角和画布,照着做,都做不到。
把DeepSeek 的代码发给GPT5.5,分析得头头是道,debug一把通了。瞬间如沐春风。
在这种Coding 这种生死局上,国模和洋模的细粒度还完全不同。感觉洋模里面都是水和细沙,国模里面还是大石块和小石块。
有一说一,差距还是存在的。
声明:本文内容由脉脉用户自发贡献,部分内容可能整编自互联网,版权归原作者所有,脉脉不拥有其著作权,亦不承担相应法律责任。如果您发现有涉嫌抄袭的内容,请发邮件至maimai@taou.com,一经查实,将立刻删除涉嫌侵权内容。