王西蒙AI创客
08-05·AI领域创作者
GPT-5.6 Sol
GPT5.6和Claude编程对比
GPT-5.6和Claude编程谁更强,这个问题我问了好几个开发者,答案高度一致:看场景。SWE-bench Pro上GPT-5.6 Sol 64.6%,Claude Sonnet 5 63.2%,基本持平。但Claude Fable 5在这个测试里能到80%。同一家公司不同模型差距这么大,说明Anthropic内部也在迭代。有个开发者分享了他的对比方式:给Cursor发一段提示词,同时启动三个子Agent,分别用GPT-5.6 Sol、Claude Fable 5和Grok 4.5,在同一段提示词下各自开发同一个项目。然后对比谁的输出可以直接用。这才是真实的测试方法,比看benchmark靠谱多了。我的选择标准很简单:做原型用GPT,速度快、覆盖面广。做生产级代码用Claude,代码质量更高、更规范。别纠结谁更强,先搞清楚你要解决什么问题。AI编程工具不是选美比赛,是生产力工具。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中