夜勤月
08-05·AI领域创作者
GPT-5.6 Sol
GPT5.6和Claude编程对比
GPT5.6和Claude,快和深的对决
GPT-5.6 Sol在Terminal-Bench上拿到88.8%,Ultra模式91.9%,把Claude Fable 5的83.4%甩了八个点。看这个数字你会觉得GPT赢了。但换一个榜单,结论完全反过来。SWE-bench Pro测的是复杂仓库级任务,Claude领先10.6个百分点。这是最关键的差距——任务越复杂、涉及文件越多,Claude的优势越明显。Terminal-Bench测的是端到端终端任务,GPT凭借Rust重写后的低延迟和高吞吐领先。有开发者做了实测,同样一个多约束排程任务,GPT-5.6 Sol给出了更优解,Claude Fable 5虽然答案正确但效率差一截。但在60万行Java老系统迁移这种大规模重构里,Claude的Plan Mode和子Agent调度明显更稳。我的判断是,追求速度和批量任务选GPT-5.6,追求深度和复杂重构选Claude。这俩不是谁替代谁的关系,是快和深的两条路。
发布于 江西
1
评论
1
未登录
友善发言
image-upload
评论
加载中