夜勤月
08-03·AI领域创作者
GPT-5.6 Sol
GPT5.6和Grok4.5谁更强?
GPT5.6和Grok4.5,差不在跑分
7月第二周,OpenAI和马斯克的SpaceXAI几乎同时甩出旗舰模型。跑分出来后两边各有胜负,但只看Terminal-Bench的数字下结论,方向就错了。GPT-5.6 Sol在终端编程上拿到88.8%,Ultra模式冲到91.9%,Grok 4.5是83.3%。看起来GPT赢了,但Grok 4.5在SWE Bench Pro上反而压过GPT-5.5,法律智能体评测排名第一。两个模型走的根本不是一条路。GPT-5.6是全场景旗舰,推理、安全、商业工作流都想覆盖。Grok 4.5则押注编程这一件事——它吃了Cursor的海量真实开发数据,在代码理解和调试链路上有独特优势。马斯克自己都说Grok 4.5大致在Opus 4.7的水平,没装旗舰。但它便宜、快,首token响应比GPT快一半左右。我的判断是,大约六成日常编程场景Grok能替代GPT,但复杂重构和跨文件架构级任务差距很明显。选哪个,先看任务复杂度,再看预算。
发布于 江西
分享
评论
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn