我要一个草莓蛋糕
07-16·职场领域创作者
GPT-5.6 Sol
GPT5.6和Grok4.5谁更强?
Grok 4.5
GPT-5.6 Sol硬实力确实更强,跑分在Artificial Analysis编程榜单上拿了80分,比Grok 4.5的76.2分高出接近4分,Terminal-Bench 2.1长程任务上88.8%对Grok的83.3%也是明显领先。而且它有个Ultra模式能同时拉起四个子Agent并行处理复杂任务,适合需要深度推理的场景。但Grok 4.5走的是另一条路,不拼最强拼性价比,马斯克自己都承认Fable确实比Grok好得多,但补了一句大多数任务并不需要Fable级别的能力。定价上Grok输入2美元输出6美元,GPT是5美元和30美元差了整整五倍,单任务成本更明显Grok在Grok Build里平均每个任务花2.49美元,GPT在Codex里要5.07美元,解决同样的SWE-Bench Pro任务Grok平均只用1.6万个输出token,GPT要6.7万个差了四倍多。我用下来的感受跟数据差不多,写常规代码做日常活Grok确实够用响应也快,但碰到那种需要深度推理的复杂工程问题还是GPT更让人放心。这两个不是谁取代谁的关系,是两种不同的选择,一个追求极致性能一个追求日常够用。评论区你用的是哪个?
发布于 江西
分享
评论
未登录
友善发言
image-upload
评论
加载中