微学AI
06-28·AI领域创作者
GPT-5.6深度推理能力提升明显吗?
Gemini
GPT-5.6
Gemini 3.1 Pro
GPT-5.4
推理架构从单体到群智
这代 GPT-5.6 我最想聊的不是分数,而是它悄悄把推理范式从「单线程深思」切到了「多智能体协同」。Max reasoning effort 仍然是给单条思维链更多时间,Ultra 模式则更进一步——模型自己拆任务、拉子 agent 并行处理、再汇总结果,Terminal-Bench 上 Sol Ultra 91.9% 对标准 88.8% 的那几个点差距,本质上就是被这套机制拉开的。横向看整个 2026 年的推理榜单,大家的路线其实已经分化了:GPT-5.4 还在 AIME 2025 = 99、Frontier Math 47.6 这类「单兵作战」型数学赛道称王,Gemini 3.1 Pro Deep Think 用 GPQA Diamond 97 分把思考链拉到极致,而 Anthropic 一贯把 Agent Teams 留给用户在外部编排。Sol 第一次把多 agent 协作塞进了模型内部,等于把「怎么拆任务」这个本来由人手写编排的工作抢了过去。我自己跑多步骤任务时最怕的不是某一步失败,而是步骤之间衔接断了、上下文丢失——Ultra 模式真正想解决的,恰恰是这条最容易翻车的缝。
发布于 福建
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn