老谭电商
07-12 · 老谭新媒体创始人
GPT-5.6 Sol
GPT-5.6一小时干掉50年数学猜想,AI自主推进人类未解边界一道困扰数学界近50年的图论猜想,刚上线一天的GPT-5.6 Sol Ultra不到一小时就交了三页PDF证明。循环双覆盖猜想,1973年Szekeres提出,Seymour、Tutte这些图论巨佬碰过,没人完整证出来。这道题有个特点:小学生能听懂题目,教授也证不出来。GPT-5.6怎么干的?研究员把Sol蹬到Ultra档位,模型自主调出64个子Agent并行推理。700词的Prompt核心策略不教模型怎么做——只把验收标准钉死:什么才算解完、什么不算解完、边界情况全覆盖。模型自己找路,自己分工,自己审。证明用到的数学工具全是1985年以前的。50年没人做出来不是因为缺新武器,是缺组合老武器的新思路。GPT-5.6恰好擅长这件事。o1核心贡献者Noam Brown在韩国ICML确认:纯公开可用的GPT-5.6 Sol Ultra,没有内部特供模型。数学界还在独立审查中,OpenAI也明确说目前只能叫"给出证明"不能叫"正式解决"。在苏州园区那边跟团队做内容策略时我有个心得:复杂任务的关键不是规定步骤,而是定义目标。GPT-5.6这次的700词Prompt完美印证了——你不用告诉它怎么走,你只需要告诉它终点在哪。这事儿的影响不只是数学圈。多Agent并行+验收驱动模式,完全可以迁移到科研、工程、商业决策。AI不是来抢饭碗的,是来当超级助手的。你觉得AI自主证数学,5年内会不会出现更多案例?评论区聊聊👇
发布于 江苏
1
评论
未登录
友善发言
image-upload
评论
加载中