靠谱阿无
07-10·AI领域创作者
AI第一线
GPT-5.6突袭:Codex消失了??
刚睡醒,AI圈又变天了。OpenAI 冷不丁甩出 GPT-5.6,没开发布会,直接上新。最狠的是,那个程序员圈里口碑不错的 Codex 独立 App,说没就没了。不是倒闭,是被强行合并进了 ChatGPT。以后桌面端只有一个入口:Chat、Work、Codex 三合一。OpenAI 美其名曰“AI 超级应用”,其实就是要把所有人的工作流锁死在一个框里。这次的模型阵容挺有意思,按天体命名:Sol(太阳):旗舰,贵,但强。Terra(地球):均衡,半价。Luna(月亮):便宜,只要 1 块钱(每百万 Token 输入)。官方拿着大喇叭到处喊“性价比”。数据确实有点炸裂:在长程智能体评测里,Sol 比 Claude Fable 5 高了 13 分,但成本只要人家四分之一。编程、做 PPT、修 Excel,以前模型写完代码就跑,现在 GPT-5.6 会自己盯着屏幕“验收”,发现丑或者不对劲还会返工。但这事儿有个巨大的反差。OpenAI 一边疯狂cue死对头 Claude,恨不得把“我比你好”刻在脑门上,另一边却在评测表格的角落里露了怯。在最硬核的 SWE-Bench Pro 编程测试和 Tier 4 数学题上,Claude 依然压着 GPT-5.6 打。OpenAI 还阴阳怪气地备注了一句:Claude 因为“不敢答”高阶生物题,所以没放进 GeneBench 榜单。这波商战,既自信又有点急。更值得玩味的是内部消息。那个最便宜的 Luna 模型,居然是旗舰 Sol 自己训练出来的。以前需要一堆资深研究员调参、找显卡、跑脚本,现在 Sol 自己全干了。这标志着“AI 训练 AI”不再是概念,已经落地了。OpenAI 内部算力半年涨了 100 倍,销售团队以前几周才能搞定的定制方案,现在 24 小时甩给你。最后还有个冷笑话。之前 GPT-5.5 训练出了岔子,动不动就往回答里塞“哥布林”和“小精灵”,怎么劝都戒不掉。现在 5.6 官宣修复了这个 Bug,哥布林没有被消灭,只是从“强制植入”变成了“适量把玩”。至于 Codex 去哪了?其实它就在新版 ChatGPT 里,顺便还带了个能自动做财报、发 Slack 的“Work”模式。但要不要为了省那点 Token 钱换模型,建议先看看那张复杂的评测表——毕竟,便宜不一定好使,贵也不一定全能。
发布于 北京
分享
1
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn