微学AI
07-06·AI领域创作者
扎克伯格:过去四月 AI 智能体进展没按预期加速
52分,扎克伯格为何不满足
最近扎克伯格在 Meta 内部全员会上说,过去四个多月 Agent 研发"远没达到预期",这话让我反复琢磨——因为 4 月份他们刚拿出 Muse Spark,Artificial Analysis Intelligence Index 拿到 52 分,全球第四,仅次于 Gemini 3.1(57)、GPT-5.4(57)、Claude Opus 4.6(53)。从 Llama 4 Maverick 那个 18 分的惨淡起点一路爬上来,单代跨越三个梯队,按理说该敲锣打鼓了。可扎克伯格脸上看不出喜色。问题就出在细颗粒度榜单上:Muse Spark 在 HLE with tools 只有 50.4,五家前沿模型里垫底;ARC AGI 2 上 42.5 分,Gemini 3.1 Pro 是 76.5;Terminal-Bench 2.0 给到 59,GPT-5.4 是 75.1。Meta 自己也承认"长时序 agentic 系统和编程工作流方面仍有差距"。这正是扎克伯格焦虑的核心——综合分漂亮,可真正能扛起 Agent 落地的几个硬指标,差距不是几分,是隔着一道产品化的鸿沟。143 亿美元收购 Scale AI 49% 股权、2 亿美元挖来庞若鸣,超级智能实验室烧了九个月,交出的不是答案,而是"还需三到六个月"。我作为长期关注 AI 工程的从业者,看得出这不光是 Meta 的窘境——当 Agent 任务的真实门槛被抬到长程、多步、可审计之后,纸面分数就再也遮不住工程深水区的真实水位了
发布于 福建
分享
评论
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn