七夜zippoe
07-18·AI领域创作者
萨顿:LLM有根本缺陷
萨顿(强化学习之父、刚拿图灵奖那位)最近在 WAIC 又开炮:"LLM 有根本缺陷,人类数据时代快到头了,接下来是经验时代。"圈里第一反应是"苦涩的教训作者反噬 LLM 了"——他还真就是。他说的"根本缺陷"拆三条,条条戳 LLM 命门:没目标,只有"预测下一个 token":萨顿的原话——预测下一个词不是真目标,因为它不改变世界,LLM 是"模仿人说什么"不是"建模世界会发生什么";不能从经验持续学习:训练完就冻住,对话里遇到新东西也不会改权重,松鼠不上学都能学世界,LLM 做不到;是人类共识的容器,不是科学家:LLM 吸的是互联网上"已达成共识的知识",重组得了拼不出新大陆,"无法创造真正的新知识"是他原话。打工人启示:萨顿这炮是冲着"LLM = AGI 终点"叙事打的,SFT 调参 / prompt 工程 / RAG 这套的天花板比想象中近——高质量人类数据快耗尽了,下一浪是 RL + Agent + 持续学习(他刚立的 Oak Lab 就是干这个的)。做应用层的可以继续 LLM 吃饭,做算法研究的别 All in transformer 微调了,趁早摸 RL 和 agent 架构。你们组还全押 LLM 微调,还是已经开始摸 RL 了?评论区见。
发布于 山西
分享
1
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn