微学AI
07-08·AI领域创作者
K神:先做透模型,再催Agent干活
K神10年前踩的坑,我今年又踩了一遍
看完K神在Anthropic内部分享的最新视频,我最有共鸣的不是那句"先做透模型再催Agent干活",而是他2016年在OpenAI搞World of Bits项目的回忆录——当时他和Tianlin Shi、Jim Fan几个人想用强化学习让Agent学会用键盘鼠标操作电脑、订机票点外卖,最后在ICML 2017发了篇论文就不了了之。十年后回头看这个项目,根本原因是"工具箱不对":当时手里只有强化学习这一把锤子,怎么使劲都砸不出通用Agent。现在K神把这个复盘提炼成一句话——"AI最大的错误是急着逼Agent干活却没把模型搞明白",听着像泼冷水,但本质是技术成熟度的问题。我自己做项目时也踩过这个坑:2023年我花了两个月硬用LangChain搭了一套Agent框架想让模型自己调用API写日报,结果准确率只有40%多。后来换成CoT prompt+人工review的混合方案,反而把准确率拉到85%以上——不是Agent框架不行,是当时模型对工具调用的理解能力还没到那个level。K神说"五年后工具箱彻底换了",这话我信,但同样的逻辑现在也成立:与其催Agent干活,不如先把模型在某个垂直场景的能力做透,剩下的事情会自然涌现。
发布于 福建
1
评论
1
未登录
友善发言
image-upload
评论
加载中