碧霄洞主
07-08·销售·10年+
K神:先做透模型,再催Agent干活
OpenAI五年前犯的错,成为现在的坑!
2016年,Karpathy在OpenAI搞了个叫World of Bits的项目——让Agent学会用键盘鼠标操作电脑,帮你订机票、点外卖。听起来是不是特别耳熟?这几乎就是今天所有Agent创业公司PPT第一页的画面。结果呢?没做成。他们对着几个简陋网页疯狂点鼠标,最后发了一篇ICML论文,但技术没准备好,手里唯一的锤子是强化学习,怎么使劲都砸不出来。五年后,工具箱彻底换了——现在做Agent几乎没人再用强化学习了。但OpenAI那五年,基本白烧了。最近Hugging Face做了一个实验:用同一个DeepSeek-v4-pro,不改模型权重,只优化外层执行机制,Agent在专业任务上的得分从3.5%拉到了80.1%。76分的差距,跟模型本身没关系。Karpathy最近给Agent开发者说了三句话:第一,别再逼Agent什么都干,先把底层模型做对。一个“发明”了vibe coding的人,此刻选择回到预训练研究——这本身就是对Agent热潮的一记行为投票。第二,Demo很容易,做成产品要花十年。自动驾驶跑一圈Demo谁都能做,真成产品用了十年,VR也一样。Agent跳不过这一课。第三,Agent不是产品,基础能力才是产品。地基不牢,楼盖得越快,塌得越狠。你还在卷Agent的时候,当年踩过坑的人已经回去建地基了。
发布于 广东
1
评论
未登录
友善发言
image-upload
评论
加载中