夜勤月
07-06·AI领域创作者
上海Agents-A1开源能跑长任务吗?
Agents-A1开了个好头
上海AI Lab开源的Agents-A1,35B参数,在部分长任务上追平万亿级模型。我的第一反应不是"小模型逆袭了",而是"终于有人换赛道了"。过去两年行业疯狂堆参数,仿佛只有大力才能出奇迹。但Agents-A1证明了一件事:与其把知识硬塞进参数里,不如教会模型怎么把任务做得更长。它靠的是扩展Agent Horizon——训练模型在长流程中搜索、调用工具、纠错、恢复,训练数据平均4.5万token,远超普通样本。但说实话,我也不想吹过头。论文自己也承认,工程类任务上跟前沿大模型还有差距。35B毕竟是35B,通用推理能力的天花板就在那里。它更大的意义是指出了一条经济可行的路:不是所有人都有万亿参数的预算,但你可以让小模型学会"更会做事"。真正值得关注的是,这种思路能不能在工程代码场景也跑通。那才是Agent落地的核心战场。
发布于 江西
1
14
9
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn