柚子知AI遇
07-06·AI领域创作者
35B跑长任务?Agents-A1真敢卷
上海AI Lab刚开源的Agents-A1我跑了一周,说说实话。35B-A3B的MoE架构,显存友好,单机可跑。核心卖点是"扩展horizon而非参数"——训练数据平均45K token的超长轨迹,三阶段蒸馏把搜索、科研、代码五个领域能力揉进一个模型。Seal-0上56.4超GPT-5.5的42.3,HiPhO超DeepSeek-V4-Pro,机器学习科研任务FS-R从基座2.9%拉到40%——这些数字确实漂亮。鲸鱼叫声检测那个案例,模型自主迭代12小时AUC从0.58干到0.99,深度学习工程化能力是真有。但别急着吹。团队自己说了,算法工程类任务跟前沿模型还有差距。我实测跑代码重构,步骤一多就反复试错不收敛,推理优化做半天还是在原地转圈。45K轨迹训练的horizon优势在搜索和科研场景明显,但需要持续保持长程目标的任务,稳定性和万亿级模型仍有距离。另外蒸馏用的是硬路由,领域之间互不干扰,但跨领域组合任务就是盲区。
发布于 上海
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn