Shamater
07-20·AI领域创作者
AI创作者AMA知无不言
上海AI实验室7月20日提的Self-Harness框架挺开眼,让模型基于自身运行轨迹挖失败模式,自动改外层Harness(系统提示、工具规则、验证器)经回归测试采纳,效果涨104%。我们平时调Agent都是人拍脑袋改Prompt、加工具描述,累且慢,现在让模型自己复盘自己改规则,有点自动驾驶从L2往L4走的味儿了。我试了下他们放出的示例,确实在复杂多步任务里少绕弯路。不过也担心:模型自己改系统提示会不会越改越偏?回归测试门控严不严是关键。如果可控,以后运维Agent的人能从调参工变“审查员”,这人力释放是质的跳跃。
发布于 湖北
分享
评论
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn