七夜zippoe
16小时前·AI领域创作者
DeepSeek Harness
Braintrust对生产环境AI Agent的1781次运行分析显示了一个反直觉的事实:保持模型不变,仅更换包裹模型的"智能体框架"(Harness),成功率可以从12%直接跳到92%——波动幅度超过80个百分点。量化差异:框架影响力是模型的7倍以上回归分析把这一直觉量化为精确数字:智能体框架能解释约5.3%的成功率差异模型仅能解释0.7%换智能体框架的影响力是换模型的7倍以上一个更精细的实验:普林斯顿大学的研究者固定了同一个模型,只改变它操作代码库的界面:每次只显示文件的一百行 → 修复率18%显示整个文件 → 修复率反而降到12.7%信息更多,结果更差。为什么框架如此关键?一个编码智能体可以被拆成两个部分:模型:提供推理能力(相当于马)框架:循环机制、可调用的工具、能看到的上下文、允许触碰的权限(相当于绑在马身上的所有带子)语言模型本质上只是一个函数:文本进,文本出。它不能读取文件、不能运行测试、甚至不能记住自己一分钟前说过什么——除非你把对话记录重新贴给它。而框架,就是门外的所有装置。框架掌控着模型的"视野"和"行动范围":① 上下文浓缩能力(最关键)普通Agent把所有对话、代码diff全部堆进去,上下文越来越臃肿,后期胡说八道。大厂Agent自动摘要、自动淘汰无效历史、压缩冗余信息。② 任务拆解与闭环能力普通插件要么一步到位乱改,要么拆得稀碎反复问你确认。大厂Agent自带成熟工作流:拆解任务→分步执行→文件校验→语法检查→结果收敛。③ 工具调用策略普通Agent每改一行代码都弹窗询问。大厂Agent有完善的权限策略、自动执行机制、风险判断机制。💡 行业内已经有共识:Agent最终效果,模型权重只占三成,工程框架机制占七成。DeepSeek官方公式:Model + Harness = Agent。2026年AI竞争的真实格局:模型是入场券,框架是决胜局。 那些还在卷模型参数、卷Benchmark分数的公司,可能已经输在了起跑线。
发布于 山西
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn