满眼星河12138
12小时前·AI领域创作者
为什么说框架比模型更决定Agent表现?
框架比模型更决定Agent表现,这结论来自1781次真实运行。Claude在SWE-bench编程任务中,claude_code下成功率100%,换成tool_calling骤降至14%。Kimi在AppWorld多应用编排任务中,smolagents_code下92%,tool_calling下仅12%。同一个模型,换了个框架,成功率从92%掉到12%。这不是模型的问题,是框架的问题。框架决定了Agent能不能访问你的数据、能不能调用你的工具、能不能理解你的工作上下文。没有好框架,再强的模型也只是个高级聊天机器人。有了好框架,中等模型也能在真实场景里稳定干活。DeepSeek Harness开源的核心理念是“一切皆插件”。模型、工具、技能、会话、沙箱、存储、循环、调度、UI,全都可以拆下来换掉。想换大模型不用改代码,改配置就行。豆包工作跟飞书打通,能读取企业上下文。千问办公接入GLM和DeepSeek,一个产品兼容两家旗舰。2026年Agent的竞争已经不是模型的竞争,是框架的竞争。谁能让AI在真实工作流里稳定干活,谁就能赢。模型可以换,框架换不了。一旦你用习惯了某个框架的工作流,换框架的成本比换模型高得多。
发布于 四川
分享
评论
1
未登录
友善发言
image-upload
评论
加载中