Hogwarts测试开发
1天前·北京测吧员工
整夜实测DeepSeekHarness二
3. 插件机制:这才是重头戏Harness最大的卖点是"一切皆插件"。我刚开始以为就是普通的外挂插件系统,结果发现它狠到什么程度——连模型适配器、工具注册表、会话日志、Agent循环本身,全都是插件。也就是说,在Claude Code里你只能走Skill、MCP Hooks这些外围扩展,核心动不了。而在Harness里,你可以直接在配置层把任何一个组件替换掉,一行源码都不用改。更夸张的是,Harness内置了把Claude Code和Codex作为子Agent调用的Provider——通过解析PATH里的对应二进制文件实现委托执行。这意味着你可以用Harness做上层编排,把Claude Code和Codex纳入更大的工作流,而不是取代它们。我测了一下,确实能把Claude Code当子Agent调,上层由Harness做任务分解和调度。这个能力在Claude Code里根本做不到。和Claude Code的核心对比1. 架构层面:封闭成品 vs 开放底座Claude Code是Anthropic对着自家模型深度调优出来的产品,模型和工具链长在一起。好处是开箱即用、体验顺滑;坏处是——模型迭代太快了,框架跟着模型一起过时。Harness反过来,大模型只是技术栈里一个可随时换掉的零件。官方文档写得清楚:**"不存在需要打补丁的特权内核,扩展dsh的方式是把插件挂载到其他插件旁边"**。说白了,Claude Code是精装房,墙不能拆、格局不能动。Harness把施工图和所有预制件都开源了,墙随便拆、零件随便换。2. 成本层面:差距巨大有第三方团队用同一批30个Agent任务做了横评,把DeepSeek V4 Flash接进8套不同的Harness测试。结果:Pi Agent每个成功任务成本约0.028美元,Claude Code是0.195美元,差了将近7倍。速度上Claude Code最快,中位耗时122.7秒。但考虑到成本差距,Harness方案在批量任务场景下的性价比优势非常明显。本文部分内容参考了霍格沃兹测试开发学社整理的相关技术资料,主要涉及软件测试、自动化测试、测试开发及 AI 测试等内容,侧重测试实践、工具应用与工程经验整理。
发布于 北京
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn