Hogwarts测试开发
08-18·北京测吧员工
智能体与自动化插件应用(二)
03 核心思路:官网深度拆解——Harness到底强在哪?我们先从DeepSeek官网和GitHub仓库的官方信息入手,拆解一下这个让测试人恐慌的东西到底厉害在哪。第一,它不是一个聊天机器人,它是一个能“把事做完”的Agent。传统AI模型——你问一句,它回一句。Harness不一样:你给它一个任务,它会自己规划、自己调用工具、自己执行、自己验证结果,直到把整件事干完。官网明确写道:“Harness让agent理解其环境、使用工具,并在真实世界中持续工作” 。它不是给你建议,是替你干活。第二,它能看到“轨迹”,所有操作都可追溯。Harness有一个叫Trajectory(轨迹) 的设计——模型看到的一切、推理过程、工具调用和结果、每一次上下文注入,全部记录在一份只增不改的会话日志里。相当于Agent的每次运行都自带一个黑匣子。出了问题,你可以完整复盘它到底看到了什么、为什么这么做。这对测试来说意味着什么?它不仅是执行者,还自带“测试报告”和“操作日志”。第三,它的架构彻底颠覆了传统Agent框架。根据DeepSeek官方架构文档,产品的每一部分都是插件,包括模型适配器、工具注册表、会话日志,以及agent loop(智能体循环)本身,因此每一部分都可以从配置替换。过去的Agent框架像一个固定浇筑的大楼——核心Harness是固定的,用户只能在外围加插件。DeepSeek Harness把这栋“固定的大楼”拆成了一盒乐高。不只是外围能力可以插件化,连核心组件都可插拔。不存在需要打补丁的特权内核——扩展dsh的方式就是把插件挂载到其他插件旁边。用大白话理解:Harness自己就是由插件拼出来的。而这一切的背后,是DeepSeek与北京大学联合发表的论文《A Programming Paradigm for Spatiotemporal Composability》所提出的Cordis动态组件框架。它解决的核心问题是:如果Agent未来真的要修改自己的Harness,修改之后还能撤回,以及被修改组件背后的依赖关系还能继续正常工作。这意味着什么?意味着测试领域的每一个细分场景——接口测试、性能测试、UI自动化、安全测试——都可能被插件化、被自动化、被Agent化。
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中