靠谱阿无
08-13·AI领域创作者
DeepSeek Harness
DeepseekHarness到底强在哪
AI第一线
DS甩出一张新牌,但这次不卷模型
就在刚刚,DeepSeek 发了首款 Agent 产品——DeepSeek Harness(DSH)。先说结论:它真不是 DeepSeek 版 Codex。Codex 想给你一个开箱即用的智能助手,DSH 想给你一套拼装 Agent 的乐高。模型只是其中一个零件,剩下的大脑怎么搭、手怎么长、脸长什么样,全由你定。这玩意儿最狠的一招叫一切皆插件。不是那种给浏览器加个黑暗模式的插件,而是能直接替换模型、工具、策略、存储,甚至把整个 Web 界面改头换面的插件。内测才几天,用户已经搓出将近 300 个插件——有把页面改成 VS Code 多栏工作台的,有给标题栏塞一只会眨眼摆尾像素鲸鱼的,还有直接往主界面塞 2005 年风格弹窗广告的。不是玩笑,真有人这么干了。更硬核的是,有人用插件给 DSH 做出了跨会话长期记忆 + 后台自我进化。AI 定期回头整理自己的工作经验,把临时踩坑沉淀成长期知识,但写入前必须经过人工确认,不会擅自把误判当事实记下来。整套系统靠本地文件持久化实现,没用向量数据库,走的是 LLM 自我整理的路子。再说说Agent 预设。DSH 不搞"日常模式""办公模式"这种场景切换,而是用预设定义 Agent 的岗位和工具箱。内置四个:标准模式全能编码、代码模式批量并行、极简模式只留两个工具(评测用)、创造模式专门用来搓新预设。预设里可以塞自定义提示词、技能文件、子 Agent 规则,同一个进程里能同时跑写作 Agent、编码 Agent、研究 Agent,各看各的工具,互不串门。模型方面,默认跑 DeepSeek V4 Flash 和 Pro,但也支持接 Kimi、OpenAI、Anthropic、Google 等近 40 家厂商的 API。想换脑子?随便换。实际跑起来怎么样?同一道 Three.js 滑沙游戏题,V4 Flash 在 DSH 上的交付质量明显好于 Reasonix 和 Codex。不是模型变了,是 DSH 的工具编排和上下文组织拉高了上限。V4 Pro 反而用时更长、画面更精致但元素更抽象——说明模型越强不一定越听话,框架的引导同样关键。以前挑 Agent 是挑哪家公司做的产品最好用,DSH 把这条路改了——Agent 和模型一样,变成可以自己组装的基础设施。想造多少个 Codex,就能造多少个。
发布于 安徽
分享
评论
未登录
友善发言
image-upload
评论
加载中