七夜zippoe
16小时前·AI领域创作者
DeepseekHarness到底强在哪
DeepSeek Harness
DeepSeek-V4-Flash
Claude Fable 5
8月13日晚,DeepSeek甩出Harness v0.1开发者预览版,MIT协议全面开源。GitHub星标疯涨:45小时突破10.5万,截至8月16日Star数已达125,959,逼近13万。强在这四个核心设计:① 一切皆插件传统智能体框架,想要修改某一项功能,开发者不得不去改动庞大的底层源码,门槛极高。而Harness把智能体运行的几乎所有能力,全部拆成独立插件:模型调度、工具调用、会话存储、沙箱环境、任务循环、用户界面——全部都是可以自由插拔的独立模块。② 模型无关市面上不少智能体产品牢牢绑定自家大模型。DeepSeek Harness没有做强制绑定——既可以接入DeepSeek系列,也可以接入OpenAI、Anthropic或其他开源大模型。模型本身,仅仅是众多插件当中可以随时替换的其中一块积木。③ 完整可追溯Harness采用只追加式日志设计。所有历史事件永久留存,不会因为上下文压缩而被删除。无论AI进行多少轮思考、多少次工具调用,完整的执行轨迹全部保留,开发者可以随时回溯整个任务全过程。④ 四种预设模式标准模式:完整工具集,适合日常复杂任务PTC模式:程序化工具调用,支持用代码批量编排工具链极简模式:仅保留基础Shell、文件编辑工具,用来做基准性能测试创造模式:开放最高权限,方便开发者深度二次开发🎯 最炸裂的是性能反转:海外独立评测博主sentdex跑出一组数据:同一套DeepSeek V4 Flash模型权重,用简陋工具只过了44/89题,换上社区的完整Harness之后直接变成64/89,多过了整整20题。切换到极简模式后,模型性能瞬间暴增,直接做到了Fable 5级别的效果。有评测显示,极简模式跑了77步,模型推理17分钟,工具调用只花了6分钟,总共23分钟,比标准模式快了将近10分钟。💡 业内开发者评价:"这不是又一个普通AI工具,它给出了下一代智能体的全新架构范式。"DeepSeek官方公式:Model + Harness = Agent。模型是大脑,负责思考;Harness是身体和神经系统,负责动手。全球开发者用Star投票,投出的是一张"Agent时代,底座由谁定义"的选票。
发布于 山西
分享
评论
未登录
友善发言
image-upload
评论
加载中