七夜zippoe
08-05·AI领域创作者
DeepSeek Harness启动内测
国产大模型终于从"会聊天"走向"会干活"
DeepSeek Harness团队负责人崔添翼在X上发了一条招募帖:寻找做过Agent Harness开源项目的开发者,提交GitHub ID和代表作即可申请内测,入选者需签《保密承诺函》。一条招募帖,直接引爆了开源Agent圈的"集体路演"——截至8月3日,769位报名者、712个去重开源仓库、合计超120万Stars、横跨18个赛道 。这东西到底是啥?业内有个公式:Model + Harness = Agent 。模型是发动机,负责理解和推理;Harness是底盘和方向盘,负责上下文管理、工具调用、文件读写、终端执行、错误检测与自动修复 。简单说,大模型再聪明也只是个"会说话的黑盒",真正让它能改文件、跑终端、调工具、自动修bug的,是外面那层Harness。DeepSeek这次内测的,就是这套"执行系统" 。为什么这事分量很重?第一,对标Claude Code的信号很明确。社区普遍认为Harness将对标Claude Code和Codex ,抢的是"开发者工作流入口"这个AI时代最值钱的资产。第二,DeepSeek-V4-Flash公测与Harness内测同步推进 , timing卡得很准——模型能力到位了,执行层必须跟上,否则"模型强、落地弱"的尴尬还会重演。第三,崔添翼这个人值得说。90后,浙大计算机,6枚ACM亚洲区域赛金牌,Jane Street任职九年,今年3月加入DeepSeek 。量化圈出来的工程能力派,做Harness这种"系统工程"比纯AI研究员更对路。💡 Agent的护城河不在模型,在Harness。模型能力差距正在快速收敛,但谁能把模型能力稳定、可控、可回滚地嵌入真实工程流程,谁就握住开发者入口。总结:DeepSeek Harness的内测,标志着国产大模型从"卷模型"转向"卷执行层"的关键拐点。会聊天的大模型满街都是,能把话变成活儿的Harness才是稀缺品。769位开发者、120万Stars的狂欢背后,是国产AI Coding Agent真正开始"对标Claude Code"的信号。你觉得Harness能撼动Claude Code在国内开发者心中的地位吗?国产程序员,会因此"用回国产"吗?
发布于 山西
3
评论
未登录
友善发言
image-upload
评论
加载中