DeepSeek Harness开源一周星标15万:插件底座改写Agent规则
事件回顾:开源48小时逼平OpenClaw的84天战绩
2026年8月13日深夜,DeepSeek把DeepSeek Harness(命令行dsh)以MIT协议推上GitHub。开源当晚21:05首个commit,Star数7,283;21:51突破1.5万;不到两小时破万;12小时破5万;45小时破10.5万。截至8月17日仓库已达14.4万Star、1.45万Fork;至8月19日,Star稳定在15万以上,社区dsh-plugin生态超过1200个仓库。
做一次直观对比:曾被称作史上最快增长的OpenClaw,84天涨20万Star,每小时平均99个;DeepSeek Harness头两个小时的涨速是它的80倍。KuCoin发布报告确认:Harness在90分钟内拿到22,000颗Star,是Grok-1达到同等量级所需时间的1/19。
一切皆插件:连Agent循环都可以替换
DeepSeek官方给出的等式只有三个字母:Model + Harness = Agent。模型负责推理,Harness负责读文件、调工具、管会话、控制权限、执行重试——所有”把想法落到真实环境”的部分,都是Harness的活。
最有冲击力的一刀藏在这里:Agent循环本身也是插件。仓库里agent是一个接口(seam),agent-loop只是它的一种实现。任何插件只依赖agent这个接口,不依赖agent-loop。换一种运行模式不用动源码,改一份Cordis配置文件即可。
Harness的地基是一个叫Cordis的微内核,来自DeepSeek与北大联合发表的论文《A Programming Paradigm for Spatiotemporal Composability》。Cordis内核只管三件事:插件加载、卸载、依赖管理,所有Agent能力都活在插件里。它引入”可逆副作用”机制——每个插件启动时登记自己开了哪些定时器、注册了哪些工具,并交出一份”拆除说明书”,一旦停用内核顺着说明书逐条回滚。整套开发哲学被官方浓缩为五个汉字:一切皆插件。
性能反转:同一份权重,Harness能拉出20道题差距
海外独立评测博主sentdex跑出的一组数据最能说明问题:同一份DeepSeek V4 Flash权重,在简陋agent框架下只通过44/89题;换上社区的完整Harness后通过64/89题,多对整整20道。这意味着DeepSeek过去公布的模型跑分脚注里”使用DeepSeek Harness极简模式”那条注脚,过去一直被忽略——辛苦工作的一半功劳,实际在Harness上。
极简模式更狠。社区发现切换到极简模式后,模型性能瞬间暴增,直接做到Claude Fable 5级别的效果。极简模式跑77步,模型推理17分钟,工具调用6分钟,总计23分钟,比标准模式快将近10分钟。模型是大脑,Harness是手脚和神经系统;没有Harness模型只是”会说话的引擎”,有了它才能读文件、调工具、跑任务。
巨头接盘:腾讯、荣耀、国家超算争抢Agent底座
社区炸开同时,产业巨头已跑步进场。腾讯QQBot官宣接入DeepSeek Harness,支持单聊和群聊,三步完成绑定。荣耀YOYO接入,国家超算互联网上线DeepSeek V4 Pro正式版与Harness全套源码,百度千帆平台上线DeepSeek-V4-Flash并推出夜间折扣。招商证券国际连夜发布报告,明确定位DSH是从模型层向框架层上移,做Agent时代的”安卓”。
社区侧的生态远比想象中跑得快。截至8月18日,dsh-plugin标签公开仓库超过700个;精选目录累计收录1,117个插件,监测生态仓库1,521个。开发者把Harness塞进各种工作流:浏览器自动化、长期记忆、数据库连接、任务管理;有人嫌DeepSeek不会看图,现场接视觉模型;dsh-agent-teams让Agent原地升职当队长拉多Agent团队;DSH Better Sidebar把文件管理、代码编辑、终端、Git全塞进侧边栏;跨会话长期记忆让项目约定、架构决策、踩过的坑能持续记忆。网友戏称:”DeepSeek说一切皆插件,社区回答——行,那我们可真不客气了。”
黑箱 vs 底座:Agent时代的标准件之争
OpenAI与Anthropic的Harness是黑箱:模型和执行循环焊死成产品(Claude Code、Codex)打包交付。要换调度策略、换沙箱,只能等官方发版,或者fork仓库自己维护补丁,长期为别人的架构打工。DeepSeek选了一条更激进的路:把agent loop做成插件,本质是承认”我们也不知道最优循环长什么样”。官方仓库里的包并不天然比社区创建的包更重要。
这条路如果走通,dsh就不只是又一个Coding Agent,而是Agent时代的基础设施——像npm之于Node.js,像Kubernetes之于容器。前提是”Model + Harness = Agent”真的成为开发者共识,而Harness必须可替换、可组合、可本地化。
前瞻:从模型竞争到执行层竞争
2026年8月19日的AI产业版图正在快速分层:模型层由Claude Fable 5、GPT-5.6 Sol、Kimi K3、GLM-5.3瓜分;执行层首次出现独立的开源底座;接入层由插件生态、各类CLI/IDE、聊天机器人构成。谁掌握了Harness的标准,谁就掌握了Agent时代的”插座规格”。
这件事还未盖棺定论。DeepSeek在README里用全大写写明THERE WILL BE COMPATIBILITY-BREAKING CHANGES,v0.1仍是开发者预览版,UX是毛坯,长尾工具得等社区生长,第三方工具兼容性也有待验证。但把时间尺度拉到6到12个月,看GitHub星标曲线、生态扩散速度、巨头接盘节奏,结论非常清晰——Agent时代的底座争夺战,已经拉开帷幕。