8 月 13 日晚上,DeepSeek 一边发通告说 V4-Pro API 从 17 号开始涨价,高峰段最狠 12 倍。一边把自家做的 Agent 框架 DeepSeek Harness (dsh) 甩到 GitHub 上,MIT 协议,随便用。
几个小时,deepseek-ai/deepseek-harness 冲上 3.3 万 star。等我第二天早上刷到,已经 10.5 万了。
我当时正用 OpenClaw 在跑一堆 skill,看到 Harness 的第一反应是:这不就是我这套东西的另一种做法?
于是花了半天把 dsh 装起来跑,顺便和 OpenClaw 摆到一起比。结论先说:它们看起来像近亲,实际是两个物种。想清楚差别,再决定要不要切。
一句 npx 就跑起来的东西,凭什么值得看?
Harness 的启动简单到反常识:
npx @deepseek-ai/dsh web
Node.js 项目,默认起在 http://localhost:3018,浏览器一开就是它自带的 Web UI。想跟源码走:
git clone https://github.com/deepseek-ai/deepseek-harness
cd deepseek-harness
pnpm install
pnpm run build
pnpm dsh web
装完连 DeepSeek 官方 API,也能挂 OpenAI、Anthropic、GLM、Kimi,模型作为「plugin」被抽象掉了。
这一层没啥新意。真正让我停下来看第二眼的,是它 README 里那句话:Everything is a plugin.
模型是插件。工具是插件。会话是插件。沙盒是插件。文件系统是插件。Loop(agent 主循环)是插件。编排是插件。连 UI 都是插件。
Cordis:把 Agent 拆到只剩空壳
Harness 底下是 DeepSeek 自家的 meta-framework Cordis。你可以把它理解成一个「服务 + 事件」总线,插件之间靠这个总线通信。
传统 Agent 框架(LangChain、AutoGen、CrewAI)大多是「先写死一个主循环,再让你在里面塞工具」。Harness 反过来——主循环本身就是插件。你不喜欢它的推理策略,换一个 Loop 插件就行;你想用 gVisor 换掉默认沙盒,写一个 Sandbox 插件;你觉得 Web UI 太重,写个 CLI 插件替掉。
这种「Agent = Model + Harness」的拆法,把过去藏在框架里的架构决策,全部暴露到 plugin 层。
好处:极致灵活。 代价:你得知道自己在拆什么。
摆到 OpenClaw 旁边看,才看得出真差别
我 5 月开始重度用 OpenClaw,从写文章、跑 cron、管多 Agent、爬数据、维护飞牛 NAS,全都跑在上面。摆到一起比 Harness,几个关键差异特别明显。
相似的地方
- 都吃「插件/技能」这套抽象。OpenClaw 有 Skills、MCP、Agents;Harness 有 plugin。目的都是把能力做成可组合模块。
- 都强调 Model + Runtime 分离。模型换成什么都行,harness/runtime 才是真正的护城河。
- 都开源、都 MIT。
- 都不是给终端用户的产品,是给 Agent 工程师的地基。
真差别在这里
第一,抽象颗粒度。
OpenClaw 的 Skill 是「一段自然语言 + 一份 SKILL.md + 一些 asset/scripts」,Agent 读到就照着做。它抽象在 prompt/context 层——你在教 LLM 怎么使。
Harness 的 plugin 是代码模块,注册到 Cordis 服务总线上。它抽象在 runtime 层——你在改 harness 本身。
一个是「教它」,一个是「换它」。
第二,多 Agent 拓扑。
OpenClaw 里我有墨守 001、墨客 002、墨盒 003、飞书接入、Discord 接入……每个 Agent 独立 session、独立记忆、跨 Agent 通过 sessions_send 或 cron 联动。这套东西对写文章、管日程、维护 NAS 这类长期任务特别顺手。
Harness 目前发出来的样子是单 agent 单 session,主打「一个 coding agent 从头到尾把一件事干完」。你要多 Agent,得自己写编排 plugin。V0.1 版本文档里明确说:暂不接受外部 PR,先自己内部迭代。
第三,任务面。
Harness 的定位从头到尾是 coding agent——写代码、跑代码、改代码。sandbox、filesystem、loop 这几个核心 plugin 都是围绕 coding 场景做的。
OpenClaw 更像通用 digital employee harness——写文章、发消息、爬网页、看摄像头、跑 cron,coding 只是子集。这就是为什么我能拿它当 24 小时秘书用。
第四,谁来开发。
Harness 是 DeepSeek 官方,钱和人都不缺。但他们暂时关着 PR 通道,指路 GitHub Discussions 和写「dsh-plugin」独立仓库。生态节奏可能会慢。
OpenClaw 走的是社区路子,plugin 直接 merge。快、乱,但活跃。
第五,成熟度。
Harness README 最上面写着:THERE WILL BE COMPATIBILITY-BREAKING CHANGES. 大写。翻译过来:别拿它上生产。
OpenClaw 我这半年跑下来,也不敢说是生产稳态,但至少 API 面收敛了,daily use 不会天天崩。
装完能干啥?以及卡在哪?
我拿 dsh web 起了个本地实例,接上自己的 DeepSeek API key,让它做几件事:
- 写一个 Hugo 短脚本、把静态站部署到 R2:行。跟 Codex 差不多。
- 跨会话记忆:没有,session 重启就忘光。得等 Session plugin 生态。
- 定时任务:没有,纯 request/response。
- 多 Agent 编排:没有。
- 挂 MCP:理论上通过 plugin 可以,实际社区还没做出好用的 MCP 桥。
换句话说,V0.1 Harness 现在是一个架构漂亮但生态空的 coding agent。
反过来,OpenClaw 的 cron、多 session、Skill Workshop、Feishu/Discord 插件、TaskFlow,是我实际靠着运转的东西。这些东西 Harness 都得自己写。
我要切吗?我的判断
如果你只写代码、只需要一个 coding agent,Harness 值得盯着。DeepSeek 官方光环 + 一夜 10 万 star + 架构真的够干净,等 V1.0 出来生态起来了,很可能吃掉一批 Claude Code / Codex 用户。
如果你在做通用 Agent、要长期任务、要多 Agent 协作、要接飞书/Discord/摄像头/NAS,OpenClaw 这类通用 harness 短期内还是更实用。Harness 走到那一步至少还要半年。
如果你只是想学 Agent 架构:那 Harness 的代码值得读一读。它把 harness 的每一层都命名了、抽象了、暴露到 config 里。读一遍胜过看十篇 blog。
我个人的做法:OpenClaw 主力继续跑,Harness 装一份留着,跟着 V0.1 → V0.5 一路观察。什么时候多 Agent + session persistence 到位,再考虑要不要把某些 coding 任务迁过去。
不用非此即彼。Model + Harness = Agent——这个公式如果 DeepSeek 说的是对的,那 harness 就是插槽,谁都可以换。留着两把总没错。