继 DeepSeek V4 Pro 正式发布后,备受期待的 DeepSeek 旗下 Agent 产品终于上线了。它的名字叫 DeepSeek Harness。核心理念非常清晰:一切皆插件。
截至笔者写完此文,它已在 GitHub 上获得了超过 3.7 万个星标。说实话,在体验完产品并研读了开发者文档后,我觉得这确实是一个特别的产品。但也注定是一个两极分化的产品——喜欢的人会觉得这就是未来,不喜欢的人则认为这玩意粗糙且毫无用户体验,根本看不懂。
因此,我想用这篇文章聊聊几个问题:我理解的 DeepSeek Harness 是什么?为什么叫 Harness 而不是 Code 或 Build?以及这玩意到底该怎么用?
### DeepSeek Harness 到底该如何理解?
DeepSeek 在官网上放了一条重要的公式:Agent = Model + Harness。这个公式是 LangChain 之前在讨论 Agent Harness 时提出的。一个优秀的 Agent,必然是由 Harness 和模型共同构成的。如果你不了解 Harness,可以参考我之前写的一篇科普文。
你使用的 Claude Code、Codex、Workbuddy 本质上都是 Harness,必须与模型(如 Claude Fable 5、GPT 5.6-Sol)搭配使用,否则就是一个空壳。而 Harness 的构成其实相当复杂,包括工具、Skills 系统、会话、沙箱、存储、Agent 循环、调度、子 Agent、工作流等。
在过去,这些所有东西都被封装在一个名为软件的壳里,比如 Codex。厂商把所有东西都做好了,我们更多是在使用持续提供的软件服务,也就是一个产品,而那些后台机制对普通用户是不可见也不需要知道的。普通用户真正需要自定义管理的,通常只有 Skill、MCP 等少数东西,其他的都被 Codex 封装好了,用户改不了也没必要改。
而在 DeepSeek Harness 中,所有这些东西都被包装成了插件,也就是说,用户完全可以自定义。这就很像以前玩过的模块化手机,所有的硬件部分都可以随便改。DeepSeek Harness 也类似,真正的核心只有一个东西,叫 Cordis 内核,这个内核的作者加入了 DeepSeek,他们甚至为此发了一篇 88 页的论文。
这个内核做的事情极其克制,只负责插件的加载、卸载和依赖管理,其他的什么都不管。最厉害的是,它可以在 Agent 运行过程中随时更换插件,还能保证 Agent 运行状态不崩。核心特性有两个:
1. **时间可组合性**:当一个插件卸载后,它之前产生的副作用能否完整撤销。
2. **空间可组合性**:当一个插件依赖其他插件时,当其他插件出现、消失或改变时,它能否动态地重新处理自己的依赖。
所以你看这两个特性就懂了。整个 Cordis 内核是为了让 Agent 在运行过程中不断给自己开发、安装、卸载插件,不断插拔以添加和删除能力,从而形成某种意义上的自进化。这就是 DeepSeek Harness 的底层机制。
与其说它是一个 Agent 产品,不如说这是一个为了展示 Cordis 内核、并预设了 100 多个官方插件的科研成果。这也是 DeepSeek 反复强调的理念:一切皆插件。
所以,现在你也知道 DeepSeek 为什么叫 Harness,不叫 Code 或 Build,为什么这次版本叫开发者预览版。因为人做的不是 Agent 产品,人做的是基建,是 Harness 系统。它需要全世界开发者进来,一起插拔,帮他做各种各样的插件,丰富整个 DeepSeek Harness 的生态,从而形成一个新时代的平台,同时完成 Agent 的自进化。这就是为什么社区会吵得不可开交——一边说理念太牛逼,另一边说这玩意鬼才用,没事为什么要插拔。
### 如何安装与体验?
新事物诞生必然有争议,但我觉得对于大家来说,最好的方式还是上手用一用。
**安装命令:**
`npx @deepseek-ai/dsh web`
如果你看不懂或者不知道怎么运行,直接把这个命令扔给任何一个本地的 Agent 产品,让它帮你安装。装好后会弹出一个本地网址,复制到浏览器打开即可。
**首次运行**会让你填上 DeepSeek API,去官网申请一个,记得充点钱。API 开放平台官网:https://platform.deepseek.com/
**模型选择与定价:**
贴好后进入首页。这是一个标准的 Web UI 界面,甚至这个界面本身也是一个 UI 插件,所以也是可以随便改的。模型可以选择 Flash 和 Pro,也可以选择思考强度。
这里需要注意,DeepSeek 也正式官宣涨价了。涨幅相当可观,不是一丁点。V4 Pro 的缓存命中价格直接涨了 12 倍,高峰期的输出价格直接来到了 27 元人民币。这个价格的性价比配合 DeepSeek V4 Pro 的性能,我觉得相比曾经的“价格屠夫”少了很多吸引力。我之前预测大概 2 倍左右,结果高峰期涨价实在太狠,起步都是 3 倍。给大家对比一下主流模型的价格,其实跟 GLM、Qwen 3.8 Max 已经不太能拉开差距了。更别提 GLM-5.3 应该马上也要发,价格大概率不变,能力又是开源 SOTA,那 DeepSeek V4 Pro 的性价比单从 API 角度来说,可能比不过 GLM 了。
**模型接入:**
而在 DeepSeek Harness 中,并没有把你锁死在 DeepSeek 模型上。它支持添加目录里的模型提供方,也支持自定义提供方、Base URL、协议和模型列表。以后完全可以把别家的模型接进来,比如完全可以在 DeepSeek Harness 里用 GLM。
### 四种模式详解
回到首页,点击“选择工作区”,添加一个项目目录,这就是你的 Agent 能操作的项目文件范围。接下来就是最特别的部分,也是普通用户最难理解的四种模式。
我觉得大家知道了 DeepSeek Harness 的内核 Cordis 后,千万不要把它当成是真正的模式来理解,这只是他们给你预设的几种模板,方便开箱即用。
1. **标准模式**
如果你是第一次使用,或者对底层机制了解不多,相信我,无脑选择标准模式就可以了。标准模式拥有完整的代码 Agent 能力,包括文件读取与编辑、Shell、文件搜索、网页搜索、Skills、计划、目标、后台任务、子 Agent 和工作流等,这些插件都已经预设好了。
2. **PTC 模式**
PTC 模式拥有标准模式的全部能力。区别在于工具呈现方式。标准模式里,模型通常发起一次工具调用,拿到结果再决定下一步。PTC 模式会给模型一套 Code Mode SDK,让模型写一段 TypeScript 程序,在一次 run_code 里组合多个工具操作。原来可能需要五次模型往返的读取、搜索、筛选、并行调用和结果整理,有机会被压进一次程序执行。这会减少模型与工具之间来回对话的次数,也更适合结构化、多步骤、可并行的操作,同时也更省 Token。但这需要模型具备足够稳定的代码规划能力,调试难度也挺高,小白先别碰,就用标准模式就行。等你遇到大量重复工具往返,或者想测试 DeepSeek 模型的程序化工具调用能力,再开 PTC。
3. **极简模式**
极简模式只给模型两个核心工具:一个持久 Bash,一个文件编辑器。它还会把系统提示词固定成一句非常简单的“你是一个有帮助的软件工程助手”,去掉上下文压缩和大量额外能力。这个模式主要用于最小环境下的模型基准测试。比如你想比较两个模型裸 Agent 能力时,它非常好用。但没事别日常用,你会发现根本没法用。
4. **创造模式**
这个才是 DeepSeek Harness 最特别的地方。创造模式拥有标准模式的完整能力,还能检查自己正在运行的 Cordis 环境,在内存中试验插件,帮助你创建新的 Agent 和插件。也就是说,它能直接让 Agent 改造自己。比如,你可以告诉它:“帮我做一个只允许读代码、不允许改文件,专门负责安全审计的模式。”或者“帮我做一个接入公司内部搜索、固定使用某个模型、拥有三种专属 Skills 的研究 Agent。”甚至你可以先让 Agent 检查自己身上已有的插件和能力,如果你发现它没有某个插件,可以直接创造一个插件,然后直接挂到自己正在运行的流程中。
用一个比喻来说,就是 Agent 发现自己没有扳手,于是现场造了一把扳手,插到自己手上,接着用这把扳手继续干活。这是整个 DeepSeek Harness 最核心的特点,也是 Cordis 内核最棒的体现。
### 开发者友好的特性
DeepSeek Harness 还有一个对开发者很友好且特别的一点,就是他们会话设计成一份只追加的事件日志。模型看到的系统提示词、用户消息、推理内容、工具调用和结果、权限变化、上下文注入、压缩、子 Agent 调度,都会成为日志里的事件。下一轮模型看到的历史,也是从这份日志重新推导出来的。
这件事挺有意义的,价值很大。很多 Agent 失败以后,你只能看到任务失败或者无限循环,根本不知道它在哪一步开始跑偏。Harness 里的轨迹视图可以按来源查看每一次运行,对开发者来说,这意味着可观测、可审计、可复现,非常适合做研究。
目前官方的**插件**,你都可以在设置页面的插件里看到。如果你觉得缺什么,也可以用创造模式自己造。
跟 DeepSeek Harness 一起上线的,还有社区插件入口。有很多开发者开发的三方插件,我挑了一些不错的,觉得可以推荐大家装上,能大大增强使用体验。
1. **dsh-at-file**:装完后直接在输入框 `@` 就可以调用文件了,很方便。
2. **dsh-genui**:允许模型在回复里直接渲染图表、表格、表单、Diff、Mermaid、交互面板等,很有用。
3. **dsh-automation**:给 DeepSeek Harness 补上了自动化的能力,刚需,不过交互感觉做得稍微有点问题。
4. **DSH-better-sidebar**:直接给 DSH 补上了一套类似 VS Code 的工作台,文件管理、代码编辑、真实终端、Git、Diff、内嵌浏览器、后台任务和子代理状态,全都塞进了侧边栏里。
5. **ModLens**:给纯文本的 DeepSeek 模型补上视觉能力,配置好视觉通道以后,直接往对话里粘贴图片,模型就可以读图了,刚需。
总之,DeepSeek Harness 的其他有趣的地方,就交给大家去探索了。
### 总结
最后,我想说 DeepSeek Harness 是一个非常有趣的系统,插件插拔的概念也很棒,但是从产品角度来说,其实对普通用户还是非常不友好的。过多的开发者术语、过高的使用门槛、过少的功能、过差的用户体验,每一步其实都是会让普通用户劝退的。
但是 DeepSeek 可能本身就是这么一个更加注重科研和探索的团队吧。就像他们的 Slogan 所说的:探索未至之境。加油,DeepSeek。
