- 定位:不是「Agent 产品」,而是展示 Cordis 内核的科研型基础设施;发布即「开发者预览版」,鼓励开发者进来造插件、共建生态。
- 核心理念:
Agent = Model + Harness。Harness 是 Agent 的「外壳 + 工具 + 调度」,各家产品(Claude Code / Codex / WorkBuddy)本质都是 Harness。 - 最大不同:别人的 Harness 把工具/Skills/沙箱全封装好;DeepSeek 把它们全拆成插件,你都能自定义。
- 四种模式:标准 / PTC / 极简 / 创造——其中「创造模式」能让 Agent 现场造插件、改造自己。
- 作者判语:概念很牛,但对普通用户非常不友好(术语多、门槛高、功能少、体验差);适合开发者与研究,不适合小白日常。
一、先搞懂:Harness 是什么
DeepSeek 官网上放了一条公式:
这个公式源自 LangChain 聊 Agent Harness 时的提法:一个好的 Agent,必然由 Harness 和模型一起构成。你用的 Claude Code、Codex、WorkBuddy,本质都是 Harness,得搭配 Claude Fable 5、GPT 5.6-Sol 这类模型才能跑,否则就是空壳。
一个 Harness 的构成很复杂:工具、Skills 系统、会话、沙箱、存储、Agent 循环、调度、子 Agent、工作流……过去这些全被厂商封装在软件壳里,普通用户看不到也不需要知道,能自定义的只有 Skill、MCP 这类。
二、DeepSeek 的做法:一切皆插件
在 DeepSeek Harness 里,上面所有东西都被包装成插件,你全都可以自定义。很像以前玩过的模块化手机——所有部件都能随便改。
真正的核心只有一个,叫 Cordis 内核(作者已加入 DeepSeek,配套发了一篇 88 页论文)。它干的事极其克制:只负责插件的加载、卸载和依赖管理,其他什么都不管。
最牛的是:Agent 运行过程中可以随时更换插件,且不崩。靠两个特性:
- 时间可组合性(Temporal composability):一个插件卸载后,它之前产生的副作用能否完整撤销。
- 空间可组合性(Spatial composability):插件依赖其他插件时,当依赖出现 / 消失 / 改变,它能动态重新处理自己的依赖。
这两个特性让 Agent 能在运行中不断给自己插拔能力、开发安装卸载插件,形成某种意义的自进化。所以说它更像一个展示 Cordis 内核、预置了 100 多个一方插件的科研成果,而不是成品 Agent 产品。
三、为什么叫 Harness,不叫 Code
因为它做的不是 Agent 产品,而是一个基建 / Harness 系统。它需要全世界开发者进来一起插拔、造各种插件,丰富生态,形成新时代平台,同时完成 Agent 自进化。所以这次版本叫「开发者预览版」。
也因此社区争议很大:一边说理念太牛,一边说「鬼才用,我为什么要没事插拔」。
四、怎么上手
- 官网:
deepseek.com/harness(文内为原文链接,以官网实际为准) - 装好后会弹出一个本地网址,复制到浏览器打开。
- 首次运行填 DeepSeek API(去
platform.deepseek.com搞一个,记得充钱)。 - 模型可选 Flash / Pro,也能选思考强度。
DeepSeek V4 Pro 正式涨价,涨幅明显:V4 Pro 缓存命中价格直接涨了约 12 倍,高峰期输出价到约 27 元/单位,性价比对比 GLM、Qwen 3.8 Max 已拉不开差距。作者直言「曾的价格屠夫少了很多吸引力」。
但 Harness 并没把你锁死在 DeepSeek 模型上:支持添加目录里的模型提供方,也支持自定义提供方、Base URL、协议和模型列表——以后完全可以把别家模型(如 GLM)接进来用。
五、四种模式(最让普通用户懵的地方)
作者强调:这四种不是 Cordis 内核本身,而是开箱即用的模板预设。
1. 标准模式
第一次用或不懂底层机制,无脑选它。拥有完整代码 Agent 能力:文件读写、Shell、文件搜索、网页搜索、Skills、计划、目标、后台任务、子 Agent、工作流——都已预设好。
2. PTC 模式
拥有标准模式全部能力,区别在工具呈现方式:给模型一套 Code Mode SDK,让模型写一段 TypeScript 程序,在一次 run_code 里组合多个工具操作。把原本可能需要五次模型往返的活压进一次程序执行,更省 Token。但需要模型有稳定代码规划能力、调试难,小白先别碰。
3. 极简模式
只给两个核心工具:一个持久 Bash + 一个文件编辑器。系统提示词固定成「你是一个有帮助的软件工程助手」,去掉上下文压缩和大量额外能力。主要用于最小环境下的模型基准测试,日常别用。
4. 创造模式(最特别)
拥有标准模式完整能力,还能检查正在运行的 Cordis 环境、在内存中试验插件、帮你创建新的 Agent 和插件——让 Agent 直接改造自己。比如:
- 「帮我做一个只允许读代码、不允许改文件的安全审计模式。」
- 「帮我做一个接入公司内部搜索、固定某模型、有三种专属 Skills 的研究 Agent。」
比喻:Agent 发现自己没有扳手,于是现场造了一把扳手、插到自己手上,接着干。这是 Harness 最核心的特点,也是 Cordis 最棒的体现。
六、对开发者友好的两点
- 会话即只追加的事件日志:系统提示词、用户消息、推理、工具调用与结果、权限变化、上下文注入、压缩、子 Agent 调度都成日志事件,下一轮历史从日志重新推导。轨迹视图可按来源查看每次运行——可观测、可审计、可复现,非常适合研究(很多 Agent 失败后你根本不知道在哪步跑偏)。
- 社区插件入口:作者推荐了 5 个三方插件增强体验:
dsh-at-file:输入框 @ 直接调用文件。dsh-genui:回复里直接渲染图表/表格/表单/Diff/Mermaid/交互面板。dsh-automation:补上自动化能力。DSH-better-sidebar:补一套类 VS Code 工作台(文件管理、终端、Git、Diff、内嵌浏览器、后台任务、子代理状态)。ModLens:给纯文本 DeepSeek 模型补上视觉能力(粘贴图片即可读图)。
七、写在最后(作者判语)
DeepSeek Harness 是一个非常有趣的系统,插件插拔概念很棒,但从产品角度对普通用户非常不友好——过多开发者术语、过高使用门槛、过少功能、过差体验,每一步都劝退。但 DeepSeek 可能本就是更重科研与探索的团队,正如其 Slogan:探索未至之境。
- 它支持接任意自定义模型提供方与 Base URL——注意只接你信任的来源,避免把密钥交给不明服务。
- 「创造模式」能让 Agent 现场改自己、装未知插件,运行前确认插件来源可信,避免引入有副作用的第三方代码。
- 涉及公司数据、客户信息、密钥,不要无脑交给任何 AI 工具——人判断、AI 辅助。
- 价格与功能更新极快,以官网
deepseek.com/harness和客户端实际显示为准。