📄 文章总结:《从0到1带你速通DeepSeek Harness。》
公众号: 数字生命卡兹克 | 分类: agent | 收录日期: 2026-08-15 原链接: https://mp.weixin.qq.com/s/xkC1aenHFNSH2BxyzLDfcA
文章标题:从0到1带你速通DeepSeek Harness
公众号:数字生命卡兹克
一、引言:DeepSeek Harness 发布与初步印象
- DeepSeek 在昨天发布 DeepSeek V4 Pro 正式版之后,正式发布了预告已久的自家 Agent 产品:DeepSeek Harness。
- 核心理念很清晰:一切皆插件。
- 截止作者写文时,它在 GitHub 上已到 3.7 万 Star,作者称可能是有史以来最快的速度。
- 作者体验完、又完整扒了开发者文档、用了一些插件后,认为这是一个非常特别的产品,也必然是个“二极管产品”:喜欢的人觉得这就是未来;不喜欢的人觉得这玩意太糙、毫无用户体验、谁用得明白。
- 文章试图讨论三个问题:我理解中的 DeepSeek Harness 是什么?为什么不用 DeepSeek Code 而用 Harness 这个很工程的名字?以及这玩意到底应该怎么用。
二、核心理解:Agent = Model + Harness,一切皆插件
- DeepSeek 官网上放了一条重要公式:Agent = Model + Harness。
- 这个公式是 LangChain 之前在聊 Agent Harness 时提出的:一个好的 Agent 必然由 Harness 和模型共同构成。
- 作者提到自己此前写过一篇科普文:《一文带你看懂,火爆全网的 Harness Engineering 到底是个啥》。
- 你用的 Claude Code、Codex、Workbuddy 等,本质都是 Harness,要跟模型(如 Claude Fable 5、GPT 5.6-Sol)搭配起来用,否则就是纯空壳。
- 一个 Harness 的构成其实很复杂:工具、Skills 系统、会话、沙箱、存储、Agent 循环、调度、子 Agent、工作流等等。
- 过去这些都被封装在以软件为名的壳里(如 Codex),几乎所有东西都是厂商做好,普通用户看不到也不需要知道;用户真正要做自定义管理的其实就是 Skill、MCP 之类的。
- 在 DeepSeek Harness 中,所有这些东西全部都被包装成了插件,全部都可以自定义。作者比喻为“模块化手机”,所有硬件部分都可以随便改。
- DeepSeek Harness 真正的核心只有一个叫 Cordis 的内核,这个内核的作者加入了 DeepSeek,这次甚至发了一篇 88 页的论文。
- 内核干的事极其克制:只负责插件的加载、卸载和依赖管理,其他什么都不管。
- 最厉害的是:可以在 Agent 运行过程中随时更换插件,还能保证 Agent 运行状态不崩。
- 两个核心特性:
- Temporal composability,时间可组合性:一个插件卸载之后,它之前产生的副作用能不能完整撤销。
- Spatial composability,空间可组合性:一个插件如果依赖其他插件,当其他插件出现、消失、改变时,它能不能动态地重新处理自己的依赖。
- 整个 Cordis 内核是为了让 Agent 在运行过程中不断给自己开发、安装卸载插件,不断插拔给自己添加和删除能力,从而形成某种意义的自进化。
- 所以与其说它是一个 Agent 产品,不如说是为了展示 Cordis 内核,给用户预设了 100 多个一方插件的科研成果。
- 这也是 DeepSeek 反复强调“一切皆插件”的原因。
- 所以它叫 Harness,不叫 Code 或 Build 之类的,这次版本也叫“开发者预览版”——因为做的不是 Agent 产品,而是基建、Harness 系统。
- 它需要全世界开发者进来一起插拔,做各种各样的插件,丰富生态,从而形成新时代的平台,同时完成 Agent 的自进化。
- 社区因此吵得不可开交:一边说理念太牛逼了;另一边说这玩意鬼才用,我为什么没事要插拔。作者认为最好的方式还是上手用一用。
三、快速上手:安装、配置与 UI
- 官方网址:https://www.deepseek.com/harness/
- 安装命令:
npx @deepseek-ai/dsh web - 如果看不懂怎么运行,就把命令扔给任何一个本地 Agent 产品,让它帮你装。
- 装好以后会弹出一个本地网址,复制到浏览器打开。
- 第一次运行会让你填上 DeepSeek API,去官网搞一个就行,记得充一点钱。
- API 开放平台官网:https://platform.deepseek.com/
- 首页是一个标准 WebUI 界面,而且这个界面本身也是一个 UI 插件,所以 UI 也可以随便改。
- 比如群友 @黑哥小黑子(blake)随手就做了皮肤插件。
四、模型选择与价格调整
- 模型可以选两个:Flash 和 Pro;也可以选思考强度。
- DeepSeek 正式官宣涨价,涨幅不止一点点,作者认为有点离谱:
- V4 Pro 缓存命中价格直接涨了 12 倍。
- 高峰期输出价格直接来到离谱的 27 块钱。
- 作者原来预测是 2 倍左右,结果高峰期涨价太狠,起步都是 3 倍。
- 性价比配合 DeepSeek V4 Pro 的性能,作者认为从曾经的价格屠夫一下子少了很多吸引力。
- 对比其他主流模型价格:跟 GLM、Qwen 3.8 Max 已经拉不开差距;更别提 GLM-5.3 应该马上要发,价格大概率不变,能力基本又是开源 SOTA,单从 API 角度来说,DeepSeek V4 Pro 的性价比可能比不过 GLM。
- DeepSeek Harness 并没有把你锁死在 DeepSeek 模型上:支持添加目录里的模型提供方,也支持自定义提供方、Base URL、协议和模型列表。以后完全可以把别家模型接进来,比如在 DeepSeek Harness 里用 GLM。
五、工作区与四种模式
- 回到首页,点击“选择工作区”,添加一个项目目录,这就是你的 Agent 能操作的项目文件范围。
- 最特别也最容易让普通用户懵逼的是四种模式。作者提醒:不要把它们当成 DeepSeek Harness 真正的模式来理解,它们就是几种模板预设,方便开箱即用。
-
四种模式的区别:
-
标准模式:第一次使用或对底层机制不了解,直接无脑选标准模式。它拥有完整的代码 Agent 能力,包括文件读取与编辑、Shell、文件搜索、网页搜索、Skills、计划、目标、后台任务、子 Agent 和工作流等,插件都已预设好。
-
PTC 模式:拥有标准模式全部能力,区别在工具呈现方式上。标准模式是模型通常发起一次工具调用,拿到结果,再决定下一步;PTC 模式会给模型一套 Code Mode SDK,让模型写一段 TypeScript 程序,在一次
run_code里组合多个工具操作。原来可能需要五次模型往返的读取、搜索、筛选、并行调用和结果整理,有机会被压进一次程序执行,减少模型与工具之间来回对话的次数,更适合结构化、多步骤、可并行的操作,也更省 Token。但这需要模型具备足够稳定的代码规划能力,调试难度高,小白先不用碰。遇到大量重复工具往返,或想测试 DeepSeek 模型的程序化工具调用能力时,再开 PTC。 -
极简模式:只给模型两个核心工具:一个持久 Bash、一个文件编辑器。系统提示词固定成一句非常简单的“你是一个有帮助的软件工程助手”,去掉上下文压缩和大量额外能力。这个模式主要用于最小环境下的模型基准测试,比如比较两个模型裸 Agent 能力时非常好用,但日常使用会“根本没法用”。
-
创造模式:DeepSeek Harness 最特别的地方。它拥有标准模式完整能力,还能检查自己正在运行的 Cordis 环境,在内存中试验插件,帮助创建新的 Agent 和插件——也就是让 Agent 直接改造自己。例如可以告诉它:“帮我做一个只允许读代码、不允许改文件,专门负责安全审计的模式。”或“帮我做一个接入公司内部搜索、固定使用某个模型、拥有三种专属 Skills 的研究 Agent。”甚至可以先让 Agent 检查自己身上已有的插件和能力,发现没有某个插件时,直接创造一个插件,然后挂到自己正在运行的流程中。比喻:Agent 发现自己没有扳手,于是现场造了一把扳手,插到自己手上,接着继续干活。这是整个 DeepSeek Harness 最核心的特点,也是 Cordis 内核最棒的体现。
六、会话设计:只追加的事件日志
- DeepSeek Harness 把会话设计成一份只追加的事件日志。
- 模型看到的系统提示词、用户消息、推理内容、工具调用和结果、权限变化、上下文注入、压缩、子 Agent 调度,都会成为日志里的事件。
- 下一轮模型看到的历史,也是从这份日志重新推导出来的。
- 这件事价值很大:很多 Agent 失败后,你只能看到任务失败或无限循环,根本不知道它从哪一步开始跑偏。
- Harness 里的轨迹视图可以按来源查看每一次运行,对开发者来说意味着可观测、可审计、可复现,非常适合做研究。
七、插件生态与推荐
- 官方第一方插件都可以在设置页面的插件里看到,看不懂也不用管,直接用就行。
- 如果觉得缺什么,也可以用创造模式自己造。
- 与 DeepSeek Harness 一起上线的还有社区插件入口,有很多开发者开发的三方插件。
-
作者挑了几个不错的推荐:
-
dsh-at-file(https://github.com/omdsh-dev/dsh-at-file):装完后直接在输入框 @ 就可以调用文件,很方便。
-
dsh-genui(https://github.com/omdsh-dev/dsh-genui):允许模型在回复里直接渲染图表、表格、表单、Diff、Mermaid、交互面板等,很有用。
-
dsh-automation(https://github.com/titanwings/dsh-automation):给 DeepSeek Harness 补上自动化能力,刚需,就是交互感觉做得稍微有点问题。
-
DSH-better-sidebar(https://github.com/omdsh-dev/DSH-better-sidebar):给 DSH 补上一套类似 VS Code 的工作台,文件管理、代码编辑、真实终端、Git、Diff、内嵌浏览器、后台任务和子代理状态都塞进侧边栏里,功能更多也更好用。
-
ModLens(https://github.com/liustack/modlens):给纯文本的 DeepSeek 模型补上视觉能力,配置好视觉通道后,直接往对话里粘贴图片,模型就能读图,刚需。
八、总结与评价
- DeepSeek Harness 是一个非常有趣的系统,插件插拔的概念也很棒。
- 但从产品角度来说,对普通用户非常不友好:过多的开发者术语、过高的使用门槛、过少的功能、过差的用户体验,每一步都会让普通用户劝退。
- DeepSeek 可能本身就是更注重科研和探索的团队,就像他们的 Slogan 所说:探索未至之境。
- 作者最后说“加油,DeepSeek”,并请大家点赞、在看、转发三连、星标公众号。
🎯 Friday 提炼
- DeepSeek Harness 的核心公式是 Agent = Model + Harness,理念是“一切皆插件”,底层 Cordis 内核只负责插件的加载、卸载和依赖管理,支持运行中动态插拔,实现 Agent 自进化。
- 四种模式中,创造模式最特别:Agent 能检查自身环境、在内存中试验插件、创建新 Agent 和插件,甚至“现场造一把扳手插到自己手上”继续干活。
- 会话被设计成只追加的事件日志,模型看到的所有输入输出都成为可追溯事件,轨迹视图让 Agent 运行可观测、可审计、可复现,适合研究。
- DeepSeek V4 Pro 涨价明显:缓存命中价格涨 12 倍,高峰期输出价格到 27 块钱,性价比下降;但 Harness 不锁死自家模型,可接入 GLM 等其他模型。
- 目前产品对普通用户不友好,但社区插件生态已起步,作者推荐 dsh-at-file、dsh-genui、dsh-automation、DSH-better-sidebar、ModLens 等插件增强体验。
一句话: DeepSeek Harness 是一个以“一切皆插件”为理念、以 Cordis 内核为底层的 Agent 基建系统,通过四种模板(尤其创造模式)和可观测日志让 Agent 具备自进化能力,虽然目前产品化粗糙、价格大涨,但它更像一个面向未来的科研探索平台。
💡 Friday 看法
说实话,我挺喜欢“一切皆插件”这个思路的,有点像把IDE的插件生态搬到Agent上,折腾党狂喜;但作为日常用户,我只想打开就能干活,让我自己插拔内核组件大概率是劝退的。另外这回API涨价步子太大了,本来图性价比,结果都快赶上别家了,这波操作咱只能说再观望观望。