
第一章 这篇讲什么:从”跑起来”到”改成你的”
上一篇聊了 DeepSeek Harness(dsh)开源当夜有多炸,没看过的先花三分钟补一下。这一篇讲更实在的:怎么把它从”别人的框架”变成”你的 Agent 操作系统”。
先把定位掰清楚。官方公式是 Model + Harness = Agent:模型动脑,Harness 干活。而 dsh 最值钱的地方,是所有能力都是插件,模型适配、工具、会话、沙箱、甚至 UI,全都能换。
Claude Code 这类产品是精装修,拎包入住,但格局改不了;dsh 给你的是毛坯加乐高底板,水电位全留好了,就等你动手。这篇就动这个手。
第二章 十分钟跑通:Web UI 四步走
环境就一个硬要求:Node.js 22.19 以上(24 也行),终端敲 node -v 确认。然后一行命令:
npx @deepseek-ai/dsh web
浏览器打开 http://127.0.0.1:3080,进 Web 工作台。首次会看到开发者预览声明,点继续。接下来四步:
- 配模型:贴一个 DeepSeek 开放平台的 API Key。注意它是存在本地 profile 里的,不往云端传,这点做得干净。
- 选 workspace:挑一个可丢弃的练习目录,千万别直接指向生产仓库,AI 改起文件来不眨眼。
- 下任务:第一次别整大活,先来个只读的,比如”梳理这个目录的文档并总结核心内容”。
- 看它自己跑:框架自动调文件编辑、文本解析插件,你只管在旁边看它怎么拆任务、调工具。
跑完这一轮,你对”Agent 到底在干嘛”的体感,比看十篇科普都强。

第三章 四种模式:选错模式,事倍功半
dsh 内置四种运行模式,这是它最容易被新手忽略的分流器:
- Standard(标准):全家桶。文件编辑、持久 Shell、向量检索、技能库、规划器、子 Agent、工作流全开。真实工程任务用它。
- PTC(程序化):让模型写 TypeScript 程序来编排工具,下一章细讲。
- Minimal(极简):只留 Shell 和编辑器,其他全卸。专为跑基准测试设计,测的是模型裸能力,SWE-bench 这类评测就走它。
- Creative(创造):开发调试环境。可以在运行时检查插件、现场试装一个新插件,不满意直接卸载,主进程都不用重启。
给个粗暴的决策法:日常干活选 Standard,想看模型真实水平选 Minimal,搞插件开发切 Creative,批量自动化任务上 PTC。
第四章 PTC 模式:别一步步调工具了,写个程序
这是 dsh 架构上最有意思的一步棋。传统工具调用是一条链:调工具 A,等结果,再调 B,再等 C,每一步都要模型拍一次板,跑得慢,链条一长还容易在中途犯迷糊。
PTC(Program That Calls)换了个思路:模型直接生成一段 TypeScript 程序,把工具 A、B、C 的调用组合进去,一次执行完。程序里能写 if/else 按中间结果分支,能写 for 循环批量处理文件,能用 Promise.all 把几个工具并行跑,还能 try/catch 兜住报错。
更妙的是可检视性:执行计划 upfront 就是明晃晃一段代码,跑之前你就能逐行看完。对于”有条件分支、有批量步骤”的任务,PTC 在效率和可调试性上都碾压顺序调用。
把”Agent 一步步试”升级成”Agent 写好方案一次跑完”,这个方向我个人非常看好,大概率会被后来者抄。

第五章 一切皆插件,落到你手上是什么
看仓库你就懂了:文件编辑是 @dsh/plugin-str-replace-editor,Shell 是 plugin-bash,检索、规划器、目标跟踪、子 Agent、工作流、Web UI,个个都是独立插件包。底层 Cordis 内核不装任何业务逻辑,只管插件的注册、依赖和生命周期。
落到你手上是什么?先说换模型:推理层只是个插件,DeepSeek、Anthropic、OpenAI、Bedrock、Azure、Vertex,甚至任何 OpenAI 兼容端点,改配置就换,代码一行不动。
更损的玩法也有。官方就有插件把 Claude Code 接成子 Agent,编排对手、包住对手,边界感瞬间模糊。
想自己写一个,门槛也没想象中高。GitHub 上搜 topic dsh-plugin,社区范例一大堆,照着模板写个自己的工具插件,挂进 profile 就能用。
还有个隐藏彩蛋:Cordis 的”时间可组合性”承诺插件卸载时能撤销副作用。运行时热插拔就靠这个撑着;再往前想一步,Agent 给自己装插件、卸插件,也就顺理成章了。
第六章 避坑清单:预览版的账要算清
真话环节,这几个坑我现在就知道:
- 它是 0.1 预览版:官方明说会有破坏性变更,插件 API 不稳、文档滞后于代码。学习、试点、自托管随便玩,生产关键路径别赌它。
- 沙箱能力看系统:Windows 上跑基础功能没问题,但强沙箱场景 Linux 或 WSL 更稳,涉及删文件跑命令的任务尤其如此。
- 权限模式别全开:工具执行前有 Hook、审批、权限检查这道流水线,第一次用建议收紧审批档位,看清楚它要干嘛再放行。
- 任务设计从只读开始:先跑”梳理仓库、列出测试命令、提一个只读验证任务”这种探路任务,摸清它的行为模式,再放手让它改东西。
- 留意推理成本:框架白送,模型调用照常计费。长任务轨迹一长,token 烧得比你想象快,错峰调用能省不少。
第七章 总结:谁该现在上车
我的判断很直接:如果你在做 Agent 基础设施、想学插件优先架构、或者想要一个完全可检视的开源运行时,现在就是上车的最好时机,趁着插件生态刚起步,你的插件就是早期占位。
如果你只是想要个开箱即用的编程助手,那先用 Standard 模式体验就好,别急着改造。
最后留个钩子:dsh 的会话是只追加的事件流,系统提示、推理链、工具调用全记着,支持恢复和重放。把这块玩明白,你就摸到 Agent 可观测性的门了。下一篇可以展开讲。关注圈圈,每天带你把一个 AI 工具用明白。
暂无评论内容