DeepSeek 又放大招!开源 AI Agent 框架 Harness:一切皆插件
🔥 DeepSeek 开源新作 · 开发者预览版
Harness 赋予 Agent 理解环境、使用工具,并在真实场景中持续工作的能力。—— DeepSeek 官方
2025 年,AI 圈的关键词已经从「聊天」变成了「干活」。Claude Code、Cursor、各类 Coding Agent 层出不穷——但它们大多是封闭、不可拆解的黑盒。
而 DeepSeek 选择了一条不一样的路:把 Agent 框架彻底开源,并且用一种近乎偏执的设计哲学告诉所有人——「Everything is a Plugin」(一切皆插件)。
它就是 DeepSeek Harness(简称 DSH)。今天这篇,我们就来好好拆解一下,它到底牛在哪、怎么玩。
| 指标 | 数据 |
|---|---|
| ⭐ GitHub Stars | 26.4k |
| 🍴 Forks | 1.9k |
| 📜 License | MIT |
| 🧩 主语言 | TypeScript |
一、它到底是什么?
💡 一句话概括:DeepSeek Harness 是 DeepSeek 团队开源的一款 AI Agent 框架,目前处于开发者预览阶段(Developer Preview),采用宽松的 MIT 协议。
它和市面上那些「只能聊天的 Agent」最大的区别在于——它是一个真正能在你的电脑上、按你的指令持续干活的编码智能体环境:能读写文件、执行 Shell 命令、检索网页、调度子 Agent、编排工作流。
你可以把它理解为:DeepSeek 版的「Claude Code」,但是开源、可插拔、可深度定制。它既是给你用的现成工具,也是给你改造的底层平台。
更关键的是,框架本身不绑定单一模型。Harness 只是「骨架」,模型、工具、技能、界面……全是挂在骨架上的「插件」。这是它最激进、也最迷人的一点。
二、核心理念:一切皆插件(Everything is a Plugin)
打开它的 GitHub 仓库,你会看到这句作为简介的话:「DeepSeek Harness: Everything is a Plugin.」 这不是一句营销口号,而是贯穿整个架构的设计准则。
传统的 Agent 框架,往往是「功能写死在内核里」——想换个模型?改源码。想加个新工具?改源码。而 Harness 彻底反转了这个思路:

这套架构的底层,是开源框架 Cordis。它的内核只做一件事——管理插件的加载、卸载和依赖关系,绝不掺和 Agent 的具体业务。正因如此,内核才能做到极致轻量。
那么,「插件」到底能挂什么?几乎是 Agent 的一切能力:
| 能力 | 说明 |
|---|---|
| 🤖 模型 Models | DeepSeek / 其他 LLM 随意切换 |
| 🛠️ 工具 Tools | 文件编辑、Shell、检索… |
| ✨ 技能 Skills | 封装好的复合工作流 |
| 📦 沙箱 Sandbox | 安全的代码执行环境 |
| 🗄️ 存储 & 调度 | 上下文与任务编排 |
| 🖥️ 界面 UI | 连可视化界面都是插件 |
🔓 配置层自由组合: 开发者无需改动源码,就能在配置层选择、替换或扩展上面任意一项能力。想换模型?改配置。想自定义工具链?改配置。这种「乐高式」的灵活度,才是它真正的杀手锏。
三、四种运行模式,各司其职
Harness 没有搞「一刀切」,而是为不同场景准备了四种截然不同的运行模式,从「开箱即用」到「极限测试」全覆盖:
🚀 标准模式 · Standard(日常首选)
功能最完整的编码 Agent 环境,绝大多数人就用它。
- 📁 文件编辑、💻 Shell 命令、🔎 网页与文件检索
- 🎯 目标设定、🤝 子 Agent 调用、⚙️ 工作流编排
🐍 PTC 模式 · Program-to-Code(高阶玩法)
在标准模式基础上,通过 Code Mode SDK 暴露工具——
- 让 AI 直接编写一段 TypeScript 程序,把多步复杂操作串起来执行
- 比一次次单独调用工具更高效、更可控
🧪 极简模式 · Minimal(模型评测)
专为最小化环境下的模型基准测试而设计,只保留两样东西:
- 一个持久化 bash
- 一个文件编辑工具(
str_replace_editor)
用来测试模型最基础的控制能力,剔除噪音
🎨 创造模式 · Creative(深度定制)
给「想造轮子」的人准备的实验场:
- 运行时检查系统状态、在内存中直接试验 Cordis 插件
- 引导你组合并创作出全新的自定义 Agent 预设
四、运行有迹可循(Observability)
Agent 最让人头疼的问题之一,就是「它到底干了啥?」 黑盒一旦出错,排查简直是噩梦。Harness 在这点上做得相当克制且优雅:
📋 仅追加(append-only)的会话日志。 模型「看到」的一切——系统提示词、思维链、工具调用记录、上下文注入——全部被如实记录。
更赞的是,它提供了 Trajectory(轨迹)视图,你可以按「数据来源」逐条审查 Agent 的每一步动作,并支持:
| 操作 | 作用 |
|---|---|
| ⏮️ 恢复 Resume | 从某处继续往下执行 |
| 🌿 分叉 Fork | 在关键节点开辟新路径 |
| 🎬 回放 Replay | 完整复现整个执行过程 |
| 🔍 审查 Audit | 按来源逐条追溯 |
这意味着调试 Agent 像调试普通程序一样可回溯、可复现——对开发者而言,这是梦寐以求的体验。
五、一行命令,马上开玩
说了这么多,怎么用?门槛低到令人发指。只要你的电脑装了 Node.js,打开终端敲一行命令:
# 一行命令启动 Web UI(无需克隆源码)
npx @deepseek-ai/dsh web
🚀 DeepSeek Harness 启动中...
🌐 默认访问地址:http://127.0.0.1:3080
✅ 就绪!在浏览器打开即可使用
它会在本地 http://127.0.0.1:3080 启动一个可视化的 Web 界面,打开就能和 Agent 交互。你没看错,连 UI 都是本地运行的,数据不出本机。
如果你是想深度魔改的开发者,也可以从源码构建:
# 1. 克隆仓库
git clone https://github.com/deepseek-ai/deepseek-harness.git
cd deepseek-harness
2. 安装依赖(项目用 pnpm 管理的 Monorepo)
pnpm install
3. 构建
pnpm run build
4. 启动!
pnpm dsh web
六、给开发者的技术档案(Under the Hood)
从仓库结构能看出,这是一个工程化程度相当高的项目。技术选型现代、工具链齐全:
| 维度 | 技术选型 |
|---|---|
| 编程语言 | TypeScript(大量 .tsx / tsconfig) |
| 包管理 | pnpm(Monorepo 单仓库) |
| 底层框架 | Cordis(插件化内核) |
| 构建工具 | tsdown |
| 测试体系 | Vitest(含 E2E、压测、性能测试套件)+ pytest |
| 代码规范 | oxlint、jscpd、knip 等多重质量门禁 |
| 开源协议 | MIT(含第三方依赖声明) |
⚠️ 开发者请注意: 项目目前处于 Developer Preview 阶段,迭代非常快,未来会有破坏性兼容更新(WILL BE COMPATIBILITY-BREAKING CHANGES)。生产环境慎用,尝鲜 / 学习 / 贡献代码正当时!
七、为什么它值得关注?
① 开源透明,打破黑盒。 Claude Code 们再强也是闭源黑盒。Harness 把整个 Agent 的运作机制摊开给你看——提示词、思维链、工具调用,全部可审计。
② 架构先进,工程优雅。 「一切皆插件 + Cordis 内核」的组合,让内核轻、能力强、可组合。这种设计范式本身,就值得每个 Agent 开发者学习。
③ 上手极低,深度极高。 普通用户 npx 一行命令开跑;硬核开发者能从配置层一路玩到内核插件——覆盖从尝鲜到造轮子的全光谱。
④ DeepSeek 出品,社区起势。 开源即斩获 26.4k Stars。背靠 DeepSeek 的模型能力 + 活跃的 Discord / GitHub Discussions 社区,生态可期。
⑤ 它定义了一种新范式。 当 Agent 框架也开始讲究「时空可组合性」,我们或许正在见证——下一代 AI 应用的开发范式正在成形。
项目地址(GitHub): 👉 github.com/deepseek-ai/deepseek-harness
觉得本文不错的朋友动动小手点个赞!
更多推荐



所有评论(0)