在这里插入图片描述
P.S. 推荐一个大神的教程给想要了解或者学习人工智能知识的读者,这个教程里内容讲解通俗易懂且风趣幽默,对我帮助很大。我想与大家分享这个宝藏教程,请点击下方链接查看, 传送门https://blog.csdn.net/qq_74013365

1. 我先把自己看进源码了

1.1 一开始我差点给它画架构图

DeepSeek Harness刚出来那几天,我手贱点进了官网。

先点开架构参考,再翻第一个插件开发教程。

Cordis、事件、插件、配置层,名词一个接一个往眼里砸。

看了半小时,我代码一行没写,差点先掏出工具给它画架构图。

后来我才反应过来,一页是给架构开发者看的,一页是给插件作者看的。

新手入门?根本不从这俩地方开始。

合着我上来直接进了硬核难度副本,新手村门都没摸着。

2. 先把它和Codex掰明白

2.1 一个公式说透本质

很多人搞不清这俩啥区别,以为又是个新的编码AI。

其实官方自己给了个公式:Agent = Model + Harness。

啥意思?

模型就是DeepSeek、GPT、Claude这些,负责动脑子出主意。

但模型自己不会开终端、改文件,它只会张嘴说要干啥。

真正动手干活的,是外面这层Agent程序。

Codex这类产品,就是把模型、文件读写、终端、权限、界面全给你组装好了。

打开就能用,像买成品家电,插电就干活,省心。

Harness不一样,它把零件全给你摊开了。

你可以换模型、换工具、改权限,甚至自己重新拼一套Agent出来。

说白了,Codex是精装修拎包入住,Harness是给你毛坯房加全套工具,想怎么装自己来。

还送你个本地Web界面,不是只能看的SDK,真能跑起来干活。

3. 新建会话那四个模式,到底在换啥

很多人新建会话一看四个选项,直接懵了。

以为是四种不同的AI性格,或者聪明程度不一样。

想多了,换的不是脑子,是手里的工具包。

你就理解成四套预先配好的工具清单,规定了这个Agent能用啥工具、按啥流程干活。

3.1 标准模式:日常干活首选

标准模式就是完整版编码Agent。

文件编辑、Shell、搜索、计划、工作流,常用能力全给你配齐。

第一次用,选这个就对了,别瞎点别的。

就像去饭店点标配套餐,最不容易踩雷。

3.2 PTC模式:不是新算法,是换了个干活方式

很多人一听PTC模式,觉得是什么黑科技新算法。

我一开始也以为,用了才知道,就是换了个调用工具的方式。

普通模式里,AI要搜索、读文件、统计,每一步都单独发一次工具请求。

一步一想,一想一步,像个老实打工人,做一步汇报一步。

PTC模式多了个run_code入口。

AI会自己写一小段TypeScript,在代码里循环调用工具、过滤结果,最后把汇总结果给你。

说白了就是,以前它自己手动搬砖,现在它先写个脚本让脚本搬砖。

我专门拿同一个任务测了俩模式。

让它们扫描仓库里的package.json,统计内部依赖排个名。

标准模式前前后后10次顶层工具调用,一步一步来。

PTC模式只有6次,其中一次是跑自己写的代码。

当然代码内部还是调了一堆工具,不是凭空出结果。

最后结果基本一致,就是干活的组织方式变了。

适合那种批量遍历、重复统计的活,能少跟你来回汇报好几次。

3.3 剩下俩模式,新手基本用不上

极简模式,就留了个持久Bash和文本替换编辑器。

相当于把工具箱里的东西全拿走,就留一把螺丝刀一把锤子。

适合想研究最小Agent长啥样的人,日常写代码用这个纯属给自己找罪受。

创造模式,是给想改Harness本身的人准备的。

除了标准模式的能力,还加了运行时检查、插件实验、preset创作指导。

新手第一次用,这个可以直接忽略,等你玩明白插件了再碰也不迟。

总结一下:

标准是全套组装好的工具包,PTC是用代码组织多步操作,极简是主动删工具,创造是用来做新工具包的。

再也别问哪个更聪明了,脑子都是同一个,手里家伙事儿不一样而已。

4. “轨迹”页才是排查问题的神器

很多人用编码Agent,最怕的就是任务卡住。

只看最后一句报错,根本不知道哪步出了问题。

Harness这点做得很实在,每个会话都有“对话”和“轨迹”两个页。

对话页给你看最终结果,轨迹页把全过程给你扒得明明白白。

输入内容、模型请求、工具调用、返回结果,按时间排得整整齐齐。

橙色是工具调用,紫色是模型输出,绿色是注入的上下文。

点进去还能看到Bash跑了啥命令、读了哪个文件、工具返回了啥结果。

我对比Standard和PTC的区别,全是从这儿看的。

以后任务卡壳了,别盯着对话页干着急,切去轨迹页,哪步出问题一眼就能看见。

当然它也不是读心术,看不到模型完整的内心戏,只能记录框架能观察到的事件。

但排查问题,完全够用了。

5. 权限和模型,别瞎搞

5.1 权限设置,保持默认就好

用过Codex的对这几个权限应该很熟:read-only、workspace-write、full access。

决定了Agent能改哪些文件、跑命令要不要你审批。

第一次试,保持workspace-write就够了。

别上来就开full access,真给你删点啥关键文件,哭都来不及。

顺便提一句,这个权限主要约束写入位置。

不是说开了workspace-write,你电脑别的文件它就读不到了,读取范围、网络访问这些不会自动缩到工作区里。

还有那个Plan模式,就是让它先出方案再执行,不是替代权限设置的,别搞混了。

5.2 模型随便换,前提是你有密钥

接模型最简单的方式,就是填DeepSeek的API Key。

想接别的模型也没问题,设置里能加一堆内置提供方。

Anthropic、OpenAI、Google、月之暗面、通义千问,市面上叫得上名的基本都有。

公司有网关或者自己搭的服务,也能走自定义提供方。

填基础URL、API协议、凭据和模型名就行。

但踩坑提示放这儿:

不是把URL粘进去就完事了,服务端得支持对应协议,认证方式也得对上。

不然配半天连不上,别赖产品不好用,先看看自己家网关对不对标。

6. 插件才是这东西的灵魂

说了这么多,Harness的核心到底是啥?

是插件。

插件就是它组装能力的基本单位。

加模型适配器、加工具、加界面、加工作流,全靠插件。

前面说的那四套Agent preset,本质上就是不同的插件组合。

你想加新能力,就装新插件;想改现有能力,就改对应插件。

现在插件列表里已经有一百六十多个了,能玩的东西很多。

后面有机会再单独聊怎么开发插件、怎么挑社区插件。

7. 桌面端?基本都是社区做的

很多人问有没有桌面端,不想每次开终端敲命令。

官方目前只有CLI和本地Web UI,没出官方桌面应用。

现在网上能搜到的各种DeepSeek Harness Desktop,全是社区维护的开源项目。

而且同名的还不止一个。

干的事儿也简单,就是把Node、CLI、Web UI包一层,做成双击就能启动的程序。

图方便可以用,但别当成官方出品就行。

8. 现在到底要不要试

最后说句实在的。

如果你就是想赶紧把代码写完,早点下班。

那Codex、Claude Code这类成品更适合你。

常用工具、权限、工作流都给你整理好了,上手就能用,省心。

但如果你就好奇,想知道一个Agent到底是怎么把模型、工具、权限拼到一起的。

或者你想折腾,想自己改点东西、做个自定义Agent。

那Harness真的很合适,入口很直接,本地就能跑起来。

毕竟现在愿意把底层全露出来给你玩的产品,真不多。

当然它现在还是开发预览版,版本变更快,坑也不少。

适合有时间、愿意折腾的开发者去玩。

其他人嘛,先用成熟产品也不迟。

最后总结一句话:

Codex把Agent组装好交给你,Harness连组装方式也一起交给了你。

P.S. 推荐一个大神的教程给想要了解或者学习人工智能知识的读者,这个教程里内容讲解通俗易懂且风趣幽默,对我帮助很大。我想与大家分享这个宝藏教程,请点击下方链接查看,传送门https://blog.csdn.net/qq_74013365

更多推荐