DeepSeek Harness完整上手:4种模式、权限、插件一次讲透
文章目录
P.S. 推荐一个大神的教程给想要了解或者学习人工智能知识的读者,这个教程里内容讲解通俗易懂且风趣幽默,对我帮助很大。我想与大家分享这个宝藏教程,请点击下方链接查看, 传送门https://blog.csdn.net/qq_74013365
1. 我先把自己看进源码了
1.1 一开始我差点给它画架构图
DeepSeek Harness刚出来那几天,我手贱点进了官网。
先点开架构参考,再翻第一个插件开发教程。
Cordis、事件、插件、配置层,名词一个接一个往眼里砸。
看了半小时,我代码一行没写,差点先掏出工具给它画架构图。
后来我才反应过来,一页是给架构开发者看的,一页是给插件作者看的。
新手入门?根本不从这俩地方开始。
合着我上来直接进了硬核难度副本,新手村门都没摸着。
2. 先把它和Codex掰明白
2.1 一个公式说透本质
很多人搞不清这俩啥区别,以为又是个新的编码AI。
其实官方自己给了个公式:Agent = Model + Harness。
啥意思?
模型就是DeepSeek、GPT、Claude这些,负责动脑子出主意。
但模型自己不会开终端、改文件,它只会张嘴说要干啥。
真正动手干活的,是外面这层Agent程序。
Codex这类产品,就是把模型、文件读写、终端、权限、界面全给你组装好了。
打开就能用,像买成品家电,插电就干活,省心。
Harness不一样,它把零件全给你摊开了。
你可以换模型、换工具、改权限,甚至自己重新拼一套Agent出来。
说白了,Codex是精装修拎包入住,Harness是给你毛坯房加全套工具,想怎么装自己来。
还送你个本地Web界面,不是只能看的SDK,真能跑起来干活。
3. 新建会话那四个模式,到底在换啥
很多人新建会话一看四个选项,直接懵了。
以为是四种不同的AI性格,或者聪明程度不一样。
想多了,换的不是脑子,是手里的工具包。
你就理解成四套预先配好的工具清单,规定了这个Agent能用啥工具、按啥流程干活。
3.1 标准模式:日常干活首选
标准模式就是完整版编码Agent。
文件编辑、Shell、搜索、计划、工作流,常用能力全给你配齐。
第一次用,选这个就对了,别瞎点别的。
就像去饭店点标配套餐,最不容易踩雷。
3.2 PTC模式:不是新算法,是换了个干活方式
很多人一听PTC模式,觉得是什么黑科技新算法。
我一开始也以为,用了才知道,就是换了个调用工具的方式。
普通模式里,AI要搜索、读文件、统计,每一步都单独发一次工具请求。
一步一想,一想一步,像个老实打工人,做一步汇报一步。
PTC模式多了个run_code入口。
AI会自己写一小段TypeScript,在代码里循环调用工具、过滤结果,最后把汇总结果给你。
说白了就是,以前它自己手动搬砖,现在它先写个脚本让脚本搬砖。
我专门拿同一个任务测了俩模式。
让它们扫描仓库里的package.json,统计内部依赖排个名。
标准模式前前后后10次顶层工具调用,一步一步来。
PTC模式只有6次,其中一次是跑自己写的代码。
当然代码内部还是调了一堆工具,不是凭空出结果。
最后结果基本一致,就是干活的组织方式变了。
适合那种批量遍历、重复统计的活,能少跟你来回汇报好几次。
3.3 剩下俩模式,新手基本用不上
极简模式,就留了个持久Bash和文本替换编辑器。
相当于把工具箱里的东西全拿走,就留一把螺丝刀一把锤子。
适合想研究最小Agent长啥样的人,日常写代码用这个纯属给自己找罪受。
创造模式,是给想改Harness本身的人准备的。
除了标准模式的能力,还加了运行时检查、插件实验、preset创作指导。
新手第一次用,这个可以直接忽略,等你玩明白插件了再碰也不迟。
总结一下:
标准是全套组装好的工具包,PTC是用代码组织多步操作,极简是主动删工具,创造是用来做新工具包的。
再也别问哪个更聪明了,脑子都是同一个,手里家伙事儿不一样而已。
4. “轨迹”页才是排查问题的神器
很多人用编码Agent,最怕的就是任务卡住。
只看最后一句报错,根本不知道哪步出了问题。
Harness这点做得很实在,每个会话都有“对话”和“轨迹”两个页。
对话页给你看最终结果,轨迹页把全过程给你扒得明明白白。
输入内容、模型请求、工具调用、返回结果,按时间排得整整齐齐。
橙色是工具调用,紫色是模型输出,绿色是注入的上下文。
点进去还能看到Bash跑了啥命令、读了哪个文件、工具返回了啥结果。
我对比Standard和PTC的区别,全是从这儿看的。
以后任务卡壳了,别盯着对话页干着急,切去轨迹页,哪步出问题一眼就能看见。
当然它也不是读心术,看不到模型完整的内心戏,只能记录框架能观察到的事件。
但排查问题,完全够用了。
5. 权限和模型,别瞎搞
5.1 权限设置,保持默认就好
用过Codex的对这几个权限应该很熟:read-only、workspace-write、full access。
决定了Agent能改哪些文件、跑命令要不要你审批。
第一次试,保持workspace-write就够了。
别上来就开full access,真给你删点啥关键文件,哭都来不及。
顺便提一句,这个权限主要约束写入位置。
不是说开了workspace-write,你电脑别的文件它就读不到了,读取范围、网络访问这些不会自动缩到工作区里。
还有那个Plan模式,就是让它先出方案再执行,不是替代权限设置的,别搞混了。
5.2 模型随便换,前提是你有密钥
接模型最简单的方式,就是填DeepSeek的API Key。
想接别的模型也没问题,设置里能加一堆内置提供方。
Anthropic、OpenAI、Google、月之暗面、通义千问,市面上叫得上名的基本都有。
公司有网关或者自己搭的服务,也能走自定义提供方。
填基础URL、API协议、凭据和模型名就行。
但踩坑提示放这儿:
不是把URL粘进去就完事了,服务端得支持对应协议,认证方式也得对上。
不然配半天连不上,别赖产品不好用,先看看自己家网关对不对标。
6. 插件才是这东西的灵魂
说了这么多,Harness的核心到底是啥?
是插件。
插件就是它组装能力的基本单位。
加模型适配器、加工具、加界面、加工作流,全靠插件。
前面说的那四套Agent preset,本质上就是不同的插件组合。
你想加新能力,就装新插件;想改现有能力,就改对应插件。
现在插件列表里已经有一百六十多个了,能玩的东西很多。
后面有机会再单独聊怎么开发插件、怎么挑社区插件。
7. 桌面端?基本都是社区做的
很多人问有没有桌面端,不想每次开终端敲命令。
官方目前只有CLI和本地Web UI,没出官方桌面应用。
现在网上能搜到的各种DeepSeek Harness Desktop,全是社区维护的开源项目。
而且同名的还不止一个。
干的事儿也简单,就是把Node、CLI、Web UI包一层,做成双击就能启动的程序。
图方便可以用,但别当成官方出品就行。
8. 现在到底要不要试
最后说句实在的。
如果你就是想赶紧把代码写完,早点下班。
那Codex、Claude Code这类成品更适合你。
常用工具、权限、工作流都给你整理好了,上手就能用,省心。
但如果你就好奇,想知道一个Agent到底是怎么把模型、工具、权限拼到一起的。
或者你想折腾,想自己改点东西、做个自定义Agent。
那Harness真的很合适,入口很直接,本地就能跑起来。
毕竟现在愿意把底层全露出来给你玩的产品,真不多。
当然它现在还是开发预览版,版本变更快,坑也不少。
适合有时间、愿意折腾的开发者去玩。
其他人嘛,先用成熟产品也不迟。
最后总结一句话:
Codex把Agent组装好交给你,Harness连组装方式也一起交给了你。
P.S. 推荐一个大神的教程给想要了解或者学习人工智能知识的读者,这个教程里内容讲解通俗易懂且风趣幽默,对我帮助很大。我想与大家分享这个宝藏教程,请点击下方链接查看,传送门https://blog.csdn.net/qq_74013365
更多推荐



所有评论(0)