30天 LLM+RL+Agent 成长计划(day4)
彻底分清固定prompt、Agent和Skill!用通俗类比讲透AI工具逻辑
最近我身边好多朋友,还有我自己,都想试着做一个属于自己的AI Agent(比如我就想做一个能把小说改成动漫短视频的),但越琢磨越懵:Agent到底跟我们平时用的那种固定指令(也就是固定prompt)有啥不一样?Skill又是什么东西?其实这三个概念看着玄乎,只要用咱们生活里的事儿串起来说,一下子就能懂,今天就用最接地气的方式,把这三个知识点讲明白,哪怕是刚接触的新手,也能轻松搞懂。
先给大家划个重点,记好这句话,后面所有内容都围着它转:固定prompt就是“一次性的指令”,Agent是“能自己琢磨、自己统筹事儿的小助手”,Skill就是这个小助手干活时,得用到的各种“工具和小脚本”,三者凑到一起,才能让AI自己完成一整套复杂的事儿,不用我们一遍一遍手动输指令、催进度。
一、先分清基础:固定prompt vs Agent(3个生活类比,一看就懂)
我们平时用AI,大多都是输一句固定的话,比如“帮我总结一下这段文字”“给我写一句文案”,但Agent跟这完全不是一回事——固定prompt是“你说一步,它做一步”,多一点都不主动;Agent是“你说个目标,它从头到尾帮你搞定”,咱们用三个平时常遇到的场景,就能分清二者的区别:
类比1:点餐——固定prompt=点单指令,Agent=专属服务员
• 固定prompt:你跟服务员说“给我来一份番茄炒蛋”,这就是最典型的固定prompt。它的作用特别单一,就只是让对方做“下单番茄炒蛋”这一件事,服务员不会主动问你要不要配米饭、能不能吃辣,也不会帮你催单、递餐具,等菜上了,这事儿就结束了。就像我们用AI时,输一句“总结这段小说”,它就只给你总结,不会多问一句、多做一步。
• Agent:你跟专属服务员说“我想吃点清淡的家常菜,能吃饱就行”,这就是个比较模糊的需求,而Agent就像这个贴心的服务员——它会主动问你“能接受番茄吗?要不要配碗米饭?”,还会帮你搭配番茄炒蛋+清炒时蔬+米饭,下单后会主动帮你催单,菜上了递餐具,甚至吃完了还会问你“口味合不合口,要不要再加碗饭”,全程不用你多费一句话,自己就把所有事儿统筹好,直到让你吃舒服、吃饱。
类比2:做饭——固定prompt=单一菜谱步骤,Agent=全职厨师
• 固定prompt:你查菜谱时,看到“番茄炒蛋的步骤:打鸡蛋、炒鸡蛋、炒番茄、混合调味”,这就是固定prompt。它只告诉你该怎么做,不会帮你准备番茄、鸡蛋这些食材,不会根据你的口味调整火候,也不管你爱吃偏甜还是偏咸,就只是一套固定的步骤,你不手动操作,它就一直放在那儿,跟我们输一句“写一段视频脚本”,AI就只写脚本、不管合不合适,是一个道理。
• Agent:你跟家里的全职厨师说“帮我做一份适合小孩吃的番茄炒蛋”,Agent就像这个厨师——它会自己去买新鲜的番茄和鸡蛋,处理干净,炒的时候调整火候,避免炒糊,还会少放糖、少放盐,适配小孩的口味,炒好后装盘,甚至会帮你把灶台擦干净,全程不用你动手,还能想到你没说出来的需求,这就是Agent最核心的好处:能自己统筹、自己变通。
类比3:旅行——固定prompt=单一导航指令,Agent=专属导游
• 固定prompt:你打开导航,说“导航到故宫”,这就是固定prompt。它就只做一件事:给你指去故宫的路,不会告诉你故宫门票怎么买、哪个景点值得看、附近有什么适合小孩吃的餐厅,就算路线堵了,也不会主动调整,除非你重新输指令,就像AI只听单一指令,不会自己变通一样。
• Agent:你跟专属导游说“我想带小孩去北京玩2天,不想太赶,轻松一点”,Agent就像这个导游——它会自己帮你规划行程,第一天去故宫+天安门,第二天去颐和园,还会帮你买好门票、查好交通,提醒你带小孩需要带的东西,遇到堵车会主动换路线,甚至会帮你找适合小孩吃的餐厅,全程帮你把所有细节都搞定,直到旅行结束,这就是Agent和固定prompt最本质的区别:能自己想事儿、自己解决问题。
二、关键补充:做Agent时,写的prompt和普通固定prompt不一样!
很多人都会有一个疑问:既然Agent这么好用,那做它的时候,不也是写了一段指令(prompt)吗?其实这话没毛病,但这段指令,跟我们平时用的普通固定prompt,完全不是一回事,一句话就能说清:普通固定prompt是“让AI做一件具体的事”,而做Agent时写的prompt,是“教AI学会自己做事的能力”。
拿我自己举例:我想做一个能把小说改成动漫短视频的Agent,做它的时候,我写的那段prompt,不是“帮我总结这本小说”“帮我生成人物形象”这种单一的指令,而是一套“做事规则+流程框架”——比如我会写“你要先把指定的小说完整读一遍,把剧情和人物都搞明白;然后生成所有重要人物的形象,一旦定好就不能改;接着把小说的核心内容总结出来,合理分成适合做短视频的片段,确定要做多少个视频;最后给每个片段写好动漫短视频的脚本”。
这段prompt的作用,就是让大模型先把这些规则和框架看懂、记牢,相当于给Agent“定好规矩、装好人脑”。之后我只需要跟它说“用这本小说做动漫短视频”,它就会按照我提前定好的框架,自己从头到尾把所有事儿都做完,不用我一遍一遍催着它“先读小说”“再生成人物”。而普通的固定prompt,永远做不到这一点,它只能做你明确说的那一件事,不会自己统筹全程。
三、串联最后一块拼图:Skill(技能)= Agent的“工具脚本”
搞懂了Agent和prompt,Skill就很好理解了——按咱们的理解,Skill其实就是Agent自己干活的时候,需要用到的各种“工具和小脚本”,就像Agent的“手脚”,它自己不会主动去做事,但Agent想做具体的细节操作时,必须靠它。要是没有Skill,Agent就算有“大脑”,也没法落地做事,相当于空有想法,却没能力动手。
还是拿我想做的“小说转动漫短视频”Agent来说:Agent的核心能力(就是我写prompt定的那些规则),是把整个流程统筹好,而流程里的每一个具体操作,都得靠对应的Skill(工具脚本)来实现,比如:
-
生成人物图像的Skill:就是一个能根据小说里的描述,精准做出人物形象的小工具,Agent要生成人物时,就用它,而且生成之后,就一直用这个形象,不随便改;
-
总结小说的Skill:就是一个能把小说的核心剧情、人物关系提炼出来的小工具,Agent要拆分剧情前,就用它,为后面分短视频片段打基础;
-
写视频脚本的Skill:就是一个能根据拆分好的剧情片段,写出适合做动漫短视频脚本的小工具,Agent分好剧情后,就用它,把最终的脚本写出来。
四、总结:三者的关系,用一句话讲透
普通固定prompt是“一次性指令”,只能让AI做一件事;做Agent时写的prompt是“能力设定”,教AI学会自己统筹做事;Skill是“工具脚本”,帮Agent把具体的事落地。三者的关系其实很简单:做Agent的prompt给Agent“定规矩、装大脑”,Skill给Agent“装手脚”,固定prompt只是Agent偶尔可能用到的“临时指令”,三者配合起来,Agent才能自己完成一整套复杂的事儿(比如我想要的小说转动漫短视频全流程)。
看到这儿,相信大家都能彻底分清Agent、固定prompt和Skill的区别了。其实不用把它们想得太复杂,本质上就是“大脑(Agent)+ 规矩(做Agent的prompt)+ 手脚(Skill)”的组合,比我们平时用的单一指令,更省心、更智能,这也是Agent最实用的地方。
更多推荐


所有评论(0)