你是否也有过这样的感受:关于 AI 的讨论无处不在,你时常听到 Token、Prompt、MCP、Agent、Skill 这些词在耳边打转,隐约觉得它们很重要,可真要你说清楚它们分别指什么、彼此又是什么关系,脑子里却像隔着一层雾。

其实,这种感觉恰恰说明你触碰到了当前 AI 生态中最核心的那一层——它们不是零散的流行词,而是共同构成了一张从“底层模型”到“上层应用”的技术地图。

接下来,我将这些关键词分为四个层级,逐一拆解,并在最后为你梳理出一张清晰的全景图。读完这篇,你不仅能听懂每一场 AI 对话,更能看清它们背后那条完整的逻辑链。

为了让你更清晰地把握全局,我将这些概念划分为四个层级逐一拆解,并在最后梳理它们之间的深层关联。

1. 核心基础层:模型的“大脑”与“记忆”
这一层决定了 AI 能做什么,以及它能记住多少信息。

  • Token(词元)

    • 含义:AI 处理文本的最小单元。它不完全等同于“字”或“单词”,通常一个汉字约合 1–2 个 token,一个英文单词约合 1–1.5 个 token。

    • 作用:AI 的“计量单位”。模型的理解能力、生成速度、费用成本,皆以 Token 为基准。

  • Context Window(上下文窗口)

    • 含义:模型单次所能处理的 Token 上限(如 128k、1M tokens)。

    • 作用:决定了 AI 的“短期记忆”容量。窗口越大,AI 能阅读的文档越长,能留存的对话历史越久,应对复杂任务的能力也越强。

  • Context Engineering(上下文工程)

    • 含义:一个新兴的工程学科。在有限的 Context Window 内,通过检索、压缩、排序、摘要等策略,精准构建出最适合当前任务的输入信息。

    • 作用:解决“模型虽聪明却记不住、抓不住重点”的难题。它是连接 RAG、Prompt 与 Model 的桥梁,也是打造高质量 Agent 的关键瓶颈。

  • Prompt(提示词)

    • 含义:给 AI 的指令、背景信息或示例。

    • 作用:激活模型能力的“钥匙”。在 Agent 时代,Prompt 不再只是简单的一问一答,而是包含角色设定、工具定义、思维链(CoT)等结构化内容的系统级指令。

2. 能力扩展层:让 AI “长出手脚”
大模型本身只能生成文本,这一层赋予了它行动和获取外部知识的能力。

  • Tool Calling(工具调用 / Function Calling)

    • 含义:模型根据用户意图,自主决定调用哪个外部 API 或函数,并生成正确的参数格式。

    • 作用:让 AI 从“聊天机器人”蜕变为“执行者”。例如查天气、写代码、操作数据库,这正是 Agent 的核心驱动力。

  • RAG(检索增强生成)

    • 含义:在作答之前,先从外部知识库中检索相关信息,将其注入 Prompt,再由模型生成答案。

    • 作用:解决模型幻觉与知识过时问题,让 AI 能够调用“私有知识”与“实时信息”。

  • Vector Database(向量数据库)

    • 含义:专门存储文本或图像向量(Embeddings)的数据库,支持语义相似度搜索。

    • 作用:RAG 的“基础设施”,让 AI 能通过“意思”而非“关键词”来查找数据。

  • MCP(模型上下文协议)

    • 含义:由 Anthropic 提出的开放标准协议,旨在统一 AI 模型与外部数据源、工具之间的连接方式。

    • 作用:AI 世界的“USB-C 接口”。以往每个工具都要单独编写适配代码;有了 MCP,Agent 可以即插即用地连接各类服务与数据,极大降低集成成本。

  • Computer Use(计算机使用)

    • 含义:AI 直接像人一样操作电脑 GUI(点击鼠标、敲击键盘、识别屏幕像素),而非仅仅调用 API。

    • 作用:应对“没有 API 怎么办”的场景。让 AI 能操控遗留系统、网页端软件,是实现全能 Agent 的最后一块拼图。

3. 智能体与工作流层:编排与执行
这一层将上述能力组装成能够完成复杂任务的系统。

  • Agent(智能体)

    • 含义:具备感知、规划、记忆、工具使用能力的自主 AI 系统。它不仅回答问题,更会为达成目标而主动拆解任务、循环执行。

    • 作用:AI 应用的终极形态。例如,一个自动帮你调研市场并输出报告的 AI 员工。

  • Skill(技能)

    • 含义:Agent 所具备的具体能力模块,通常封装了特定的 Prompt + Tool + 逻辑。

    • 作用:模块化设计。一个 Agent 可以加载“数据分析 Skill”、“邮件写作 Skill”等,像安装插件一样扩展能力。

  • Workflow(工作流)

    • 含义:预定义的、确定性的业务流程编排(如 Dify/Coze 中的画布)。

    • 作用:保障业务稳定性。Agent 擅长“自主决策”,适合开放任务;Workflow 擅长“按部就班”,适合标准化流程。现代架构常将二者结合,在 Workflow 中嵌入 Agent 节点。

  • Harness(框架/测试套件)

    • 含义:在 AI 工程中,通常指用于评估、测试或运行 Agent 的基础设施框架(如 Evaluation Harness)。

    • 作用:确保 Agent 靠谱。用于自动化测试 Agent 在不同场景下的表现,防止上线后“翻车”。

4. 开发范式与环境层:人与 AI 的协作

  • Vibe Coding(氛围编程)

    • 含义:Andrej Karpathy 提出的新概念。开发者不再逐行写代码,而是用自然语言描述需求,完全依赖 AI 生成代码,自己仅负责验证与引导“氛围”。

    • 作用:开发效率的一场革命。它的实现,高度依赖强大的 Agent 与 Context Engineering。

  • Workspace(工作空间)

    • 含义:为 AI Agent 提供的隔离运行环境(沙箱),包含文件系统、终端、浏览器等。

    • 作用:安全与持久化。Agent 需要一个地方存放文件、运行代码、保持状态,Workspace 就是这张“虚拟办公桌”。

🔗 它们之间的相互联系(全景图)
如果把构建一个 AI 应用比作“培养一名数字员工”,它们的关系便一目了然:

概念类比相互关系
Token脑细胞/能量所有交互的基础消耗单位。
Context Window脑容量限制了同时能处理多少 Token。
Context Engineering整理笔记的方法在有限脑容量下,通过 RAG 和 Prompt 优化,把最关键的信息塞进去。
Vector DB + RAG图书馆 + 查阅能力为 Context Engineering 提供外部知识素材。
Prompt岗位说明书告诉模型你是谁、该怎么做,定义 Agent 的行为边界。
Tool Calling动手能力Agent 通过它来执行具体操作。
MCP万能转接头让 Tool Calling 能够标准化地连接各类外部服务。
Computer Use实操电脑的能力当 Tool Calling(API)不可用时的备选方案。
Skill职业技能证书封装好的 Prompt + Tool 组合,供 Agent 随时调用。
WorkflowSOP 标准作业程序编排多个 Agent 或 Skill 按固定顺序协作。
Workspace办公工位Agent 执行 Computer Use 和文件操作的物理场所。
Harness绩效考核系统用来测试 Agent 和 Workflow 是否达标。
Vibe Coding新型师徒制人类利用上述所有技术,通过自然语言指挥 AI 完成软件开发。

💡 总结与趋势

  • 从 Prompt Engineering 到 Context Engineering:大家发现,光写好提示词已远远不够,如何动态管理海量上下文,才是决定 Agent 聪明程度的关键。

  • MCP 成为连接器:工具调用正在从“定制化”走向“标准化”,MCP 是当前最重要的趋势之一。

  • Agent 是容器:其他所有技术——RAG、Tool、Memory——最终都是为了服务于 Agent 这一载体。

  • Vibe Coding 是结果:当上述技术臻于成熟,人类的编程方式也将被永久改变。

这套体系正在快速迭代。掌握这些概念的内在联系,就等于握住了理解当下 AI 技术变革的一张地图。

Logo

小龙虾开发者社区是 CSDN 旗下专注 OpenClaw 生态的官方阵地,聚焦技能开发、插件实践与部署教程,为开发者提供可直接落地的方案、工具与交流平台,助力高效构建与落地 AI 应用

更多推荐