Skill 是一种轻量级、开放格式的 AI agent 能力扩展机制 [8]。它的物理形态是一个包含 SKILL.md 的目录:

  • YAML 前置元数据定义 namedescriptiontriggers 等字段,用于 agent 的自动发现 [1][9];
  • Markdown 指令体描述何时以及如何使用工具、执行何种工作流;
  • 可选资源包括脚本、模板、参考数据 [9]。

Skill 与 Tool 有本质区别:Tool 是单一函数调用,Skill 是结构化的多文件能力包,封装了工作流指令、可执行脚本与领域知识参考 [16]。Tool 是"锤子",Skill 是"装修手册"。

1.2 MetaSKILL:三个层次的精确定义

"MetaSKILL"在实践与学术中已形成三个清晰的含义层次:

层次一:Skill 生成器——能够自动创建、编辑、优化 SKILL.md 的 Skill。Anthropic 发布了官方 skill-creator [15],OpenClaw.NET 内置了 meta-skill-creator 支持三种 DAG 模式:p1_sequentialp2_fan_out_mergep3_condition_gated [18]。

层次二:Skill 编排器——在众多 Skill 中选择、组合、编排以完成复杂任务。AgentSkillOS [2] 将 Skill 组织为能力树,用 DAG 编排多 Skill 流水线。

层次三:生产级多步 DAG 工作流(OpenClaw.NET 定义)——这是 MetaSKILL 最工程化的定义 [18][19]:

MetaSkill 将重复的多步工作封装为可复用、可审查的 DAG 工作流。当一个请求需要超过一个普通 Skill、工具、检查点或最终综合步骤时,使用 MetaSkill。

核心对比(OpenClaw.NET 精确区分 [18]):

能力 适用场景
Skill (kind: standard) 一个聚焦任务——指令作为 system prompt 注入。1 步,无 DAG,无暂停,无降级。
MetaSkill (kind: meta) 3-12 步可复用 DAG,带 depends_onon_failureuser_input 暂停点,完整审计轨迹。

举例:"总结这份文档"是 Skill 形态。"将这份合同、报价和邮件转化为签/拒/谈决策建议,包含风险和后续行动"是 MetaSkill 形态 [18]。

从系统角度看,MetaSKILL 是 Skill 生态的"操作系统"——它负责 Skill 的发现、选择、组合、执行与演化。


2 MetaSKILL 解决的六个真问题

OpenClaw.NET 的设计文档精确定义了 MetaSKILL 要解决的单 Skill 无法应对的六个工程问题 [20]:

# 问题 单 Skill MetaSKILL 方案
1 长任务卡死没法停 timeout_seconds + retry + 合约封顶(四层有界执行)
2 多步任务需要人确认关键节点 user_input + clarify + checkpoint 暂停/恢复
3 复杂流程要可审计 + 可恢复 MetaRunHistory + replay + reconstruct + proposals
4 不同 Skill 之间需要编排依赖 depends_on DAG + skill_exec/agent 委托
5 任务失败需要 fallback 降级路径 on_failure 5 条工程约束 + 输出镜像
6 多团队复用同一任务模板 Meta-skill 即模板 + Session 隔离 + catalog

2.1 问题 1-2:执行期可靠性

长任务卡死:四层超时保护——步骤级 timeout_seconds + CancellationToken → 步骤重试 retry.max_attempts + backoff_ms → 会话合约 ContractPolicy.MaxRuntimeSeconds → Agent 循环 maxIterations + 熔断器 [19][20]。

人工确认节点user_input 步骤暂停 DAG 等待结构化人工输入。运行时保存完整 checkpoint(pending/blocked/outputs/stepResults)到 Session,用户输入后恢复。可配置 timeout_seconds + on_failure 降级防止无限等待 [19]。

2.2 问题 3:运维期可信度

每次执行自动记录 SessionMetaRunRecord,包含每步耗时、失败码和执行证据 [19]。运维人员可通过 CLI 查看、回放预览和审计重建:

openclaw skills meta-runs <sid> --run <id> --verbose --json
openclaw skills meta-runs replay <sid> --run <id>
openclaw skills meta-runs reconstruct <sid> --run <id>

2.3 问题 4-5:编排期韧度

DAG 编排:步骤通过 depends_on 声明形成有向无环图。独立步骤并行执行(波次调度)。DAG 引擎在 AgentRuntime(原生)和 MafAgentRuntime(Microsoft Agent Framework 适配器)之间共享,行为一致 [19]。

降级路径on_failure 声明替代步骤。当主步骤失败时,运行时激活 fallback 并将其输出镜像到主步骤 ID——下游步骤无感知。五条工程约束(parse-time + runtime 双重校验):fallback 目标必须存在、不能自引用、fallback 不能有 on_failure(禁止链式)、同一 fallback 只能被一个 primary 引用、fallback 不能有 depends_on [19][20]。

2.4 问题 6:协作期复用性

一份 SKILL.md 在所有团队共享,每次执行在独立 Session 上下文(outputs 字典、MetaExecutionCheckpointMetaRunHistory 均绑定 session.Id),模板通过 {{ input }}{{ outputs.X }} 传递上下文参数化 [20]。

本质总结 [20]:

问题 1-2:执行期可靠性  (timeout + 暂停)
问题 3:   运维期可信度  (可审计 + 可恢复)
问题 4-5:编排期韧度    (DAG + fallback)
问题 6:   协作期复用性  (模板 + 隔离)

3 架构与技术实现

3.1 SKILL.md:一个事实上的开放标准

2025 年底 Anthropic 将 SKILL.md 格式发布为开放规范 [9],迅速被 10+ 平台采纳 [8]。OpenClaw 和 Claude Code 使用完全相同的 SKILL.md 格式,一个为 Claude Code 编写的 Skill 无需修改即可在 OpenClaw 中使用 [4]。

OpenClaw 采用六级优先级覆盖设计 [1]:workspace skills > project agent skills > personal agent skills > managed skills > bundled skills > extra dirs。每个 agent 可通过 allowlist 独立控制可见的 Skill 集合。

3.2 MetaSKILL 的架构方案

方案 A:OpenClaw.NET MetaSkill 编排器(生产级 DAG 工作流)

这是目前工程化程度最高的 MetaSKILL 实现 [19]。核心组件:

解析管线SKILL.md YAML frontmatter → SkillLoader 解析 composition.steps → TryValidateMetaPlan DAG 结构校验(唯一 ID、Kind 有效性、依赖引用、无环校验、OnFailure 5 条约束、MetaSkill 嵌套禁止、Route 目标校验 8 项检查)→ 进入 ExecuteMetaSkillAsync 调度循环。

六种步骤类型 [19]:

Kind 执行方法 工具访问 成本 适用场景
agent 委托到其他 Skill 指令 ✅ 完整 最高 开放式推理与综合分析
llm_classify 强制返回闭集合标签 最低 路由分类器
llm_chat 有界 LLM 生成 有界综合
tool_call 直接工具调用 ✅ 直接 最低 确定性副作用
skill_exec 子进程执行 ✅ 子进程 CLI 包装的 Skill 执行
user_input 暂停等待人工输入 暂停开销 人工介入澄清表单

双运行时架构:DAG 引擎在 AgentRuntime(原生)和 MafAgentRuntime(Microsoft Agent Framework 适配器)之间共享。仅 LLM 调度路径不同——CallLlmWithResilienceAsync vs _chatClient.GetResponseAsync——等价测试保证行为一致 [19]。

失败处理on_failure 替代步骤 + continue_on_error 控制错误传播 + 输出镜像机制(fallback 输出写入主步骤 ID 的 outputs 槽位,下游无感知)[19]。

用户输入暂停/恢复skip_if Jinja 评估 → 可选 NL 预提取 → checkpoint 保存到 Session → 返回 waitingPrompt;恢复时 TryRestoreMetaExecutionCheckpoint 重建状态,已完成步骤不重新执行 [19]。

触发器匹配:确定性子串匹配(不区分大小写,按 meta_priority + 触发短语长度排序)+ 路由提示注入(通过 BuildMetaRoutingSuffix 将路由提示注入 system prompt)[19]。

方案 B:AgentSkillOS 能力树 + DAG 编排

上海人工智能实验室提出 [2],将 Skill 组织为能力树(根节点五个大类 → 递归细分 → 可达 20 万 Skill 规模),然后通过 DAG 编排多 Skill 执行。能力树检索在 20 万规模下近似 oracle 水平,DAG 编排显著优于原生扁平调用。

方案 C:EvoSkills 协同进化式 Skill 生成

Skill Generator 迭代生成与优化 + Surrogate Verifier(独立 LLM 会话)合成测试用例提供高保真反馈 [16]。5 轮进化内超越人工 Skill,且进化后的 Skill 可跨 6 个不同模型迁移。

方案 D:CASCADE 双重 Meta-Skill

给 agent 装上两个 meta-skill:持续学习(自行搜索文档和代码示例)+ Skill 自生成(在任务执行中自动捕捉可复用工作流并沉淀为 Skill)[17]。


4 安全:快速膨胀的生态系统面临严峻挑战

4.1 规模与风险并存

截至 2026 年 2 月,公开 Skill 数量超 28 万 [2],社区贡献超 5,200 个 [11]。Snyk 的 ToxicSkills 研究 [3] 对 3,984 个 Skill 的全量安全审计:

  • 13.4%(534 个)包含至少一个严重级安全问题
  • 36.82%(1,467 个)存在至少一个安全缺陷
  • 76 个恶意载荷被确认,8 个恶意 Skill 仍在 clawhub.ai 公开可用 [3]。
Logo

小龙虾开发者社区是 CSDN 旗下专注 OpenClaw 生态的官方阵地,聚焦技能开发、插件实践与部署教程,为开发者提供可直接落地的方案、工具与交流平台,助力高效构建与落地 AI 应用

更多推荐