请添加图片描述

TL;DR

Anthropic 技术团队在 Claude Opus 5 和 Fable 5 上做了一个惊人的实验:删除了 Claude Code 超过 80% 的系统提示词,编码评估结果没有任何可衡量的下降。核心发现是——Claude 5 代模型不再需要旧模型那么多 guardrails,过度约束反而让模型花更多时间处理冲突指令。本文整理 6 条新规则,帮你把系统提示词、Skills 和 CLAUDE.md 升级到 Claude 5 时代。

1. 背景:Claude 5 代到底变了什么?

2026 年 7 月 24 日,Anthropic 技术团队成员 Thariq Shihipar 发布了《The new rules of context engineering for Claude 5 generation models》。这篇文章的核心信息可以用一句话概括:Claude 5 代模型(Opus 5、Fable 5)的判断力大幅提升,导致旧时代的"过度约束"策略变成了一种负担。

在 Artificial Analysis 智力指数排行榜上,Claude Opus 5(Max Effort)以 61 分排名第一,Claude Fable 5 以 59 分与 GPT-5.6 Sol 并列前三。但更强的模型不意味着需要更复杂的 prompt——恰恰相反,你需要更少的指令。

Anthropic 团队在 Claude Code 中做了一个关键实验:他们删除了超过 80% 的系统提示词,而编码评估结果没有任何下降。为什么?因为团队发现自己在过度约束(overconstraining)Claude。当系统提示词、Skills 和用户请求中存在相互冲突的指令时,Claude 必须花费额外的思考时间来理清这些矛盾。在旧模型时代,这些约束是为了避免最坏情况的必要措施;Claude 5 代已经不再需要它们。

2. 六大新规则:从"给规则"到"给判断空间"

规则一:给规则 → 让 Claude 自行判断

旧做法:系统提示词中写死规则。“默认不写注释,永远不要写多段落文档字符串或多行注释块——最多一行。”

新做法:“编写与周围代码风格一致的代码:匹配其注释密度、命名方式和代码习惯。”

为什么? 旧模型的 guardrails 在很多场景下其实是错误的(比如某些代码确实需要注释),但当时不得不接受这个权衡。Claude 5 有更好的判断力,可以自行处理这些决策。与其给硬性规则,不如给原则性指导。

规则二:给示例 → 设计接口

旧做法:给 Claude 提供大量工具使用示例。

新做法:示例反而会约束 Claude 到一个特定的探索空间。应该思考工具的参数设计——Claude 有哪些参数,如何让它们更具表达力?

具体例子:Todo 工具中,只需将 status 定义为 pending, in_progress, completed 的枚举,就能暗示 Claude 如何使用它。加上 keep one item in_progress 的指令,就能帮助定义期望的行为。精心设计的接口比示例更能释放模型的能力。

规则三:全部放在前面 → 渐进式披露(Progressive Disclosure)

旧做法:系统提示词中包含了详细的代码审查和验证信息,不管是否需要。

新做法

  • 将验证和代码审查移到独立的 Skills 中,Claude 可以按需调用
  • 使用"延迟加载"工具,agent 必须通过 ToolSearch 搜索才能获取完整定义
  • 构建文件树,让正确的内容在正确的时间被加载

核心原则:“与其让 CLAUDE.md 成为所有可能遇到的实践的中央仓库,不如考虑构建一个可以在正确时间加载的文件树。”

规则四:重复自己 → 简洁的工具描述

旧做法:在系统提示词和工具描述中重复引用工具使用说明。

新做法:删除重复示例,将工具使用说明放在工具描述中,而非系统提示词中。单一信息源,避免冲突。

规则五:CLAUDE.md 中的记忆 → 自动记忆(Auto-memory)

旧做法:鼓励用户使用 # 快捷键将内容写入 CLAUDE.md。

新做法:Claude 现在自动保存与工作和你相关的记忆。CLAUDE.md 保持轻量,简要描述代码库用途,把大部分 token 花在代码库的"坑"(gotchas)上。避免陈述 Claude 通过查看文件系统就能知道的"显而易见"的事情。

规则六:简单规格文档 → 丰富引用(Rich References)

旧做法:依赖 Markdown 计划文件作为参考。

新做法:Claude 可以处理越来越复杂的引用形式:

  • HTML artifacts:通过新的 artifacts 功能创建,比 Markdown 描述更精确
  • 代码作为规格:详细的测试套件、另一个代码库中的函数
  • Rubrics(评分标准):允许 Claude 验证特定领域的"品味"(如好的 API 设计应该是什么样),使用动态工作流和验证 agent

3. 实战指南:升级你的 Claude 5 配置

系统提示词(System Prompt)

  • 与产品上下文紧密绑定,告诉 Claude 它在什么产品中操作
  • 构建自己的 agent harness 时,这是最应该花时间的地方
  • 删掉 80%:先问自己"这条规则 Claude 5 自己能判断吗?"

CLAUDE.md

  • 保持轻量,简要描述代码库用途
  • 把大部分 token 花在代码库的(gotchas)上——那些 Claude 无法从文件系统中推测的事情
  • 不要写"这个项目使用 React 和 TypeScript"——Claude 看 package.json 就能知道

Skills

  • 轻量级指南,让 Claude 在需要时找到信息
  • 避免过度约束,除非在非常重要的领域
  • 对长 skill 使用渐进式披露,拆分成多个文件,按需加载
  • 最适合编码特定于你、你的团队或产品的意见、知识或最佳实践

引用(References)

  • 使用 @ 提及文件作为引用
  • 优先使用代码形式的文件(如 HTML 模型 > 设计描述或截图)
  • 测试套件是比文字描述更精确的规格

使用 /doctor 命令

Claude Code 内置的 /doctor 命令可以自动帮助优化你的 Skills 和 CLAUDE.md 文件。这是升级到 Claude 5 时代最快捷的方式。

4. 一个关键思维转变

这篇文章最重要的洞见不是具体的 6 条规则,而是一个思维转变:从"防止 Claude 做错事"转向"给 Claude 正确的上下文和判断空间"。

Claude 5 代模型的判断力已经达到了一个临界点,过度约束不仅浪费 token,还会产生冲突指令导致性能下降。如果你还在用 Claude 4 时代的 prompt 模板,现在就是升级的时候了。

5. 参考资料

  • Thariq Shihipar, “The new rules of context engineering for Claude 5 generation models”, Anthropic, 2026-07-24
  • Artificial Analysis, Intelligence Index v4.1, 2026-07
  • Anthropic, “Claude models explained”, 2026

更多推荐