资深博主解读Anthropic 工程师的 6 条新规则:Claude Code 的上下文策略已彻底转变

封面

一个 Anthropic 的 lead engineer,在 X 上发了篇文章。430 万浏览。

文章叫《The New Rules of Context Engineering for Claude 5 Models》。不长,但信息密度很高。关键结论:Opus 5 和 Fable 5 发布后,之前我们照着做的 Claude Code 使用建议,过时了。有些甚至完全反过来。

对此文的解读,可以参考我的微信公众号文章《Anthropic 工程师 Thariq 文章解读:删掉 80% 系统提示词后,Claude 5 反而更强了》

老丁888,公众号:钉子之家Anthropic 工程师 Thariq 文章解读:删掉 80% 系统提示词后,Claude 5 反而更强了

视频博主 Jay(RoboNuggets 社区创始人)读了全文。拆出 6 条新规则。每条都附上他项目里的实操案例。结尾还送一个免费的 doctor-plus skill。能自动检查你的 Claude Code 配置,合不合这 6 条新规则。

这个Skill请拿走:https://github.com/robonuggets/doctor-plus


背景:什么是 Context Engineering

讲 6 条规则之前,Jay 先用一个框架解释了。上下文工程,到底是什么。

A.R.M.S 框架

他管它叫 A.R.M.S 框架:

  • Applications — 通过 MCP、API、CLI 接入的外部工具
  • Routines — 定时任务、cron、自动化流程
  • Memory — 会话历史、生成的报告、积累的文档
  • Skills — 通过 slash command 调用的 SOP/工作流

每次跟 Claude 对话,你发的 prompt 只是上下文的一小部分。真正决定输出质量的,是这四个东西有没有组织好。Jay 说:「如果你把 A.R.M.S 组织好了,你已经领先 99% 的 Claude 用户。」


80% 的系统提示被删了,评测分数没掉

最震撼的数据,先放出来。

Benchmark 对比

Anthropic 团队在 Opus 5 和 Fable 5 上做了个实验。删掉 Claude Code 系统提示的 80%。代码评测跑完。没有可测量的损失。

一年前,Opus 4 在 Artificial Analysis 基准上的原始智能得分 31%。现在 Opus 5 是 60%。几乎翻倍。

模型更聪明了。「给它套一堆规则,防止它犯错」,不再是最好方案。Tariq(文章作者)给了 6 条转变。从旧规则,到新规则。


规则 1:从堆规则 → 让模型用判断力

Rule 1

旧做法:

   默认不写注释。不写多段 docstring。只对复杂逻辑加注。 

这是 Claude Code 早期系统提示里的原话。当时模型不够聪明。必须用严格规则,防止它写出啰嗦的代码。

新做法就一句话:

   写代码时匹配周围代码的风格:注释密度、命名习惯、代码惯用法。 

四行英语,管住所有情况。Jay 的案例是 surprise-me 这个 skill。专门让 Claude 在前端设计上自由发挥。skill 里的描述,不是「用蓝色、字号 24px」这种。是「展示极致的品味和艺术感」。他说 Claude 产出的设计,远超他手动指定的效果。


规则 2:从给示例 → 给设计界面

Rule 2

旧做法:给 Claude 几个具体例子,让它模仿。新做法:给一整套设计系统。颜色、字体、视觉规则。让它在框架里自己发挥。

Jay 的做法:建一个 brand-book.html。里面定义 RoboNuggets 品牌的色板、字体、dot-matrix 效果等视觉规范。再做一个 robo skill。每次要品牌物料,就调这个 skill。skill 自动引用 brand-book。

效果是:视频里所有标题幻灯片、社区网站 landing page、系统架构可视化图。全是一个视觉体系。「不是 Claude 默认的 AI 味设计」。


规则 3:从全量前置 → 渐进式披露

Rule 3

CLAUDE.md 曾经流行一种做法。把所有规则、偏好、工作流程全塞进去。越厚越好。

现在反过来。Tariq 说,Claude Code 已经足够擅长 progressive disclosure。在需要的时候,加载需要的上下文。

Jay 的 second brain 工作区有 57,000 个文件。他的 CLAUDE.md,早就不再是「规则大全」。是个路由器。指向四个子索引文件:

  • content.md:内容创作相关的 skill 和文件路径
  • community.md:社区运营的
  • product.md:产品开发的
  • business.md:商业事务的

每次对话,Claude 先看路由器。再按需加载对应分支。Token 成本也下来了。厚的 CLAUDE.md,每次会话一启动就吃掉一堆 token。薄的路由器,只在用到时才加载。


规则 4:工具描述更简洁

旧模型,需要在系统提示和工具描述里各写一遍指令。怕它忘。Fable 5 和 Opus 5,不需要这种重复了。

Jay 的建议很直白:回去检查你的 skill description 和 tool description。删掉重复内容。省 token,还不影响质量。


规则 5:自动记忆

calibrate skill

Claude Code 现在能自动保存相关记忆了。以前,得手动按 # 写进 CLAUDE.md。

Jay 保留了自己的习惯。他做了个 calibrate skill。每次有价值的会话结束,跑一次。自动:

  • 更新相关 skills

  • 更新 CLAUDE.md

  • 更新子索引(content.md 等)

  • 写新的 memory 文件

  • 记录 prompt 模板

他说,这是他用得最多的 skill。


规则 6:从纯 Markdown → 更丰富的引用格式

Rule 6

以前做 spec、plan、artifact,几乎只用 markdown 文件。新模型能处理更复杂的引用格式。

Jay 最喜欢 HTML artifact。他的 brand-book.html,如果用 markdown 写。描述一套色板、一段视觉风格,要大段文字,还讲不清。HTML 直接在浏览器打开,就是视觉参考。Claude 能解析,底层还是代码。人能看到,渲染后的效果。

日常遇到复杂概念,想快速理解。他也直接让 Claude 生成 HTML 信息图。用 robo skill 套上品牌风格。「比读 Claude 写的长篇 markdown 快 10 倍。」


落地:/doctor 和 /doctor-plus

doctor-plus

Claude Code 最新版自带 /doctor 命令。做五件事:

  1. 检查安装健康度(路径冲突、重复安装)

  2. 找「死重」(废弃 skill、MCP server、臃肿的 CLAUDE.md)

  3. 检查 hooks 性能(每次对话都拖慢的 hook)

  4. 出报告

  5. 提供一键修复选项

但 Jay 觉得 /doctor 偏基础。没覆盖 Tariq 那 6 条新规则。于是自己写了个 doctor-plus。在 /doctor 基础上,加了 6 条新规则的检查。

doctor results

视频里,他演示跑 doctor-plus。它找出 last-30-days 这个研究 skill 的问题。2090 行。旧时代的「全量加载」写法。建议拆成 router 模式。还查了 token 效率、skill description 冗余、有没有设计系统文件等。

skill 免费。描述栏可以下载。


小结

小结

Anthropic 上下文工程新规的主旨:模型更聪明了,管得越少越好。

六条规则的底层逻辑,其实就三个:

  1. 信任模型

    少给死规则,多给判断空间。规则 1、4、5。

  2. 优化加载

    需要时才给,不一次塞满。规则 3。

  3. 升级格式

    用设计系统替代示例,用 HTML 替代纯 markdown。规则 2、6。

如果你在用 Claude Code,现在就能做:

  • 跑一下 /doctor 看基础健康度

  • 检查 CLAUDE.md 是不是超过 100 行,是的话考虑拆成 router

  • 做一个「calibrate」类 skill,每次有价值的会话后自动沉淀


素材来源:Jay 的 YouTube 视频 Claude Code Just Changed Forever (6 NEW Rules by Anthropic Engineers),基于 Anthropic 工程师 Tariq 的文章《The New Rules of Context Engineering for Claude 5 Models》解读。配图为视频截图

更多推荐