专利.Skill 升级:通俗解读模式上线,把难读专利变成 Obsidian 私库
专利.Skill 升级:通俗解读模式上线,把难读专利变成 Obsidian 私库
上一篇讲过:从项目文档挖专利点、联网查新、脱敏写出可交付交底书。
这次升级补上另一条刚需——公开专利太难看懂时,怎么把它读成人话,并沉淀进自己的知识库。
仓库:patent-disclosure-skill · 开源 MIT · 兼容 Agent Skills(Cursor / Claude Code 等)
系列前文:从项目文档到可交付交底书
本文面向三类读者:
| 读者 | 你会带走什么 |
|---|---|
| 用过交底书能力的同学 | 同一 Skill 的「读」侧怎么开、和「写」如何分工 |
| 第一次接触本仓库的同学 | 解读链路、依赖、Obsidian 配置与一条可复现命令 |
| 做技术情报 / 竞品调研的同学 | 如何把单篇笔记长成可检索、可关联的私有专利库 |
目录
- 一、这次升级解决什么问题
- 二、一句话看懂双模式
- 三、设计取舍:Agent 编排与脚本取证
- 四、通俗解读端到端怎么跑通
- 五、解读笔记长什么样
- 六、为什么强烈推荐 Obsidian
- 七、完整上手:从安装到第一次入库
- 八、示例公开号与运行效果
- 九、常见坑与排障
- 十、和「纯人工读专利」比差在哪
- 十一、边界与免责
- 十二、小结与后续方向
- 十三、参考与延伸
一、这次升级解决什么问题
研发同学读公开专利,常见卡点往往不是「找不到文献」,而是读完仍无法落地:
| 卡点 | 实际体验 | 后果 |
|---|---|---|
| 权要表述绕 | 「一种……其特征在于……」读完仍不知道保护重心 | 评审会上讲不清差异点 |
| 术语密、落地散 | 定义在说明书,流程在附图,场景在背景段 | 来回翻 PDF,上下文断裂 |
| 读完就散 | 合上 PDF 只剩模糊印象 | 下周重读几乎从零开始 |
| 难横向对比 | 多篇专利各开各的阅读器 | 同申请人 / 同技术线难以串起来 |
专利.Skill 原先主打「写交底书」;本次把 专利通俗解读(阅读模式) 做成一等能力:输入公开号或 PDF,输出通俗叙事笔记、权要树、术语网、附图对照,并可入库 Obsidian,逐步长成私有专利知识库。
愿景里有两句很贴场景:
做了多年核心研发,专利发明人那一栏从没写过我的名字。(交底书侧)
不止一篇。(解读侧)
写,是把贡献写进可交付材料;读,是把一篇篇难啃文献变成可检索、可关联、可继续比对的知识资产。升级的目标很明确:同一套 Agent Skill,覆盖「写得出」和「读得懂」两条刚需。
1.1 典型使用场景
| 场景 | 输入 | 你期望的结果 |
|---|---|---|
| 竞品 / 同领域公开文献速读 | 公开号 | 一句话结论 + 权要树 + 可回查依据 |
| 入职 / 转岗补技术背景 | PDF 或公开号 | 故事线叙事,降低第一次通读成本 |
| 写交底书前的现有技术消化 | 若干公开号 | 多篇入库后按术语、申请人、IPC 串起来 |
| 个人技术情报库建设 | 持续解读 | Obsidian 私库越读越厚,支持后续比对分析 |
二、一句话看懂双模式
| 交底书编写 | 专利通俗解读(本次重点) | |
|---|---|---|
| 输入 | 项目文档 / 代码 / 技术主题 | 公开号、专利 PDF / 全文 |
| 输出 | 时间戳命名的 .md + .docx |
Obsidian 解读笔记(或降级 outputs/patent_reader/) |
| 典型说法 | 专利挖掘、交底书、查新 | 读专利、专利解读、/读专利 |
| 定位 | 从材料到可交付交底书 | 从难读文献到通俗笔记 + 图谱 |
| 主入口 | SKILL.md Step 1–8 |
prompts/patent_plain_reader.md |
给公开号且意图是「读懂」时,技能优先走解读,不会默认开交底书流水线。
上一篇已展开交底书侧(挖点、官方公布公告检索、脱敏成文、自检与迭代);本文聚焦解读升级。
仓库简介可记为:
专利.Skill:从项目文档到交底书编写,挖点、查新、脱敏成文;也能做专利通俗解读,叙事、图谱、沉淀 Obsidian 私库。
两条线可以配合:先解读若干公开文献建立语感与术语网,再回头写自己的交底书——写的时候「现有技术」不再是空话。
三、设计取舍:Agent 编排与脚本取证
解读模式刻意拆成两层,避免「全靠模型瞎编」或「全靠脚本不会讲人话」:
| 层级 | 负责方 | 典型工作 |
|---|---|---|
| 数据与门禁 | Python 工具链 | 下载 PDF、抽取权要/说明书/附图、lint、入库、bootstrap Obsidian |
| 理解与成文 | Agent(大模型) | 校对权项父子、写「本项新增」、连贯叙事、读公开网页写摘要与贴合点 |
这样做有三个好处:
- 可复现:公开号 → PDF →
claim_tree.json等中间件落在tmp/patent_reader/<RUN>/,排障有据可查。 - 可校对:权项树必须经 Agent/
review.by=agent校对后再入库,减少「权 1 或 2」类正则误挂。 - 可扩展:下载源、附图质量门、线索筛选都是脚本;叙事风格与领域判断留给模型。
一句话:脚本负责「拿得到、拆得开、写得进库」;Agent 负责「读得懂、讲得清、贴得上语境」。
四、通俗解读端到端怎么跑通
主流程写在 prompts/patent_plain_reader.md,Agent 按步骤执行。
第 0 步 门禁:check_obsidian_env(强烈推荐配置库)
↓
第 1 步 仅公开号 → fetch_patent_pdf(固化脚本)
已有 PDF → 跳过下载
↓
extract_patent_text + extract_patent_figures
↓
第 1.5 build_context_anchor / claim_mermaid(辅助)
↓
第 1.55 Agent 校对 claim_tree.json(强制)
第 1.6 写 claim_deltas.json(本项新增短句)
↓
第 2 步 公开线索 ≤3 条:Agent 读 URL 写 summary / anchor_fits
↓
第 3~4 步 note_plan + 写解读 Markdown
↓
第 5 步 lint_patent_note
↓
第 6 步 write_patent_obsidian_note(入库 + Canvas + 旁路锚点)
↓
第 7~8 步 交付引导;库内 ≥2 篇可问是否 link_patent_notes
4.1 取证与固化下载
仅有公开号时,使用仓库内 tools/patent_reader/fetch_patent_pdf.py:
python tools/patent_reader/fetch_patent_pdf.py \
--pub CN119961396A \
-o tmp/patent_reader/read-CN119961396A-YYYYMMDDHHmm
# → .../source/CN119961396A.pdf
设计要点:
- 优先从 Google Patents 详情页解析
citation_pdf_url/ CDN 直链 - 备选源与说明见
references/patent_pdf_sources.yaml - 禁止在会话里临时再写一套下载脚本(易碎、难维护、难复现)
- 网络不稳时可稍后重试;也可用户自备 PDF 后直接 extract
用户已提供本地 PDF / 全文时,跳过下载,直接:
python tools/patent_reader/extract_patent_text.py \
-i /path/to/xxx.pdf \
-o tmp/patent_reader/${RUN} \
--pub-number CN119961396A
4.2 权项树校对:人不能省的一步
抽取脚本只会用正则猜独立权与父号。遇到「如权利要求 1 或 2」「权 1 至 3」时极易错。流程要求 Agent:
- 对照权要原文改
is_independent/parent - 多引用时选定单一
parent并写review.notes - 跑
validate_claim_tree.py --write --require-review
然后再写 claim_deltas.json:每一项一句大白话「相对父权多了什么」,独立权写骨架要点。入库时第三节「本项新增」列优先用这份文件,而不是从原文截半句糊弄。
4.3 读成「人话」仍锚定原文
笔记强调证据可回查,而不是「翻译腔空话」:
| 约定 | 写法 | 入库后体验 |
|---|---|---|
| 说明书段落 | 说明书 0002 / 说明书 0002–0004 |
单链悬停预览(页面预览 + Ctrl) |
| 权项引用 | 正文写 权2、权2–3 |
链到旁路 {公开号}_权项锚点 |
| 附图引用 | 图1、图1–3 |
跳到第六节图标题 / 嵌入图 |
| 禁止 | 裸 [0002] |
Obsidian 会误染成假链接 |
权项锚点采用旁路笔记方案:主文不堆大段 callout,预览与跳转仍可用。关系图里默认过滤旁路 JSON、权项锚点、说明书段落等噪声节点,避免图谱被附件淹没。
4.4 公开线索:辅助理解,不作法律证据
最多 3 条公开网页线索(产品页、报道、开源实现等):
- 先
validate_public_clues.py按置信度筛选 - Agent 打开 URL 写
summary(要点列表,禁止粘贴导航栏)与anchor_fits(对权/特征/术语的贴合句) - 入库脚本落地
clues/、导航入口、L1–L4 折叠旁注、附录 B、Canvas 线索卡
文中明确标注推测语境。脚本 HTTP 抓取仅作降级(--fetch-clues-fallback),默认不依赖爬虫正文。
4.5 lint 与入库闸门
lint_patent_note.py 检查必备章节、免责声明、应用场景、附录线索形态等。通过后再:
python tools/patent_reader/write_patent_obsidian_note.py \
--content-file <笔记.md> \
--manifest .../source_manifest.json \
--context-anchor .../context_anchor.json \
--bundle .../synthesis_bundle.json \
--public-clues .../public_clues.json \
--workdir tmp/patent_reader/${RUN} \
--lint-json .../lint.json
有库时自动 bootstrap_vault(CSS / Bases / 关系图 Groups),并生成 Canvas、说明书段落笔记、权项锚点、默认拷贝官方 PDF 到笔记目录 source/。
五、解读笔记长什么样
交付笔记大致对应模板 assets/patent_note_template.md,结构刻意固定,方便多篇横向扫读:
| 章节 | 作用 |
|---|---|
| 著录 + Obsidian 导航 | 公开号、申请人、IPC、图谱 / PDF / 线索入口 |
| 一、一句话 | ≤3 句抓住问题、手段、意义 |
| 二、连贯叙事 | 问题 → 思路 → 怎么做 → 效果 |
| 三、权利要求树 | 树形表:结构 | 权 | 本项新增 |
| 四、独立权利要求精读 | 原文摘录 + 特征大白话表 |
| 五、专利内术语表 | 优先双链到 Research/术语/ |
| 六、特征—说明书—附图 | 对照表 + 插图 / 占位 |
| 七、和现有技术的差别 | 仍锚定专利内表述 |
| 八、阅读建议 | 可执行的再读路径(含规避视角初判方向时须声明非法律意见) |
| 九、技术应用场景 | 只写专利内依据,禁止塞 URL |
| 十、附录 | IPC 坐标 + 公开线索(推测) |
| 十一、免责声明 | 固定口径 |
写作纪律(对质量影响很大):
- 标题只用简洁名称,不把「给 Agent 的提示」写进
## - 正文禁止出现脚本文件名、内部流水线字段、裁图临时文件名
- 推测内容只进
[!warning]-类折叠区,不污染一至八主结论
六、为什么强烈推荐 Obsidian
无库时笔记仍可落到 outputs/patent_reader/,链路能跑通,但「图谱、术语网、索引、悬停预览」会弱一截。配置库后,入库脚本会自动完成大量库级配置,你主要享受结果:
| 能力 | 你得到什么 |
|---|---|
| 单篇图谱 | *_图谱.canvas:叙事、权要、术语、线索一张图看清 |
| 术语双链 | 第五节术语进 Research/术语/,跨专利复用 |
| 关系图 | 解读笔记、Canvas、术语多色节点(原生 Groups) |
| 私库沉淀 | 越读越厚;同目录 PDF、说明书段落、权项锚点齐备 |
| CLI / 连接 | 可与 Obsidian CLI、外部工具接力做检索与批处理 |
库厚了之后,还可以在这层之上做专利比对、挖掘与分析(同族对照、技术路线、差异点扫描)——把「读懂一篇」推进到「用起来」。多篇时可选用 link_patent_notes.py 生成全局关联 Canvas(辅助导航,不构成侵权/无效结论)。
可选社区插件(Dataview、Colored Tags 等)能让索引更好看,但不是跑通解读的硬前置;关系图配色不依赖社区插件。详见仓库 docs/obsidian-setup-guide.md。
七、完整上手:从安装到第一次入库
7.1 接入技能
任选其一:
- 克隆仓库到宿主的 skills 目录
- 直接用 Agent 打开本仓库根目录作为工作区
详细步骤见 INSTALL.md。
7.2 依赖(按需)
# 共用基础
pip install -r requirements.txt
# 专利解读 PDF 抽取
pip install -r tools/patent_reader/requirements.txt
交底书图示定稿另需 Node.js(mmdc);纯解读可暂不装。查新用的 Playwright 依赖属于交底书 Step 5,解读主链路不强制。
7.3 配置 Obsidian 库路径
python tools/patent_reader/check_obsidian_env.py --json
python tools/patent_reader/check_obsidian_env.py --set "你的库路径"
环境变量:PATENT_READER_OBSIDIAN_VAULT(亦支持持久化到用户目录配置文件)。
明确只要 Markdown、不要库时,可降级 outputs/patent_reader/。
7.4 对话触发
读专利 CN119961396A
或:
/读专利
请解读公开号 CN119961390A,入库我的 Obsidian。
Agent 应按:门禁 →(必要时)fetch_patent_pdf → extract → 权树校对 → 写笔记 → lint → write_patent_obsidian_note 执行。你侧验收打开:
Research/Patents/<领域>/<公开号>/*_解读_*.md- 同目录
*_图谱.canvas Research/Patents/_专利解读索引.md- Obsidian Ctrl/Cmd+R 后看关系图配色
八、示例公开号与运行效果
仓库提供解读示例镜像说明(PDF 本地自备,不入库):
| 公开号 | 用途 | 说明 |
|---|---|---|
| CN119961390A | 主示例 | 大模型问答 / 软件类,适合看叙事与权树 |
| CN119961396A | 同域对照 | 可与上一篇做关联 / 术语对照测试 |
| CN114552122A | 按图裁切 | 文字层附图页含可选中图注,适合验证附图抽取 |
下载示例:
python tools/patent_reader/fetch_patent_pdf.py \
--pub CN119961396A \
-o examples/example_patent_reader
更多镜像直链见 examples/example_patent_reader/README.md。
运行效果(仓库 README 同源)
Obsidian 关系图:知识图谱与多色节点

专利解读 Canvas:叙事、权要、术语与公开线索图谱

读图时可以对照:靛色多是解读主笔记,青绿常见于 Canvas,橙色多为术语节点——入库时写入的原生 Groups,无需社区插件也能看清层次。
九、常见坑与排障
| 现象 | 可能原因 | 处理建议 |
|---|---|---|
| 只有公开号下不了 PDF | 国际站点超时 / 网络不稳 | 重试 fetch_patent_pdf;或自备 PDF;元数据可用公布公告检索核验 |
| 权要树父子明显不对 | 未跑 Agent 校对就入库 | 改 claim_tree.json 后 --require-review 再写 |
| 第三节「本项新增」像原文截断 | 缺少 claim_deltas.json |
按权补短句增量,再入库 |
| Obsidian 里说明书变成假链接 | 写了裸 [0002] |
改为 说明书 0002 写法 |
| 表格里链接裂成多列 | wikilink 的 | 未转义 |
入库脚本会表内转义;手改时写成 [[path\|别名]] |
| 悬停没有预览 | 未开「页面预览」或未按 Ctrl | 设置 → 核心插件 → 页面预览 |
| 关系图很吵 | 附件 / JSON 未过滤 | 新版 graph 搜索会排除图片、json、旁路锚点笔记 |
| 入库后样式没变 | 未重载 | Obsidian 内 Ctrl/Cmd+R |
中间产物目录约定:
| 路径 | 用途 |
|---|---|
tmp/patent_reader/<RUN>/ |
取证与草稿(不入库、一般不提交 Git) |
Obsidian Research/Patents/... |
正式交付(有库时) |
outputs/patent_reader/ |
无库降级交付 |
十、和「纯人工读专利」比差在哪
不是替代专业代理意见,而是把重复劳动与结构化沉淀交给流水线:
| 维度 | 纯人工 | 专利.Skill 解读模式 |
|---|---|---|
| 首次通读 | 靠经验扫权要 + 说明书 | 固定叙事骨架 + 权树表,降低冷启动成本 |
| 依据回查 | 手写页码 / 段号,易丢 | 说明书 / 权 / 图可跳转、可悬停 |
| 多篇管理 | 文件夹堆 PDF | Obsidian 双链 + 图谱 + 索引 |
| 行业语境 | 自己再搜产品新闻 | 可选公开线索旁注(明确为推测) |
| 可复现 | 因人而异 | RUN 目录 + lint 闸门 + 固化下载脚本 |
适合:技术理解、调研草稿、团队内部分享底稿。
不适合:直接当侵权分析结论、无效检索报告或对外法律意见书。
十一、边界与免责
| 说明 | 含义 |
|---|---|
| 学习与技术理解辅助 | 不构成法律意见 |
| 保护范围 | 以官方法律文本为准 |
| 公开线索 | 行业语境推测,不作侵权/无效结论 |
| 重大决策 | 请咨询专利代理师或律师 |
| 模型幻觉 | 须对照原文与 lint;禁止编造公开号与链接 |
十二、小结与后续方向
| 要点 | 结论 |
|---|---|
| 升级主题 | 新增专利通俗解读,与交底书编写并列 |
| 核心体验 | 权要树 + 人话叙事 + 附图对照 + Obsidian 图谱 |
| 工程要点 | fetch_patent_pdf 固化下载;权树强制校对;入库自动 bootstrap |
| 长期价值 | 私有专利知识库,可继续比对、挖掘与分析 |
| 仓库 | handsomestWei/patent-disclosure-skill |
如果你上一篇已经用过交底书流程,这次只需补上 Obsidian 库路径,然后丢一个公开号试试「读专利」——同一套 Skill,写与读都覆盖了。
后续可以自然延伸的方向(仓库已留钩子):多篇 link_patent_notes、模型边增强关联、基于私库做差异点扫描与技术路线整理。欢迎在 Issue 里提你的场景。
十三、参考与延伸
- 仓库主页:https://github.com/handsomestWei/patent-disclosure-skill
- 技能入口:
SKILL.md(模式 B · 专利通俗解读) - 解读主流程:
prompts/patent_plain_reader.md - 解读工具说明:
tools/patent_reader/README.md - Obsidian 安装引导:
docs/obsidian-setup-guide.md - PDF 源表:
references/patent_pdf_sources.yaml - Obsidian CLI:https://help.obsidian.md/cli
- 系列前文(交底书能力):https://blog.csdn.net/weixin_42112831/article/details/159958334
欢迎 Star / Issue / PR。若本 Skill 帮你省下啃 PDF 或写交底书的时间,也欢迎在仓库「支持作者」区随意支持。
更多推荐




所有评论(0)