专利.Skill 升级:通俗解读模式上线,把难读专利变成 Obsidian 私库

上一篇讲过:从项目文档挖专利点、联网查新、脱敏写出可交付交底书。
这次升级补上另一条刚需——公开专利太难看懂时,怎么把它读成人话,并沉淀进自己的知识库
仓库:patent-disclosure-skill · 开源 MIT · 兼容 Agent Skills(Cursor / Claude Code 等)
系列前文:从项目文档到可交付交底书

本文面向三类读者:

读者 你会带走什么
用过交底书能力的同学 同一 Skill 的「读」侧怎么开、和「写」如何分工
第一次接触本仓库的同学 解读链路、依赖、Obsidian 配置与一条可复现命令
做技术情报 / 竞品调研的同学 如何把单篇笔记长成可检索、可关联的私有专利库

目录


一、这次升级解决什么问题

研发同学读公开专利,常见卡点往往不是「找不到文献」,而是读完仍无法落地

卡点 实际体验 后果
权要表述绕 「一种……其特征在于……」读完仍不知道保护重心 评审会上讲不清差异点
术语密、落地散 定义在说明书,流程在附图,场景在背景段 来回翻 PDF,上下文断裂
读完就散 合上 PDF 只剩模糊印象 下周重读几乎从零开始
难横向对比 多篇专利各开各的阅读器 同申请人 / 同技术线难以串起来

专利.Skill 原先主打「写交底书」;本次把 专利通俗解读(阅读模式) 做成一等能力:输入公开号或 PDF,输出通俗叙事笔记、权要树、术语网、附图对照,并可入库 Obsidian,逐步长成私有专利知识库

愿景里有两句很贴场景:

做了多年核心研发,专利发明人那一栏从没写过我的名字。(交底书侧)
不止一篇。(解读侧)

写,是把贡献写进可交付材料;读,是把一篇篇难啃文献变成可检索、可关联、可继续比对的知识资产。升级的目标很明确:同一套 Agent Skill,覆盖「写得出」和「读得懂」两条刚需。

1.1 典型使用场景

场景 输入 你期望的结果
竞品 / 同领域公开文献速读 公开号 一句话结论 + 权要树 + 可回查依据
入职 / 转岗补技术背景 PDF 或公开号 故事线叙事,降低第一次通读成本
写交底书前的现有技术消化 若干公开号 多篇入库后按术语、申请人、IPC 串起来
个人技术情报库建设 持续解读 Obsidian 私库越读越厚,支持后续比对分析

二、一句话看懂双模式

交底书编写 专利通俗解读(本次重点)
输入 项目文档 / 代码 / 技术主题 公开号、专利 PDF / 全文
输出 时间戳命名的 .md + .docx Obsidian 解读笔记(或降级 outputs/patent_reader/
典型说法 专利挖掘、交底书、查新 读专利、专利解读、/读专利
定位 从材料到可交付交底书 从难读文献到通俗笔记 + 图谱
主入口 SKILL.md Step 1–8 prompts/patent_plain_reader.md

给公开号且意图是「读懂」时,技能优先走解读,不会默认开交底书流水线。
上一篇已展开交底书侧(挖点、官方公布公告检索、脱敏成文、自检与迭代);本文聚焦解读升级。

仓库简介可记为:

专利.Skill:从项目文档到交底书编写,挖点、查新、脱敏成文;也能做专利通俗解读,叙事、图谱、沉淀 Obsidian 私库。

两条线可以配合:先解读若干公开文献建立语感与术语网,再回头写自己的交底书——写的时候「现有技术」不再是空话。


三、设计取舍:Agent 编排与脚本取证

解读模式刻意拆成两层,避免「全靠模型瞎编」或「全靠脚本不会讲人话」:

层级 负责方 典型工作
数据与门禁 Python 工具链 下载 PDF、抽取权要/说明书/附图、lint、入库、bootstrap Obsidian
理解与成文 Agent(大模型) 校对权项父子、写「本项新增」、连贯叙事、读公开网页写摘要与贴合点

这样做有三个好处:

  1. 可复现:公开号 → PDF → claim_tree.json 等中间件落在 tmp/patent_reader/<RUN>/,排障有据可查。
  2. 可校对:权项树必须经 Agent/review.by=agent 校对后再入库,减少「权 1 或 2」类正则误挂。
  3. 可扩展:下载源、附图质量门、线索筛选都是脚本;叙事风格与领域判断留给模型。

一句话:脚本负责「拿得到、拆得开、写得进库」;Agent 负责「读得懂、讲得清、贴得上语境」。


四、通俗解读端到端怎么跑通

主流程写在 prompts/patent_plain_reader.md,Agent 按步骤执行。

第 0 步  门禁:check_obsidian_env(强烈推荐配置库)
    ↓
第 1 步  仅公开号 → fetch_patent_pdf(固化脚本)
         已有 PDF → 跳过下载
    ↓
         extract_patent_text + extract_patent_figures
    ↓
第 1.5  build_context_anchor / claim_mermaid(辅助)
    ↓
第 1.55 Agent 校对 claim_tree.json(强制)
第 1.6  写 claim_deltas.json(本项新增短句)
    ↓
第 2 步  公开线索 ≤3 条:Agent 读 URL 写 summary / anchor_fits
    ↓
第 3~4 步  note_plan + 写解读 Markdown
    ↓
第 5 步  lint_patent_note
    ↓
第 6 步  write_patent_obsidian_note(入库 + Canvas + 旁路锚点)
    ↓
第 7~8 步  交付引导;库内 ≥2 篇可问是否 link_patent_notes

4.1 取证与固化下载

仅有公开号时,使用仓库内 tools/patent_reader/fetch_patent_pdf.py

python tools/patent_reader/fetch_patent_pdf.py \
  --pub CN119961396A \
  -o tmp/patent_reader/read-CN119961396A-YYYYMMDDHHmm
# → .../source/CN119961396A.pdf

设计要点:

  • 优先从 Google Patents 详情页解析 citation_pdf_url / CDN 直链
  • 备选源与说明见 references/patent_pdf_sources.yaml
  • 禁止在会话里临时再写一套下载脚本(易碎、难维护、难复现)
  • 网络不稳时可稍后重试;也可用户自备 PDF 后直接 extract

用户已提供本地 PDF / 全文时,跳过下载,直接:

python tools/patent_reader/extract_patent_text.py \
  -i /path/to/xxx.pdf \
  -o tmp/patent_reader/${RUN} \
  --pub-number CN119961396A

4.2 权项树校对:人不能省的一步

抽取脚本只会用正则猜独立权与父号。遇到「如权利要求 1 或 2」「权 1 至 3」时极易错。流程要求 Agent:

  1. 对照权要原文改 is_independent / parent
  2. 多引用时选定单一 parent 并写 review.notes
  3. validate_claim_tree.py --write --require-review

然后再写 claim_deltas.json:每一项一句大白话「相对父权多了什么」,独立权写骨架要点。入库时第三节「本项新增」列优先用这份文件,而不是从原文截半句糊弄。

4.3 读成「人话」仍锚定原文

笔记强调证据可回查,而不是「翻译腔空话」:

约定 写法 入库后体验
说明书段落 说明书 0002 / 说明书 0002–0004 单链悬停预览(页面预览 + Ctrl)
权项引用 正文写 权2权2–3 链到旁路 {公开号}_权项锚点
附图引用 图1图1–3 跳到第六节图标题 / 嵌入图
禁止 [0002] Obsidian 会误染成假链接

权项锚点采用旁路笔记方案:主文不堆大段 callout,预览与跳转仍可用。关系图里默认过滤旁路 JSON、权项锚点、说明书段落等噪声节点,避免图谱被附件淹没。

4.4 公开线索:辅助理解,不作法律证据

最多 3 条公开网页线索(产品页、报道、开源实现等):

  1. validate_public_clues.py 按置信度筛选
  2. Agent 打开 URLsummary(要点列表,禁止粘贴导航栏)与 anchor_fits(对权/特征/术语的贴合句)
  3. 入库脚本落地 clues/、导航入口、L1–L4 折叠旁注、附录 B、Canvas 线索卡

文中明确标注推测语境。脚本 HTTP 抓取仅作降级(--fetch-clues-fallback),默认不依赖爬虫正文。

4.5 lint 与入库闸门

lint_patent_note.py 检查必备章节、免责声明、应用场景、附录线索形态等。通过后再:

python tools/patent_reader/write_patent_obsidian_note.py \
  --content-file <笔记.md> \
  --manifest .../source_manifest.json \
  --context-anchor .../context_anchor.json \
  --bundle .../synthesis_bundle.json \
  --public-clues .../public_clues.json \
  --workdir tmp/patent_reader/${RUN} \
  --lint-json .../lint.json

有库时自动 bootstrap_vault(CSS / Bases / 关系图 Groups),并生成 Canvas、说明书段落笔记、权项锚点、默认拷贝官方 PDF 到笔记目录 source/


五、解读笔记长什么样

交付笔记大致对应模板 assets/patent_note_template.md,结构刻意固定,方便多篇横向扫读:

章节 作用
著录 + Obsidian 导航 公开号、申请人、IPC、图谱 / PDF / 线索入口
一、一句话 ≤3 句抓住问题、手段、意义
二、连贯叙事 问题 → 思路 → 怎么做 → 效果
三、权利要求树 树形表:结构 | 权 | 本项新增
四、独立权利要求精读 原文摘录 + 特征大白话表
五、专利内术语表 优先双链到 Research/术语/
六、特征—说明书—附图 对照表 + 插图 / 占位
七、和现有技术的差别 仍锚定专利内表述
八、阅读建议 可执行的再读路径(含规避视角初判方向时须声明非法律意见)
九、技术应用场景 只写专利内依据,禁止塞 URL
十、附录 IPC 坐标 + 公开线索(推测)
十一、免责声明 固定口径

写作纪律(对质量影响很大):

  • 标题只用简洁名称,不把「给 Agent 的提示」写进 ##
  • 正文禁止出现脚本文件名、内部流水线字段、裁图临时文件名
  • 推测内容只进 [!warning]- 类折叠区,不污染一至八主结论

六、为什么强烈推荐 Obsidian

无库时笔记仍可落到 outputs/patent_reader/,链路能跑通,但「图谱、术语网、索引、悬停预览」会弱一截。配置库后,入库脚本会自动完成大量库级配置,你主要享受结果:

能力 你得到什么
单篇图谱 *_图谱.canvas:叙事、权要、术语、线索一张图看清
术语双链 第五节术语进 Research/术语/,跨专利复用
关系图 解读笔记、Canvas、术语多色节点(原生 Groups)
私库沉淀 越读越厚;同目录 PDF、说明书段落、权项锚点齐备
CLI / 连接 可与 Obsidian CLI、外部工具接力做检索与批处理

库厚了之后,还可以在这层之上做专利比对、挖掘与分析(同族对照、技术路线、差异点扫描)——把「读懂一篇」推进到「用起来」。多篇时可选用 link_patent_notes.py 生成全局关联 Canvas(辅助导航,不构成侵权/无效结论)。

可选社区插件(Dataview、Colored Tags 等)能让索引更好看,但不是跑通解读的硬前置;关系图配色不依赖社区插件。详见仓库 docs/obsidian-setup-guide.md


七、完整上手:从安装到第一次入库

7.1 接入技能

任选其一:

  1. 克隆仓库到宿主的 skills 目录
  2. 直接用 Agent 打开本仓库根目录作为工作区

详细步骤见 INSTALL.md

7.2 依赖(按需)

# 共用基础
pip install -r requirements.txt

# 专利解读 PDF 抽取
pip install -r tools/patent_reader/requirements.txt

交底书图示定稿另需 Node.js(mmdc);纯解读可暂不装。查新用的 Playwright 依赖属于交底书 Step 5,解读主链路不强制。

7.3 配置 Obsidian 库路径

python tools/patent_reader/check_obsidian_env.py --json
python tools/patent_reader/check_obsidian_env.py --set "你的库路径"

环境变量:PATENT_READER_OBSIDIAN_VAULT(亦支持持久化到用户目录配置文件)。
明确只要 Markdown、不要库时,可降级 outputs/patent_reader/

7.4 对话触发

读专利 CN119961396A

或:

/读专利
请解读公开号 CN119961390A,入库我的 Obsidian。

Agent 应按:门禁 →(必要时)fetch_patent_pdf → extract → 权树校对 → 写笔记 → lint → write_patent_obsidian_note 执行。你侧验收打开:

  • Research/Patents/<领域>/<公开号>/*_解读_*.md
  • 同目录 *_图谱.canvas
  • Research/Patents/_专利解读索引.md
  • Obsidian Ctrl/Cmd+R 后看关系图配色

八、示例公开号与运行效果

仓库提供解读示例镜像说明(PDF 本地自备,不入库):

公开号 用途 说明
CN119961390A 主示例 大模型问答 / 软件类,适合看叙事与权树
CN119961396A 同域对照 可与上一篇做关联 / 术语对照测试
CN114552122A 按图裁切 文字层附图页含可选中图注,适合验证附图抽取

下载示例:

python tools/patent_reader/fetch_patent_pdf.py \
  --pub CN119961396A \
  -o examples/example_patent_reader

更多镜像直链见 examples/example_patent_reader/README.md

运行效果(仓库 README 同源)

Obsidian 关系图:知识图谱与多色节点

Obsidian 关系图:解读笔记、术语与 Canvas 知识图谱

专利解读 Canvas:叙事、权要、术语与公开线索图谱

专利解读 Canvas:叙事、权要、术语与公开线索图谱

读图时可以对照:靛色多是解读主笔记,青绿常见于 Canvas,橙色多为术语节点——入库时写入的原生 Groups,无需社区插件也能看清层次。


九、常见坑与排障

现象 可能原因 处理建议
只有公开号下不了 PDF 国际站点超时 / 网络不稳 重试 fetch_patent_pdf;或自备 PDF;元数据可用公布公告检索核验
权要树父子明显不对 未跑 Agent 校对就入库 claim_tree.json--require-review 再写
第三节「本项新增」像原文截断 缺少 claim_deltas.json 按权补短句增量,再入库
Obsidian 里说明书变成假链接 写了裸 [0002] 改为 说明书 0002 写法
表格里链接裂成多列 wikilink 的 | 未转义 入库脚本会表内转义;手改时写成 [[path\|别名]]
悬停没有预览 未开「页面预览」或未按 Ctrl 设置 → 核心插件 → 页面预览
关系图很吵 附件 / JSON 未过滤 新版 graph 搜索会排除图片、json、旁路锚点笔记
入库后样式没变 未重载 Obsidian 内 Ctrl/Cmd+R

中间产物目录约定:

路径 用途
tmp/patent_reader/<RUN>/ 取证与草稿(不入库、一般不提交 Git)
Obsidian Research/Patents/... 正式交付(有库时)
outputs/patent_reader/ 无库降级交付

十、和「纯人工读专利」比差在哪

不是替代专业代理意见,而是把重复劳动与结构化沉淀交给流水线:

维度 纯人工 专利.Skill 解读模式
首次通读 靠经验扫权要 + 说明书 固定叙事骨架 + 权树表,降低冷启动成本
依据回查 手写页码 / 段号,易丢 说明书 / 权 / 图可跳转、可悬停
多篇管理 文件夹堆 PDF Obsidian 双链 + 图谱 + 索引
行业语境 自己再搜产品新闻 可选公开线索旁注(明确为推测)
可复现 因人而异 RUN 目录 + lint 闸门 + 固化下载脚本

适合:技术理解、调研草稿、团队内部分享底稿
不适合:直接当侵权分析结论、无效检索报告或对外法律意见书。


十一、边界与免责

说明 含义
学习与技术理解辅助 不构成法律意见
保护范围 以官方法律文本为准
公开线索 行业语境推测,不作侵权/无效结论
重大决策 请咨询专利代理师或律师
模型幻觉 须对照原文与 lint;禁止编造公开号与链接

十二、小结与后续方向

要点 结论
升级主题 新增专利通俗解读,与交底书编写并列
核心体验 权要树 + 人话叙事 + 附图对照 + Obsidian 图谱
工程要点 fetch_patent_pdf 固化下载;权树强制校对;入库自动 bootstrap
长期价值 私有专利知识库,可继续比对、挖掘与分析
仓库 handsomestWei/patent-disclosure-skill

如果你上一篇已经用过交底书流程,这次只需补上 Obsidian 库路径,然后丢一个公开号试试「读专利」——同一套 Skill,写与读都覆盖了。

后续可以自然延伸的方向(仓库已留钩子):多篇 link_patent_notes、模型边增强关联、基于私库做差异点扫描与技术路线整理。欢迎在 Issue 里提你的场景。


十三、参考与延伸

欢迎 Star / Issue / PR。若本 Skill 帮你省下啃 PDF 或写交底书的时间,也欢迎在仓库「支持作者」区随意支持。

Logo

小龙虾开发者社区是 CSDN 旗下专注 OpenClaw 生态的官方阵地,聚焦技能开发、插件实践与部署教程,为开发者提供可直接落地的方案、工具与交流平台,助力高效构建与落地 AI 应用

更多推荐