Back to skills
SKILL.md
Paper Zh Reading Guide
ASecurity把 AI/CS 论文 PDF 转成中文结构化「文献导读」,并维护跨论文的横向对比表。五种用法,前三种会产出文件、后两种只在对话内给摘要:(1) 全文导读——给出论文 PDF 并说"生成导读 / 文献导读 / 精读 / 仔细阅读全文生成导读""除了实验部分之外的导读""按之前的格式写导读""照上次那样再写一份",产出 `<短名>-导读.md`;(2) 局部详解——点名论文某一处(章节号如 §3.2、模块名、图表号如 Fig. 3 / Table 2、概念名)并要求"详细解释 / 详细讲解 / 展开讲讲 / 这部分什么意思 / 这个公式怎么推的",且**没有**要求全文导读时使用,产出 `<指定部分>部分-导读.md`,只讲这一部分,但必须先精读全文、结合上下文;(3) 多篇对比——给出 2 篇及以上论文,或说"对比这几篇""这几篇论文的方法有什么区别""批量生成导读""更新对比表""这几篇该怎么排阅读顺序",按 references/comparison-dimensions.md 的固定维度产出对比表并回填;(4) 速览——"总结这篇论文的主要内容""讲讲这篇讲了啥",对话内给摘...
- 2 stars
- 0 votes
- 0 copies
- 1 view
- Added September 22, 2026
Security analysis
92/100- Installs packages at runtime which could introduce malicious dependencies
Pro scans all 5 files and shows the line behind each finding
npx -y skills add fangbing66/paper-zh-reading-guide --skill paper-zh-reading-guide --agent claude-codeAre you the author of Paper Zh Reading Guide?
Add the live security badge to your README. It updates with every re-scan.
[](https://www.skillsdirectory.com/skills/fangbing66-paper-zh-reading-guide)---
name: paper-zh-reading-guide
description: 把 AI/CS 论文 PDF 转成中文结构化「文献导读」,并维护跨论文的横向对比表。五种用法,前三种会产出文件、后两种只在对话内给摘要:(1) 全文导读——给出论文 PDF 并说"生成导读 / 文献导读 / 精读 / 仔细阅读全文生成导读""除了实验部分之外的导读""按之前的格式写导读""照上次那样再写一份",产出 `<短名>-导读.md`;(2) 局部详解——点名论文某一处(章节号如 §3.2、模块名、图表号如 Fig. 3 / Table 2、概念名)并要求"详细解释 / 详细讲解 / 展开讲讲 / 这部分什么意思 / 这个公式怎么推的",且**没有**要求全文导读时使用,产出 `<指定部分>部分-导读.md`,只讲这一部分,但必须先精读全文、结合上下文;(3) 多篇对比——给出 2 篇及以上论文,或说"对比这几篇""这几篇论文的方法有什么区别""批量生成导读""更新对比表""这几篇该怎么排阅读顺序",按 references/comparison-dimensions.md 的固定维度产出对比表并回填;(4) 速览——"总结这篇论文的主要内容""讲讲这篇讲了啥",对话内给摘要、不产出文件;(5) 局部摘要——"总结某一部分""不用保存为 markdown 文件",对话内给摘要、不产出文件。前三种模式都**默认只呈现原文、不输出推断与价值判断**(【推测】默认关闭),含幻觉防护标注体系(【原文】【推导】【读数观察】)与精确到章节/公式/图表编号的溯源要求,产出以连贯段落为主、不堆砌分点。不适用于逐行代码讲解(那是另一类任务)。
agent_created: true
---
# 论文 → 中文结构化导读
## 路径基准与依赖
本 skill 内所有路径均**相对 skill 根目录**(即本 SKILL.md 所在目录)。
下文出现的两个占位符,使用时替换成实际路径:
- `<论文目录>` —— PDF 文件所在目录
- `<工作区>` —— 存放提取文本与导读产出的目录
依赖与调用:
- 需要 **PyMuPDF**:`pip install pymupdf`。若报 `externally-managed-environment`(PEP 668),
先建虚拟环境再装,**不要**用 `--break-system-packages` 绕过。
- 提取脚本位于 `scripts/extract_pdf.py`,调用方式为 `python scripts/extract_pdf.py ...`。
- 若宿主环境有专门的 Python 解释器路径,用 `python` 之外的解释器调用也可以,脚本本身不依赖特定解释器。
## 核心要求(违反即为不合格)
1. **先读全文再动笔**。必须通读,不能只读摘要和 intro。局部详解与局部摘要模式同样适用——只读点名的那一节就动笔,是明确禁止的。
2. **每一条实质性陈述都要能溯源**。引用必须精确到 `§x` / `Eq.n` / `Table n` / `Fig. n` / `Box n` / 附录编号。
3. **默认只呈现原文,不输出推断**。导读的第一读者是**还没读懂这篇论文的人**,他的任务是理解,不是评价。除用户明确要求("多些推测 / 谈谈你的判断 / 批判性看")外:不写价值判断、不写推测、不评价贡献大小、不指出论文缺陷。理由:【推测】是整套标注体系里**唯一无法被复核**的标记(【原文】可回原文核、【推导】可手算复核、【读数观察】可对照图例),多写只会挤占读者理解原文的注意力。你自己的推理**绝不允许**写成原文陈述。
4. **做客观交叉引用**。读者通常是沿着一条研究线在读,工作目录里往往已有同方向的前几篇导读。新导读必须指出与已有论文的**可核查关系**——谁在正文里引了谁、谁和谁在同一数据集/同一张表上比过、谁被谁当 baseline。这些都要给 `§x` / `Table n` 出处。**不要**输出"路线分歧在哪""谁的历史位置更高"这类判断。
写交叉引用前先确认**方向**:本文引了前几篇(→ 给本文的 `§x` / `Table n`)、前几篇引了本文、还是两边都没引。**两边都没引时必须明写"本 PDF 未引用 XXX"**——这是可核查的事实,比含糊带过有用得多。**没有引文支撑、只靠机制相似建立的跨论文联系**(如"两篇都让模型不输出时间戳"),不要混进正文冒充原文陈述,也不要占用【推测】标记——单列一小节、明确标注「非原文内容」,且只写机制事实、不写路线判断。
5. **结论先行**。"一句话定位"放在最前面,讲清"这篇在解决什么问题、用什么手段、你已读的那几篇里与之直接可比的是哪篇、在哪张表上比"。
6. **不写套话,也不堆砌分点**。不要"本文提出了一种新颖的方法"这种空话;列表只用于真正的并列项,一个连贯的句子不要拆成三条 bullet。
## 标注体系(固定,不要改)
| 标记 | 含义 | 默认 |
|---|---|---|
| 【§x】/【Eq.n】/【Table n】/【Fig. n】/【Box n】 | 溯源到原文的具体位置 | 启用 |
| 【原文】 | 直接引述原文(关键处给英文原句) | 启用 |
| **【推导】** | 由原文给出的数字/图例**反推**出的定量结论,原文未直接写出 | 启用 |
| **【读数观察】** | 从原文直接读出、但正文未明确指出的现象 | 启用 |
| **【推测】** | 导读作者的解读或推断,**不是**原文陈述 | **默认关闭** |
**【推测】默认关闭**:只有在用户明确说"多些推测内容 / 谈谈你的判断 / 批判性看这篇"时才启用,且集中写在文末,不散落到正文各节。没有这个开关就不要用这个标记。
**原文章节无编号时怎么办**(常见:AAAI 相机就绪版,标题只有 `Introduction` / `Method` / `Experiments`,正文里没有 `3.1` 这种编号):
用**章节名**定位——`§Method`、`§Sequence-Time Embedding`、`§Detailed Experiment Settings`,不要自己给原文编造 `§3.1`。
同时**在开头的「阅读约定」里单独说明这一点**,并约定页码的指代(如"括号里的 `P7` 指本 PDF 的文件页码,共 13 页含附录"),读者才能按图索骥。
导读开头必须放一段**阅读约定**说明这套标注,然后才是正文。
## 捆绑资源
| 路径 | 用途 | 何时读 |
|---|---|---|
| `scripts/extract_pdf.py` | PDF → 带分页标记的纯文本(支持多文件、页码范围) | 步骤 1 |
| `references/output-templates.md` | 产出结构的自适应参考:自适应原则 + 基准要素 + 参考骨架(全文导读 / 局部详解) | **动笔前读一遍** |
| `references/comparison-dimensions.md` | 跨论文对比的固定维度定义 + 填写纪律 + 空表 | 写多篇对比表时读;写完全文导读后回填 |
**仅全文导读模式需要回填**:每写完一篇全文导读,把该论文作为**新的一列**补进 `references/comparison-dimensions.md`,
并在该文件的「分篇详表」追加一节、逐条标注出处。局部详解模式**不回填**(方法全貌未读完,数据不可靠)。
该文件是累计型数据,默认只增不改;如发现此前填错需要订正,须在改动处写明订正原因。
首次使用时该文件只有维度定义和空表——按自己的研究方向重写 D2 之后再用(见该文件的「按领域落地」一节)。
## 工作流
### 步骤 0:判定模式
**先判断用户有没有点名某一处要求详解**,再看给了几篇 PDF:
| 输入 | 模式 | 产出 |
|---|---|---|
| 1 篇 PDF + 点名某处要求详解 | **局部详解** | `<指定部分>部分-导读.md`,走下方「局部详解模式」节 |
| 1 篇 PDF,未点名部分 | 全文导读 | `<短名>-导读.md`,走下方步骤 1–5 |
| 2 篇及以上,或用户明确说"对比" | 多篇对比 | 跨论文对比表,并回填 `references/comparison-dimensions.md` |
| 1 篇 PDF,说"总结主要内容 / 讲讲讲了啥" | **速览**(对话内,**不产出文件**) | 见下表 |
| 1 篇 PDF,点名某处说"总结"、或明确不要文件 | **局部摘要**(对话内,**不产出文件**) | 见下表 |
局部详解优先于其余模式:用户既然点名了某一处,就说明当下只关心这里,不要塞给他一份全文导读。
**易混边界**——下面几句话看着相近,走的却是不同模式:
| 用户的话 | 模式 | 为什么 |
|---|---|---|
| "除了实验部分之外的导读" | 全文导读 | 主语是"全文导读",实验部分只是被排除,**其余部分仍要全写** |
| "详细解释实验部分" | 局部详解 | 主语是"某一部分",**只写实验部分** |
| "总结这篇论文的主要内容" / "讲讲这篇讲了啥" | **速览**(对话内摘要,**不产出文件**) | 用户只要一份概述,既没说"导读"也没要文件。仍须通读全文、照用标注体系,但结构压到 4 块:论文档案 → 一句话定位与动机 → 方法要点 → 主要结果;长度约 50 行,全部为原文陈述。**不产出 md、不回填** `references/comparison-dimensions.md`。末尾用一句话告知可升级为完整 `<短名>-导读.md` |
| "总结某一部分" / "总结论文的 Numerical Results 部分" / "不用保存为 markdown 文件" | **局部摘要**(对话内,**不产出文件**) | 主语是**某一部分**而非全篇,且用户明确不要文件。字面上像「局部详解」,但用户要的是"总结"不是"详细解释",**不要按局部详解的深度展开,也不要落盘**。仍须通读全文(才能说清该部分依赖前文什么),输出按该部分自己的论证顺序走,逐条给 `§x` / `Table n` 出处;有数值就给关键数字 |
多篇模式下**不必为每一篇都写完整导读**:只为用户点名要精读的那几篇写,其余只填对比表。
若用户问"先看哪篇",在对比表后附一段阅读顺序建议,说明依赖关系(先懂哪个概念才能读懂哪个)。
### 步骤 1:提取 PDF 全文
宿主自带的文件读取工具对 PDF 常失败(报 "Cannot display content of binary file" 之类)。改用 skill 自带脚本:
```bash
python scripts/extract_pdf.py "<论文目录>/<文件名>.pdf" --outdir "<工作区>"
```
常用参数:
- `--name vtg` → 输出 `_vtg_full.txt`。默认按文件名派生短名并转小写(`VTimeLLM.pdf` → `_vtimellm_full.txt`)。
- `--pages 1-8` → 只提取部分页;写导读前先扫结构时用。
- 多个 PDF 路径并列传入即逐个处理;省略 `--outdir` 则输出到 PDF 同目录。
**短名冲突要先查再提**:工作目录里会不断积累 `_<短名>_full.txt`,短名相近的文件可能属于**完全不同的论文**。
典例:`VTG-LLM.pdf` 默认派的短名 `vtg_llm`,与更早提取的 `_vtg_full.txt`(同一方向的另一篇综述)只差一个下划线,极易读错文件。
所以**提取前先列一下工作目录已有的 `_*_full.txt`**,若目标文件与已有 txt 短名相近,用 `--name` 显式指定一个不冲突的短名
(如 `--name vtg_llm`),并在自己的笔记里记下"这个名字对应哪篇",避免下次读错文件。
- 提取的 txt 是**中间产物**,命名 `_<短名>_full.txt`,放在工作目录。**不要**把它作为最终产出展示给用户。
- 脚本会打印页数与平均字符数。**若提示"每页字符数极低",说明是扫描版或文本层缺失,须先 OCR**,不要硬读。
- 公式和图注在 txt 里会错位/断行(如 `3.2.1` 单独成行、脚标符号丢失)。遇到可疑处回原文 PDF 对照,不要猜。
### 步骤 2:通读
分 2–3 次读完,正文 + 附录都要读。附录里常藏着方法细节(模板、prompt、评测协议),是导读的高价值区。
### 步骤 3:核实 PDF 之外的元信息
PDF 本身往往没有会议戳(arXiv 版本尤其)。**必须**联网检索核实:正式发表 venue、年份、页码。搜标题 + 作者即可。
在"论文档案"表里单独注明来源,例如:
> 正式发表:**CVPR 2024**, pp. 14271–14280。注:该 PDF 为 arXiv v1,正文内无会议戳,此信息来自 CVF Open Access 收录记录。
同时记录读者手上 PDF 的版本(arXiv v1?几页?),因为不同版本的章节编号和数字可能不同。
### 步骤 4:写导读
产出文件名 `<短名>-导读.md`,放在工作目录根下。
**结合参考自适应输出,不要照模板填。** `references/output-templates.md` 给的是**基准要素 + 按论文类型
起手的参考骨架**——**动笔前先读一遍**,同页的**自适应原则**和**行文要求**对两种模式都适用。
**先读懂论文,再决定结构。** 论文自身的章节组织和论证方式优先于参考骨架。基准要素四项(定位与动机 /
档案 / 方法拆解 / 快速索引)通常都会涉及,但**增、删、改、合并、重排都可以**,名称也可以换成这
篇论文自己的说法(诊断类论文的"方法拆解"其实就是"证据链")。参考骨架覆盖不了的类型(综述、数据集、
理论、立场论文等)自己定义结构。
**论文没有的内容直接跳过,不要留"本文无附录"这类空节,也不要为了对齐要素而凑内容。** 自适应之后的
唯一检查标准是**读者能不能读懂**——这篇在解决什么问题、为什么要解决、方法关键环节和公式是否都在;
对齐清单本身不是目的。
**没有「评注」节,全文零推测。** 导读的价值全部落在「方法拆解」上——把方法讲准、讲全、公式不漏,
是这份产出唯一的质量标准。想输出对这篇论文的判断,先确认用户有没有明确要求。
### 步骤 5:收尾
1. 把该论文作为**新的一列**补进 `references/comparison-dimensions.md`——该文件的表结构是「维度 × 论文」,追加**列**而非行;同时在「分篇详表」追加一节,逐条给出 `§x` / `Table n` 出处。无法从原文确认的格子填「未核」,不要留空、更不要猜。
2. 向用户展示导读 md(若宿主提供文件展示/预览工具就调用它,**放在最后一个工具调用**,只展示导读,不展示中间提取的 txt)。
## 局部详解模式
**触发**:用户给一篇 PDF,点名某一处(章节号 / 模块名 / 公式号 / 图表号 / 概念名),要求"详细解释",且没有要全文导读。产出**只有这一部分**。
### 与全文导读的三点差别
1. **必须通读全文,但只输出一部分**。这是本模式最容易做错的地方:用户说"解释 §3.2",仍然要把全文读完。只有读完,才能判断这一处**依赖前文的哪些概念**、它的输出**被后文哪些模块消费**。"结合上下文"是本模式唯一的价值来源,只读那一节就动笔,等于把它丢掉。
2. **深度高于全文导读的对应小节**。同一部分在全文导读里可能只占 20 行;局部详解要展开到逐公式、逐设计决策。但展开的只能是**原文写了的内容**——原文没说明设计理由,就是没有说明,不要替作者补,也不要自己推演替代方案。
3. **不回填 `references/comparison-dimensions.md`**。方法全貌没读完就填对比数据,会污染那张表。
### 输出
命名 `<指定部分>部分-导读.md`,放在工作目录根下。
- `<指定部分>` 取用户对该部分的称呼,剔除文件名非法字符 `/ \ : * ? " < > |`。
- 该称呼本身已含"部分"二字时**不再重复追加**,避免出现 `方法部分部分-导读.md`。
- 用户只给了章节号时,直接用章节号命名。
> 用户说"详细解释方法部分" → `方法部分-导读.md`
> 用户说"展开讲讲 Stage 2" → `Stage 2部分-导读.md`
> 用户说"解释一下反事实探针" → `反事实探针部分-导读.md`
> 用户说"§4.3 那段讲清楚" → `§4.3部分-导读.md`
### 输出结构
**三项基准要素**:读懂它需要的前置 / 逐段逐公式拆解 / 与后文的接口。
详见 `references/output-templates.md` 的**「二、局部详解」**——**动笔前先读一遍**。
本模式的结构弹性小于全文导读("一部分"的边界是明确的),但仍允许前置并入拆解、按用户点名的对象
换形态(点名的是表格而非章节时,"拆解"就变成"逐行读表")。其中「读懂它需要的前置」与「与后文的接口」
两项是本模式的关键,篇幅紧张时优先压缩其他项、不要压缩这两项。
### 硬约束
- **默认不出现无原文依据的内容**。除用户明确要求外,不写推断、不写价值判断。确需补外部背景知识(如某个通用术语的定义)时,必须显式标注"外部背景知识,非原文内容"并给出可核查来源。
- **深度不设上限,但不要跑题**。与本部分无关的全文内容不展开,只给位置指引。
- 定位页码范围时可先用 `--pages` 分段提取,但**判断上下文关系仍须读完全文**。
## 范围限定处理
用户经常限定范围,最常见的是"除实验部分之外"。处理方式:
- 在开头的范围声明里**明确写出省略了什么**,并说明实验部分的位置(在「快速索引」里给出 `§4.2, Table 1` 等指向),方便按需回查。
- 但**不能因为省略实验就丢掉影响结论解读的协议事实**。例如:baseline 输出解析失败被剔除、训练集不含评测集(零样本)、评测用 LLM 打分。这类信息放在附录要点节里,标注出处,不呈现数值。
## 已知的坑
- **数字要动手算**。图例里常藏着关键机制。例:某篇论文 Fig. 1 中 16s 视频的 `30` 被标为 4.8s,`30/100×16 = 4.8` → 证明输出是百分位归一化刻度而非秒。这类"动手一算就能确认"的结论用【推导】标出,它是原文陈述的等价位,**不受"少推测"限制**,价值很高。
- **读数矛盾默认不写**。同一套刻度在正文两处被叫成不同名字、摘要里的提升幅度与正文表格对不上——这类属「歧义与存疑」范畴,**默认不输出**。仅当用户明确问"这篇有什么问题 / 哪里写得不清楚"时才写,且只列可核查的读数矛盾、不做评价。
- **作者的归因只作原文陈述**。作者对消融结果的解释("因为 X 所以 Y")标【原文】,不升格为事实,也不在导读里评判它对不对。
- **中文为主,技术术语保留英文**。论文标题、专业术语、指标名(mIoU、R@1@0.5 等)不译。
- **不要替读者筛选**。不要写"这篇可以跳过第 3 节"这类建议——读者自己判断。
Files in this skill
- README.md
- SKILL.md
- references/comparison-dimensions.md
- references/output-templates.md
- scripts/extract_pdf.py
Attribution
Comments
Loading comments…