Archive method
Paper Analysis Workflow
这里说明如何理解论文的核心机制、检验证据支持范围,并将得到的认识用于新的问题。
目标与适用范围
论文存档的首要目标是帮助读者解释核心机制、判断证据支持到什么程度,并把得到的认识用于新的问题。归档保留的是经过理解和检验的判断;出处承担查证功能,作者与文献沿革承担补充功能。隐藏原文编号后,正文仍应完整成立。
本 SOP 适用于单篇论文、技术报告、模型卡、已发表综述、博客和框架文档。当前契约为 Workflow version: v3,使用 Paper Note Template。研究方向综述、进展或时间线使用 Research Synthesis Workflow 和 Research Mainline Template。
阅读深度由核心问题、解释缺口和结论风险决定。篇幅以读者能复述机制、评估判断和理解适用条件为准;不以原文页数、标题、公式或引用数量安排篇幅。
执行入口
先确定阅读问题、材料身份与版本、交付方式。能够据上下文确定时直接执行;只有歧义会改变分析对象、核心判断或写入范围时询问。
| 交付方式 | 触发与结果 |
|---|---|
analysis-only |
分析、总结、解释或单篇比较:读取必要来源并回答,不修改仓库。局部问题按其范围处理;整篇分析执行完整科学流程。 |
archive-core |
归档、建档、保存,或要求提交尚未归档的分析:完成核心阅读,写笔记、索引和标签,验证后本地提交。已有提交的 push 请求按 Git 规则处理。 |
enrichment |
用户点名,或来源冲突、实现、审稿、身份问题会改变核心判断时,补充对应证据;不单独授予写入权限。 |
未指定问题时默认回答:论文增加了什么认识,这种认识靠什么成立,它会怎样影响后续研究或设计选择。允许负面结果、证据不足和没有可靠的新迁移判断。
阅读与归档流程
1. 确定问题、版本与核心主张
从规范来源确认标题、版本、公开日期和责任主体,检查本地是否已有同一材料。arXiv 使用 abstract 页面确认身份、明确版本的 PDF、HTML 或 source 阅读正文;代码与网页固定 release、tag、commit,无法固定时记录观察日期。不同版本的正文、附录、代码与评测逐项区分。
先浏览摘要、贡献、方法总图、主要结果与局限,建立简短的问题与主张记录:现有方法受什么限制,作者改变了什么,哪些结果决定其贡献。每项核心主张先判断需要什么证据,再读取对应内容。必要的简单基线和强基线用于理解区别性贡献;新颖性只比较实际核验的工作,未独立核验的“首次”保留作者归因。
工作记录区分设计事实、观察或证明、作者解释、本地判断。此时暂不填公开模板,也不把原文章节清单当成成文提纲。
2. 重建机制,走通实例
用核心问题组织“问题—关键变化—作用机制—结果”。从输入或假设开始,解释完整执行链或论证链。多阶段方法写清角色、状态、传递对象、更新关系和最终输出;理论写清定义、量词、实质假设和关键推导依赖。辅助贡献按其对核心问题的作用展开,技术分支可进入补充材料。
对关键步骤追问:为什么需要它,去掉或替换它会改变什么?作者已经验证的理由、作者提出的解释和阅读者的推论分别表述。同名模型、训练与推理版本、冻结与更新对象先消歧;检查额外监督、目标泄漏、oracle 信息和未计入的成本。
机制解释完成两层复述:
贡献与方法总览独立解释首要贡献、必要辅助贡献、完整链条、关键对象的角色与最终输出或训练信号。- 必要详解进一步解释关键操作、设计理由、成立条件,并用可对应原定义的实例走通机制或关键论证。示意实例明确区别于实测,源材料未披露的步骤就近说明。
总览的编号、位置和阶段拆分按解释需要决定。公式先解释它要解决的局部问题,之后说明变量、信号方向、实现后果或适用条件。影响机制和判断的公式与细节必须保留;原文逐式推导不自动成为正文交付要求。
3. 逐项判断证据支持范围
围绕主张选择证据,集中读取会影响核心判断的结果、对照、消融、失败设置和必要附录。每项核心证据需要回答以下问题,答案可以写成连贯自然段或便于比较的表格:
- 实际测量或证明了什么?比较对象、设置、指标及分母是什么?
- 对照改变和固定了什么?是否混入数据、容量、计算或调参差异?
- 结果能区分哪些解释,哪些相关替代解释仍未排除?
- 在这些条件下,证据足以支持什么结论,尚有什么未知?
正文先说明判断,再解释证据与推理。使用“证据支持的结论及范围”完整表达已经建立的贡献,同时保留改变真值的条件。可以说明支持、部分支持、尚不能判断或存在反证的具体原因;不把这些逐主张判断合成无依据的整篇评分,也不把条件性正面结果一概收缩成“无法说明任何问题”。
实验关注效果大小、独立实验单位、重复与误差范围、数据划分、选择协议和预算;理论关注假设、量词、证明依赖、上下界及存在性、可学习性、实际算法保证的区别;系统结果关注实测口径、完整执行边界和资源归因。细则按主张启用 internal/paper-analysis-modules.md,不要求为每篇搜齐全部字段。
机制构造、性能变化、原因识别与跨场景有效分别判断。多变量消融只能识别相应联合变化,相关性探针属于机制线索;未匹配算力的结果仍可支持相应配置比较。未披露、未读取、无法访问、未支持和已证伪分别记录,缺口只约束受影响的主张。
4. 抽象关系,主动检验迁移
每篇完整分析都执行这一步。去掉论文专属名称,保留决定结果的关系:任务如何分解、信息如何流动、误差如何产生、学习规则如何匹配目标、约束如何改变可行选择。抽象后仍应能映射回论文中的具体操作与证据,避免泛化成任何论文都适用的提醒。
主动寻找目标场景,并检查:
原论文中的机制 → 保留的抽象关系 → 目标中的对应对象 → 预期变化 → 失效条件或否定预测的观察。
同领域改变数据分布、预算、学习规则或模型结构也可构成迁移。比较时说明哪些关系相同、哪些条件已经改变;表面名称相似不足以支持推论。新颖类比可以作为假设提出,证据等级如实标注。
归档区分有直接依据的认识、有前提的迁移推论和待验证假设。可用一个新场景与一个条件变化检查理解,不强制固定案例数、领域跨度、段落或启发数量。不编造读者以前持有的观点;有实际对话或来源支持的认识变化才归因到该原有判断。
抽象与迁移 记录本篇新增的区分、可复用判断及其适用范围。尚无可靠迁移结论时,说明缺少哪种机制或证据、因此无法作出哪种判断,不强造启发。执行这一步不要求安装环境或实际运行新实验,未运行的验证设计明确写为待验证。
5. 按理解顺序成文
analysis-only 直接回答问题,再解释机制、证据与适用条件。局部请求不套整篇模板。
archive-core 的阅读主干按下列顺序组织;每篇的具体小标题按内容命名:
| 内容 | 归档位置与交付结果 |
|---|---|
| 核心判断 | 一句话结论:本文带来的认识及决定其真值的条件,与索引核心信号对齐。 |
| 问题与机制 | 论文脉络:首要贡献、完整链条、必要详解和对应实例。 |
| 证据与判断 | 证据与结论:按核心主张解释实际结果、比较与替代解释、证据支持的结论及范围。 |
| 可迁移认识 | 抽象与迁移:抽象关系、目标场景、预测与失败条件,或尚不能形成可靠迁移判断的原因。 |
| 来源与补充 | Source 放在阅读主干之后;作者、相关工作与必要技术细节按内容在后续章节补充。 |
证据与结论 兼容旧结果章名称,但 v3 不要求显式填写 证据定位、观察、判别性与局限、支持的最窄结论 四行。相关科学问题仍须回答。条件性局限在受影响的机制、证据或迁移判断附近解释;需要综合时另设局限章,避免重复展开。
引用紧邻被支持的判断,优先用描述证据内容的链接文字。原文定理、算法、章节和图表编号保留在定位信息中;专门讨论某个定理本身时可显式使用编号。正文不以编号串联代替思想、作用和条件。引用定位精确到所读版本的章节、图表、定理、页码或代码位置,来源首页只用于确认材料身份。
同一结果在一个主要位置完整展开,其他位置简短引用已有解释。作者与关系、跨论文关系不作为 v3 独立必填章节。作者块和论文时机构保留在来源或补充资料中,执行本地重名、别名与已有 profile 检查;无可靠跨论文关系时省略相应章节。
决定贡献差异或对照有效性的前序工作进入核心分析,文献沿革与延伸阅读放在补充部分。跨论文联系区分作者引用、方法继承与本地比较,不由共同作者或相似名称推断方法关系。普通作者只复用已有 profile;外部作者增强按“指定作者 × 指定字段”启用,完整档案和代表论文请求按维护 SOP 处理。新论文不会自动更新旧笔记或研究主线。
关键图按解释价值决定,在讨论其机制或结果的位置嵌入带 Image Source 的本地图片,保留坐标、图例、条件与来源。文字或表格足以完成解释时可以 omit 并说明理由。用户明确要求的图片属于交付范围。
6. 完成科学验收
主执行者完成一次合并自审,发现问题后复查受影响部分:
- 理解:隐藏引用编号后能复述贡献、关键对象与完整链条,并走通关键实例;只能复述术语或结果数字时,返回机制解释。
- 证据:每个重要判断能指出直接依据,解释比较口径、相关替代解释和成立条件;贡献表达既不过度推广,也不遗漏已建立的结果。
- 迁移:改变关键条件后能指出受影响的环节,并提出有理由的预测或明确未知;预测依据不足时标为假设或撤回。
- 来源与范围:版本、阅读缺口、来源定位、实际启用的增强范围与审阅状态符合事实和授权。
结构检查通过只表示相应结构和数据约束满足。机器不通过关键词计数、字段数量或引用数量判断科学质量;语义正反例见分析模块。存在核心证据冲突、结论高风险或用户要求独立复核时,可启用范围限定到争议主张的独立审查者。
7. 归档、提交与后续维护
科学验收后更新论文文件、唯一索引行、标签、来源图片和审阅状态,执行仓库检查,审查暂存差异并创建本地 commit。只有明确要求时 push。已有笔记修订保留首次归档时间和原审阅历史。
后续交流在归档授权下更新其影响的机制、证据、局限、关系或抽象迁移。v3 的稳定认识集中在 抽象与迁移,不并行维护重复的 主要启发 或 本地讨论补充。旧笔记仅因事实纠错、核心结论变化或用户明确要求维护时迁移;普通新增论文不触发跨库整理。
来源缺口、检索与停止条件
补充检索须对应尚未解决的问题。先读同版本正文和必要附录,再取直接相关的一手材料。摘要、搜索片段和自动结构化报告可用于导航;核心方法和判断须回到原始内容核验,不能因工具返回“报告”就视为已读全文。相关代码链接也需确认属于该论文及所读版本。
实现细节会改变判断时可只读代码;精确复现、环境安装、长时间计算和有外部副作用的执行按已授权范围处理。作者档案、公开账号、完整审稿和引用扩展不自动扩大任务。
核心问题已回答、关键机制能复述、直接证据和主要替代解释已处理、抽象迁移已完成有界判断时停止检索。搜索轮数、来源数量与空结果均不能单独证明充分性;没有新证据时不反复改写同一查询。
| 来源状态 | 处理方式 |
|---|---|
| 原材料未披露 | 绑定到受影响主张,说明还能判断什么。 |
| 关键材料尚未读到 | 补读,不把未读写成未披露。 |
| 来源不可访问 | 尝试官方替代;仍不可用时记录已读范围与未验证内容。 |
| 核心证据冲突 | 保留各自版本、设置与结果;无法解释时保留未解决状态。 |
| 缺口阻止回答 | 交付已确定部分和所需最小材料,不宣称完成整篇分析。 |
用户明确要求保存不完整材料时,按有限结论归档,在 Reading scope 和核心判断中说明影响。只有摘要时不能写成已核验完整方法。
Source 与审阅状态
必填来源字段为 Workflow version: v3、Material type、Analysis modules、Canonical source、Title、Authors 或 Responsible organization、公开日期、所读版本、Accessed、Reading scope、图片决定和公开审稿状态。材料类型与模块枚举见模板。Reading scope 用短句说明实际读过的正文、附录或代码范围,以及影响判断的未读或访问缺口;不宣称未执行的复现。
公开审稿与本地用户确认分别记录。公开状态不要求固定次数的搜索,按用户问题或可信度缺口决定是否检索:
- Review status: page-type=not-checked; match-confidence=not-applicable; observed-at=YYYY-MM-DD; venue-status=unknown
| page-type | 含义与记录方式 |
|---|---|
not-checked |
未核验外部评审;不能据此声称不存在评审。 |
not-found |
实际检索未找到可靠匹配;补充 Review lookup,简记服务、查询与范围。结论限于本次检索。 |
unavailable |
候选来源访问失败;Review lookup 记录目标与失败原因。 |
metadata-only / proceedings / commentary |
分别只读元数据、正式出版记录或非正式评论;补充 Review evidence 定位对应 URL 与已读范围。 |
official-review |
实际读到正式评审、meta-review 或 decision;增加审稿分析章,写明已读材料与直接定位、主要质疑、作者回应及对结论的影响。 |
not-applicable |
材料不适用学术评审,注明材料身份。 |
match-confidence 表示候选材料与本文的身份匹配程度;有已读页面时用 high、medium 或 low,not-checked、not-found、unavailable、not-applicable 时用 not-applicable。observed-at 是状态记录日期,venue-status 只写来源支持的出版状态,未知写 unknown。状态不能证明内容正确。
审稿章的 已读材料 必须区分 decision、meta-review、选读 review 和 rebuttal。只读 decision 时不推断 reviewer 共识;未读回应写“未读取”,已读范围中没出现回应写“未在已读材料中披露”。是否继续读由质疑对核心判断的影响决定。
头部使用分钟精度的 First-Archived-At、Updated-At、Review-Status: pending。v3 允许同一分钟归档多篇,身份由 slug 区分,排序沿用 slug 决胜;时间如实记录。用户明确确认后改为 approved 并记录 Reviewed-At;后续修订保留原有 Review-Status 和 Reviewed-At。approved 表示曾获用户确认,不代表之后的每次修订都获确认。实质内容变化更新 Updated-At,纯排版、拼写和不改变来源身份的链接维护保留时间;审阅动作只更新审阅字段。
维护与兼容
阅读与科学判断的规范来源为本 SOP;模板只提供可填写骨架;条件分析细则归 internal/paper-analysis-modules.md;路径、标签、作者数据、公式图片、删除与验证细则归 internal/paper-archive-maintenance-sop.md。AGENTS.md 保存执行边界和路由,历史设计文档只记录决策背景。
新笔记使用修订后的 v3。现有 v3 笔记随本次契约修订完成正文迁移;既有 legacy、v2、v2.1 按冻结范围继续校验;v2.1 集合记录在 internal/paper-workflow-v21-slugs.json,只能随迁移缩减,不能加入新材料;验证器固定对应的 Updated-At,时间变化即要求迁移。旧笔记达到实质回写条件时迁移到 v3;单纯排版维护沿用原契约。原 paper-workflow-method-overview-baseline.json 只服务未迁移 v2.1 的兼容检查,迁移时移除对应记录。迁移保留来源事实、用户判断、首次归档时间与原审阅历史,不批量重写现有论文。
后续交流在取得归档授权后按语义进入当前笔记的机制、证据、局限、跨论文关系或抽象迁移,不新增 本地讨论补充。删除论文仍须精确路径的二次确认,并同步处理索引、标签、受影响关系、主线引用及无剩余论文关联的作者 profile;orphan-author-profile 为硬错误。
强制契约变更须在同次改动中对齐 AGENTS.md、SOP、模板、验证器、测试与至少一个新契约 fixture 或真实 canary。自动规则只检查可确定的结构和数据约束;新增语义要求提供人工验收问题与正反例,不用关键词数量代替。历史兼容测试继续运行,新增规则不能迫使无关笔记改写。
安全与双用途材料保留机制、风险、评测和防御启发,省略可直接滥用的操作细节;所省略内容影响理解时说明披露边界。
流程参考及采用范围
| 来源 | 本流程采用的部分 | 适用边界 |
|---|---|---|
| Keshav:How to Read a Paper | 分层阅读,尝试从假设重新构造工作并识别理解缺口。 | 阅读方法建议,不机械套用固定时长。 |
| NeurIPS Paper Checklist | 主张与结果匹配,明确假设、实验设置、不确定性与资源口径。 | 透明度检查帮助判断,字段齐全不证明科学结论正确。 |
| Gentner 等:Learning and Transfer | 主动比较案例中的关系,帮助形成可迁移结构。 | 直接实验涉及谈判学习;用于论文阅读是本流程的设计借鉴,迁移收益仍需观察。 |
| alphaXiv OpenResearch 文献阅读规范 | 按具体缺口检索,读后引用,区分发现来源与核验主张。 | 2026-09-05 读取该版本;其默认结构化报告只作导航,检索轮数限制不替代证据充分性判断。 |
这些来源分别帮助组织阅读、检验证据和设计迁移检查;本流程的完整组合尚无独立学习效果测量。