AI 文献解读审核、修改与润色指南
适用对象:已有的论文解读、逐图笔记、文献总纲和主题综述。目标是让解读忠实于原文、推理清楚、图文对应、语言自然,并能支持后续研究思考。
本指南可直接作为 AI 的任务指令。执行顺序是:核实来源 → 审核科学内容 → 检查图片 → 重组论述 → 润色语言 → 验证交付。不能用语言流畅代替事实准确,也不能把机械添加“可能”“尚不能证明”当作完成科学审查。
本文目录
一、先确认范围与证据来源
1. 建立当前任务清单
读取用户指定文件夹,列出待审查的单篇解读、总纲、综述及对应图片。保留已有编号与文件名;不要因编号不连续就认定文件缺失。
将每篇解读与 Zotero 条目及实际使用的全文关联,至少记录:
- 笔记编号和文件路径。
- 原文题名、作者、年份、DOI 或其他稳定标识。
- Zotero 条目及实际 PDF 附件。
- PDF 版本:正式发表版、作者稿、预印本或其他版本。
- 本轮使用的文件页序;必要时保留文件哈希,便于复核版本和确认原件未变。
集合名称、历史清单和旧审查报告只能帮助定位,不能代替当前核查。若 Zotero 条目数与文件夹笔记数不同,分别报告已覆盖、缺少来源、尚无笔记的条目,不强行凑成相同数量。
2. 明确哪些材料能支持哪些结论
优先核对所用版本的正文、方法、图表、图注及相关补充材料;如有正式勘误,应纳入解释。涉及补充实验、预处理或统计细节时,必须读取相应补充材料后再判断。
摘要适合定位主旨,不能单独支持完整的逐图解读。检索摘要、旧笔记、AI 总结和记忆都不能作为原文事实的最终依据。综述转述的研究若未调取原始论文,应写成“该综述援引的研究……”,不要伪装成已独立核验。
原文也可能存在错误。若正文、图注、面板或补充材料相互矛盾,应回查并记录;不要简单规定“正文永远优先”或“图注永远正确”。
3. 证据不完整时继续可完成的工作
没有全文、图像无法辨认或关键补充材料缺失时,指出受影响的具体结论,暂缓该项判断。可先修订有依据的部分,但必须保留待核实状态,不能将整篇标为“全文核对完成”。
二、每篇先梳理研究,再修改旧解读
先读原文,形成下面六项概括,再对照旧笔记。这样可以减少被原有解释带偏的风险。
| 要素 | 必须回答的问题 |
|---|---|
| 研究问题 | 作者实际要区分什么解释,或解决什么测量、控制问题? |
| 研究对象 | 什么物种、多少个体、哪些脑区或数据集?哪些分析使用不同子集? |
| 关键设计 | 操纵了什么,测量了什么,对照了什么?哪些变量仍共同变化? |
| 主要结果 | 哪些观测支持主张?效应方向、大小和适用条件是什么? |
| 推理边界 | 数据能支持到哪一步?作者解释与直接结果之间还隔着什么? |
| 研究价值 | 相比已有认识,这篇新增了什么可被验证的信息? |
不要先写宏大的背景,再寻找支持它的结果。优先建立“问题—设计—结果—解释”的关系;需要介绍前人工作时,只保留帮助理解当前实验的内容。
三、逐项审核科学内容
1. 检查基本事实与方法
逐项核对物种、个体数、性别与年龄(若与问题相关)、任务流程、刺激条件、记录区域、样本筛选、预处理、分析窗口、模型输入输出及统计方法。
尤其注意不同数量的单位:动物数、session 数、通道数、单元数、试次数和时间点数不能互相替代。伪群体不能写成所有单元同时记录;重复测量和重复抽样不能直接当作独立动物证据。不同结果可能来自不同子集,不要给全文套用一个统一样本量。
引用性能时,还应核对训练与测试划分、数据筛选是否使用测试信息、校准与辅助条件、基线和评价指标。如果论文没有交代某项,不要自动判断其存在错误,也不要替作者补上一个合理流程。
2. 核对重要数字和指标含义
优先核对会改变读者判断的数字:样本量、效应方向、主要效应量、关键时间、刺激参数、解码表现和统计结论。图中读出的近似值必须标明“约”,不能伪装成正文精确报告。
| 常见混淆 | 修改要求 |
|---|---|
| r、R²、解释方差、分类准确率 | 按原指标名称和定义表述,不互换,也不统一改成“准确率” |
| 百分比变化与百分点变化 | 写清分母及比较基准 |
| SD、SEM、置信区间 | 按原文标记,不笼统写“误差” |
| 未显著与没有效应 | 报告“未检出显著差异”;除非有相应证据,不写成等效或完全相同 |
| 行为首次显著分叉与机制启动 | 说明这是所用分析检出的时刻,不自动等同于内部过程的起点 |
| 采样率、刷新率与闭环延迟 | 分别说明测量对象,不由高采样率直接推出低端到端延迟 |
| 归一化或模型特定指标 | 查清公式、方向和取值范围,不凭指标名称套用常见定义 |
参数明显不合理或统计量与 p 值疑似不符时,先查看清晰源页,排除 OCR 丢失指数、希腊字母、负号或单位。仍无法解释时,准确引用原文并标明疑点;不要擅自把单位改成“通常应该使用”的单位。
3. 区分四个层次
在审核中分清:实验直接观察、作者解释、解读者的综合判断、尚未验证的假设。成稿不必给每句话贴标签,但读者应能辨别这些层次。
常见的结论越界包括:
- 相关或可解码,被写成因果控制机制。
- 模型内部操纵,被写成动物实验已证实的机制。
- 控制了几个混淆因素,被写成排除了所有替代解释。
- 特定任务、个体或时间窗口的结果,被写成整个脑区的普遍规律。
- 经过线性对齐得到相似结构,被写成实际突触、细胞身份或生物读出完全不变。
- 离线预测较好,被写成已经完成在线闭环或临床验证。
- 在一种训练安排中学习困难,被写成永远无法学习。
- 相对于某个读出定义的零空间,被写成对全部下游均不起作用。
- 神经或行为指标,被直接写成未经测量的主观体验。
发现越界时,应补回被省略的条件并重新组织结论,而不是只把“证明”替换为“提示”。反过来,若研究确有相关的因果操纵,应明确陈述其所检验的因果关系,不要一律降格为相关性。
4. 建立简明的核对记录
对核心主张、重要数字及有争议的修改,保留足够的证据位置。无需给每个形容词建表。
| 原解读的问题 | 原文依据 | 判断 | 修改后的表述 |
|---|---|---|---|
| 引用原句或准确概括 | 正文段落、PDF 页序、图号/面板、补充材料位置 | 事实错误/范围过宽/语言问题/原文矛盾/待核实 | 可直接放回正文的句子 |
“没有找到依据”不等于“原文一定没有”。说明已查看哪些部分、目前缺少什么,再决定删除、改写或保留疑问。
四、逐图审核必须同时看图片、图注和正文
1. 先核对图片身份
确认论文、版本、主图或补充图编号,以及是否存在错图、重复图、漏图、跨页遗漏或将邻近图误拼成一图。不能仅凭图片文件名认定来源正确。
并非所有图都必须重新生成:已有图片正确且清晰时保留;仅在错配、缺失、低清晰度或裁切不完整时,从已确认的原文重新提取。
2. 再核对可见内容
逐图检查:
- 面板字母、排列顺序、横纵轴、单位、刻度及颜色条。
- 颜色、线型、实心/空心标记、阴影和显著性符号的含义。
- 个体数据、群体均值、模拟结果和示意图的区别。
- 标题、图例、误差线、比例尺、时间窗及底部坐标是否完整。
- 文字中的“上排/下排”“左列/右列”是否对应实际布局。
缩略图和联系表只适合定位与初筛。涉及小字、计数、相邻示例或疑似缺失面板时,必须放大原页核对。一个视觉区域可能包含多个示例,不能只数缩略图中的矩形块就宣称原图注计数错误。
3. 按证据写逐图解释
每张图回答三个问题:
- 比较什么? 指明条件、对象和关键面板。
- 看到什么? 写主要方向、差异、时间过程或空间结构,必要时引用关键数字。
- 支持什么判断? 连接研究问题,并指出这一图特有的解释边界。
不必逐一复述所有轴标签,也不要只写“这张图非常重要”。同一限制若适用于多图,可在讨论中集中说明,避免每张图都用相同的免责声明收尾。
图下保留原文图号、可定位的 PDF 页码及来源链接。说明页码是文件页序还是期刊印刷页。提取时不改变数据、配色或坐标;不得用生成式补画修复缺失的科学图像。保留完整标签比裁得紧凑更重要。
五、重组单篇解读的结构
可采用以下顺序,但不要为不同类型论文强套完全相同的篇幅:
- 文献信息与一句话结论:准确概括主要发现及必要条件,不使用宣传式标题。
- 背景与问题:已有认识留下了什么具体缺口。
- 研究思路:关键比较如何区分不同解释。
- 方法:保留影响结果判断和复现理解的信息,不堆积无关设备参数。
- 主要结果:按科学问题组织,而非机械照抄正文段落或把摘要扩写。
- 逐图解读:与原图对应,补充结果段没有讲清的读图细节。
- 讨论与边界:解释贡献、适用范围、主要替代解释和与相关文献的关系。
- 思考问题:提出 1–3 个具体问题。
综述论文应突出观点及其援引的证据,不能写成作者新做了所有实验。方法论文重点看验证设计、误差和适用条件;数据论文重点看数据结构、采样、质量与使用限制;模型论文重点看假设、拟合、比较模型和可检验预测。
六、把文字改得自然、准确、像认真读过论文的人写的
应做到
- 每段围绕一个明确问题展开,先陈述结果,再解释它如何回答问题。
- 使用具体主语和动作,例如“作者比较了两种反馈条件”,少用“本文从多个维度深刻揭示”。
- 保留有判断力的解释,但给出依据。专业、直接的语言比夸张赞叹更有说服力。
- 首次出现的缩写给出全称或中文说明;同一个术语前后一致,同一缩写在不同论文中重新确认含义。
- 根据需要保留关键英文术语,但不要在可以清楚表达的地方频繁中英切换。
- 将重要限制放在相关结论附近;共同限制集中处理,避免正文先夸大、最后再用一段话撤回。
- 控制数字密度:正文突出决定结论的数字,技术细节可留在方法或图解中。
应避免
- “最硬的证据”“一锤定音”“彻底颠覆”“教科书级”“打脸旧观点”等缺乏依据的评价。
- 每段都以“值得注意的是”“更重要的是”“这张图说明”开头。
- 用“第一层、第二层、第三层”组织所有论文,而忽略各自不同的实验逻辑。
- 用大量比喻替代机制,或把“拟合较好”写成“模型看懂了大脑”。
- 为显得严谨而连续堆叠“可能、似乎、一定程度上”,却不交代不确定性来自哪里。
- 全局替换词语:否定句、引文和反例中的强词可能是必要的,盲目替换会改变原意。
- 捏造个人阅读经历、情绪、作者意图或未被报告的实验过程来制造“人味”。
“像人写的”应体现为取舍合理、解释具体、句子顺畅和判断有依据,不是口语化、赞美化或虚构主观感受。
改写示例(示意,不代表某篇论文的实际结果)
| 不合适的表述 | 更合适的表述 |
|---|---|
| 这张图彻底证明了群体动力学是运动控制的唯一机制。 | 所测任务中出现了共同的群体轨迹结构;区分其来自内部动力学还是持续输入,还需要进一步操纵。 |
| 两组没有显著差异,所以机制完全一样。 | 该指标未检出组间显著差异;这一比较没有直接检验两组是否使用相同机制。 |
| 作者漂亮地排除了所有混淆。 | 作者匹配了速度并检查了肌电,减弱了这两个因素的解释;接触反馈仍未被独立控制。 |
| 该技术具有巨大应用潜力。 | 该方法减少了所测任务的人工标注量;用于精细手指动作前,仍需验证遮挡条件下的误差。 |
改写时必须有相应事实支持。不能把示例中的“匹配速度”“检查肌电”等内容直接套入未实施这些控制的论文。
七、每篇末尾提出 1–3 个值得继续研究的问题
问题应从论文的结果、设计或主要解释边界出发,尽量包含“改变什么、测量什么、什么结果能区分解释”。可以涉及:
- 机制区分:哪种操纵能区分当前结果同时相容的两种解释?
- 迁移与泛化:改变目标、反馈、时间尺度或行为情境后,什么应保持,什么可能改变?
- 方法检验:换用更严格的留出测试、匹配条件或独立测量,关键结果是否保留?
避免空泛的“未来如何应用”“还有哪些不足”。不要问原文已明确回答的问题,也不要要求用无法观测的概念直接检验机制。不是每篇都必须提出三个问题;一个具体、有判别力的问题优于三个通用问题。
八、最后修订文献总纲和综述
完成逐篇审核后,再更新跨论文概括;不要让旧综述反过来规定单篇应该得出什么结论。
总纲负责准确导航。 核对范围、编号、链接、研究类型及一句话结论;按读者问题提供阅读路线。区分直接相关、方法参考和跨物种或跨任务的启发性资料。
综述负责比较和推理。 围绕问题组织证据,而非连续粘贴单篇摘要。说明不同论文的任务、对象、时间尺度和指标是否可比;有分歧时检查其可能来自设计、测量或理论预测,而不是强行写成一致结论。
需要特别检查:
- 是否把同一数据集的不同论文误算为独立重复验证。
- 是否将预印本与正式版重复计算,或混用不同版本的图与结论。
- 是否把综述中的二手转述当成新的原始证据。
- 是否由多篇相关性研究累积出未经检验的因果结论。
- 是否把方法可行性、行为有效性和神经机制证据混为一谈。
- 是否为了故事完整,删掉了重要反例或任务边界。
本来是选定文献集的综合阅读,就据实说明范围;没有完成系统检索、筛选与相应记录,不称为系统综述。需要补充关键文献时,另行检索核实,并清楚标记新增来源。
九、交付前的验证与记录
先备份待修改笔记及需要更换的图片。默认保留原始 PDF、数据和 Zotero 题录;如发现源文件或题录问题,单独记录,不将解读润色扩展为未经授权的源数据修改。
交付时分别检查三个层面:
| 层面 | 完成标准 |
|---|---|
| 科学内容 | 核心主张和重要数字有出处;事实、解释与假设可区分;正文、图解和讨论不矛盾;待核实项有明确边界 |
| 图片与显示 | 图片身份正确、面板和标签完整;修改过的裁切逐一回看;长文档检查实际显示,不能只看代码或缩略图 |
| 文件与来源 | 应审文件均有状态;链接和图片路径有效;图号及来源对应;每篇有 1–3 个问题;备份可找到,原件保持完整 |
脚本适合查数量、路径、重复文件、来源映射和结构缺失,不能自动证明科学解读准确。不要把结构检查通过写成“所有结论均已验证”。
至少交付修改后的单篇解读、总纲/综述(若在范围内),以及简明审查记录。审查记录应写明:审了哪些文件、依据什么版本、主要修正了什么、哪些事项仍待核实。可使用“已核对并修订”“部分核对,存在明确待核实项”“缺少必要来源”描述状态,不能把后两类混入全部完成的统计。
最终回复给出实际完成数量、关键文件入口和必要限制。除非执行并验证了原始分析,不宣称重现论文统计结果;除非实际打开测试过,不把来源链接存在写成已验证所有软件跳转行为。
十、可直接复制给 AI 的执行指令
请依据指定 Zotero 集合和真实论文全文,审核并修改目标文件夹内的文献解读、文献总纲与综述。请实际修改文件并完成必要验证,不只给出建议。
1. 先列出待审文件,并将每篇与 Zotero 条目、真实 PDF 和版本对应。集合数量与笔记数量分开统计;不要沿用历史数量或按编号猜测缺失。
2. 先读原文,再对照旧解读。明确研究问题、对象、关键操纵、测量、对照、主要结果和解释边界;相关补充材料在需要时一并核对。
3. 逐项纠正事实、样本量、数字、单位、指标、时间窗和方法错误。区分直接观察、作者解释、综合推断与待验证假设。不要把相关写成因果、不显著写成等效、模型结果写成动物实证、特定条件写成普遍规律。
4. 每张图同时对照原图、完整图注和相关正文,检查图号、面板、行列、坐标、图例与结果对应。缩略图仅用于初筛,有疑问必须放大原页。正确图片保留,问题图片从对应原文重新提取,保全标签并补充来源页码。
5. 按问题—设计—结果—解释重组每篇。删除重复和夸张评价,写清关键推理,使行文具体、自然、有取舍。不要机械替换词语,也不要只在结尾添加免责声明来补救正文的过度结论。
6. 每篇末尾提出1–3个具体思考问题,优先围绕机制区分、泛化或方法验证。问题不能空泛,也不能是原文已回答的内容。
7. 完成单篇后再改总纲和综述。区分物种、任务、时间尺度、研究类型和证据强度;注意数据集复用与版本重复,保留重要分歧,不强行组织成统一机制。
8. 原文内部矛盾或证据不足时,准确标明问题和受影响范围,不自行猜改;继续完成其他有依据的部分。没有全文不能宣称完成全文审核。
9. 保留原编号和文件名,备份待改笔记及旧图,不擅自改动原始PDF、数据或Zotero题录。交付修订文件和审查记录,验证链接、图片、来源和问题数量,并回看修改后的实际显示。
10. 最后报告实际审查范围、完成数量、关键改动和待核实项。文件结构通过不等于科学结论全部验证;未重跑数据就不要宣称重现统计结果。
任务参数:
- 目标文件夹:[填写路径]
- Zotero集合:[填写名称或ID]
- 交付范围:[单篇解读/总纲/综述]
- 特别关注:[例如反馈控制、运动学习、图文对应]
- 其他明确要求:[填写;没有则按现有文件风格做必要修改]