核心结论

核验 AI 给出的事实和参考文献,需要通过四道关:来源是否真实存在,元数据是否对应同一项成果,原文是否真的包含这项信息,以及原文证据能否支持当前句子的强度。确认 DOI 能解析,只完成了前两道中的一部分;看到摘要中有相似词,也不等于完成证据核验。

最稳妥的产物是一张引用核验台账。每个准备进入论文的主张,都记录来源身份、原文位置、支持关系、适用范围、核验人和日期。AI 可以帮助发现元数据冲突和整理格式,但不能作为来源存在性的证明。

一条“看起来像真的”文献怎样产生

生成式 AI 可能把真实作者、相近题目、真实期刊和错误年份组合成一条不存在的记录;也可能给真实论文配上另一个 DOI,或把预印本与正式版本混在一起。更隐蔽的错误是文献本身真实,但并不支持 AI 放在它后面的结论。

因此,核验不能只问“这篇文章有没有”,而要问:

  1. 题名、作者、年份、期刊和标识符是否属于同一条记录;
  2. 当前拿到的是预印本、会议摘要、更正前版本还是正式发表版本;
  3. 准备引用的事实位于原文哪里;
  4. 研究设计和样本允许把结论说到什么程度;
  5. 论文之后是否出现更正、撤稿或重要质疑。

第一道关:确认来源身份

优先通过学术数据库、出版方页面和 DOI 登记机构核对元数据。Crossref 的元数据检索说明指出,其服务提供成员登记的题名、作者、出版物、DOI和更新等元数据,但 Crossref 本身通常不保存全文。元数据适合确认“这是什么”,不能代替阅读“它说了什么”。

遇到 DOI 时,至少检查解析后页面的题名、作者、年份和期刊是否与引用一致。没有 DOI 不表示来源必然虚假,书籍、报告、早期论文和某些数据库使用其他永久标识;同样,有 DOI 也不表示内容质量已经通过评价。

第二道关:确认版本和状态

同一研究可能先以注册、预印本或会议摘要出现,之后正式发表,甚至再发布更正。应记录实际阅读和引用的版本。预印本可以是有价值来源,但不能静默写成已经同行评审的正式论文。

检查出版方页面是否显示 correction、expression of concern、retraction 或 update;检查题名和作者变化;确认补充材料是否属于当前版本。若论文关键数据在更正后改变,引用必须使用更正后的信息并说明影响。

第三道关:定位原文证据

每个将进入论文的具体主张都要能定位。定位可以是页码、章节、段落、表号、图号或补充材料位置。只在摘要中出现的信息,应标注依据摘要;需要方法或数值细节时,不能用摘要代替全文。

最容易错配的内容包括:样本量、分母、时间点、效应方向、单位、置信区间、参照组和作者列出的限制。AI 解析表格失败时,常把相邻列组合,或者漏掉脚注中的子样本说明。

第四道关:判断来源能支持多强的句子

一篇横断面研究可以支持特定样本中观察到的关联,通常不能证明干预效果;一项动物实验不能直接证明临床有效;一篇观点文章可以支持“作者提出某种主张”,不能替代实证证据。引用核验要把论文设计、结果和当前句子放在一起比较。

可以给支持关系使用四种状态:

  • **直接支持:**原文在相同对象、变量和关系上提供证据;
  • **有限支持:**方向相关,但对象、测量或情境不同,需要限定;
  • **背景支持:**用于定义、历史或理论背景,不证明当前结果;
  • **不支持:**原文没有该主张,或证据类型不足以支持当前措辞。

教学案例:15条参考文献的核验

**教学模拟案例:**硕士生沈禾让 AI 为“睡眠与学习表现”引言推荐 15 篇论文。列表格式完整,其中多数带 DOI。她没有直接导入文献管理器,而是先建立核验台账。

编号AI给出的状态身份核验正文核验最终处理
R01题名、作者、DOI齐全DOI解析到另一篇相似题名论文无法继续删除,记录为标识错配
R02真实系统综述元数据一致结论只涉及青少年,AI写成全部成年人保留,但缩小句子范围
R03真实队列研究正式版本存在支持睡眠时长与成绩关联,不支持因果保留,改“相关”
R04会议摘要数据库可查,无正式全文方法和完整结果不足仅作线索,不进入关键结论
R05真实论文元数据一致出版方页面显示后来更正样本数使用更正版本并重核数值

沈禾原本准备写:“大量研究证明睡眠不足会直接导致大学生成绩下降。”核验后,她发现纳入证据包含不同年龄、不同睡眠测量和大量观察研究,于是改为:“多项观察研究在特定学生样本中报告睡眠时长或质量与学习表现相关,但测量差异和潜在混杂限制了因果解释。”

核验不仅清理了虚假引用,也改变了论文能够提出的结论强度。

填写完成的引用核验台账

字段R03示例
当前主张在该大学生样本中,较短睡眠与较低课程成绩相关
完整来源保存正式题名、作者、期刊、年份和DOI
来源类型观察性队列研究
版本状态出版方正式版本;核验日无更正提示
原文位置结果第3段、表2模型B
关键数值记录估计值、区间、单位、样本数和参照
支持关系直接支持“关联”,不支持“导致”
适用范围特定学校、年龄和随访条件
核验人/日期沈禾/2026-08-06

台账中应保存当前论文实际使用的句子。只记录来源而不记录它支持哪句话,后续改稿时仍可能发生引用漂移。

AI可以承担哪些核验辅助

  • 对比参考文献列表和 DOI 元数据,标记题名、年份或作者冲突;
  • 从已获取全文中定位候选证据段落;
  • 把正文主张与来源摘要成对展示,提醒强度词;
  • 检查同一 DOI 是否被写成多个不同题名;
  • 根据期刊格式整理已经核验的记录;
  • 标记正文中有事实主张但没有来源的位置。

这些工作都应基于外部数据库和原文。让同一个模型先生成文献、再问它“这些是否真实”,不是独立核验。

数字核验需要完整上下文

引用一个百分比时,要同时确认分子、分母、样本范围和时间;引用一个效应量时,要确认方向、参照组、模型、调整变量和区间;引用诊断准确性时,要确认阈值和目标人群。

例如原文写“42/120名完成随访者达到标准”,不能只摘录“35%达到标准”而遗漏最初招募 180 人以及失访。AI 常优先保留易读的百分比,研究者必须检查它代表谁。

引用格式正确仍然可能学术不当

格式转换只处理标点、作者顺序和期刊缩写,不处理来源是否被正确理解。还要避免二手引用伪装成读过原始文献:如果一个定义来自综述转述的早期研究,研究者应获取原始来源或明确引用当前实际阅读的综述,不能让 AI 自动把引文链改成“原始来源”。

大段改写来源文字还涉及抄袭和版权风险。即使 AI 更换了同义词,思想和具体事实仍需适当归属;直接文字则按规范引用并获得需要的许可。ICMJE 的 AI 出版建议把正确归属、权限和避免抄袭的责任明确留给人类作者。

必须停止和升级的情况

  • DOI解析结果与题名或作者不一致;
  • 只能找到二手转载,无法确认原始出版记录;
  • 关键结论只存在于 AI 摘要,原文无法定位;
  • 表格解析出现列错位、单位或正负号不确定;
  • 来源存在更正、撤稿或版本冲突,当前结论受影响;
  • 研究设计明显不足以支持稿件中的因果或普遍性表述;
  • 团队无法获取需要核验的全文,却准备引用具体数值或方法。

可以删除该主张、降低措辞、改用可获得且适当的来源,或请信息专家和领域专家处理。不能为了保留一段已经写好的文字,反过来寻找“看起来差不多”的引用。

改稿后要防止“引用漂移”

引用在初稿中核验过,不代表终稿仍然正确。合并句子、加强动词、扩大人群范围或把数字从结果段移到摘要,都可能让原来源失去支持关系。因此每次实质改稿后,应比较“被核验的句子”和“当前句子”,而不是只检查参考文献是否还在列表里。

例如初稿写“在某校大学生样本中,睡眠时长与课程成绩相关”,来源能够直接支持;修改后变成“睡眠不足普遍导致学生学习能力下降”,虽然引用编号没有变化,对象、结局与因果强度已经扩大。AI 可以批量标记这些范围词、因果词和数字变化,作者仍须返回原文重新判断。

终稿审计可以从两个方向进行:逐条参考文献检查它在正文承担什么主张;逐条可核查主张检查是否有恰当来源。前者发现无关或装饰性引用,后者发现无来源事实。撤稿、更正和更新状态也应在临近投稿时再次检查,尤其是承担主要结论的关键来源。

可直接复用的引用核验模板

稿件中的具体主张:

来源题名:
作者、出版物、年份:
DOI/PMID/其他永久标识:
元数据核验页面与日期:
实际阅读版本:正式版/预印本/摘要/报告
更正、撤稿或更新状态:

研究设计、对象和情境:
原文证据位置:
完整数值、单位、分母、区间和参照:
原文限制:

支持关系:直接/有限/背景/不支持
当前句子是否需要缩小范围:
最终引用句:
核验人和日期:

一条引用只有完成“身份—版本—原文—支持关系”四层检查,才可以进入正式论文。文献管理软件和 AI 都能提高整理效率,但最终证据责任仍在作者。