核心结论

AI 不能证明一个选题“有创新”。它可以帮助扩大检索语言、比较研究设计和整理已有证据,但创新性必须建立在可复核的文献范围、明确的差异和真实研究价值上。“没有搜到相同标题”“某地区研究较少”或“把两个热门词组合起来”,都不足以构成研究空白。

更可靠的做法是把创新性主张拆成三部分:现有研究已经知道什么;仍然不知道或不能确定什么;拟开展的研究将用什么新证据减少这项不确定性。三部分都能对应到来源、方法和可交付结果时,才形成可辩护的研究位置。

研究空白不是一个固定类别

“研究较少”把完全不同的问题混在一起。至少应区分五类空白:

  • **证据缺失:**关键对象、结局或情境几乎没有直接研究;
  • **结果冲突:**研究存在,但方向、效应或解释不一致;
  • **方法缺口:**问题被研究过,但测量、设计、样本或分析不足以支持当前结论;
  • **情境缺口:**证据集中在特定地区、人群、材料或制度,外部适用性不清;
  • **机制缺口:**现象已经观察到,但过程、边界条件或替代解释尚未被区分。

这些空白需要不同研究。结果冲突不一定需要再做一个相同横断面研究,可能需要统一测量、提高样本质量或解释异质性;情境缺口也不能仅靠“换一个城市再做一次”成立,必须说明新情境为什么会改变机制、实施或结果。

AI最容易制造的三种伪创新

第一种是词语创新。模型把“数字化”“智能化”“多模态”等词加到普通问题上,标题看起来新,研究关系却没有改变。

第二种是地点创新。只因为在当前检索中没有发现某所学校或某个城市的研究,就声称填补地区空白。地点只有在制度、人口、资源或环境差异可能改变结论时,才具有研究意义。

第三种是检索盲区创新。研究者只用一个中文关键词或一个数据库,AI 没找到结果,就判断“尚无研究”。相同概念可能使用不同术语,早期研究可能不含当前流行词,相关证据也可能出现在邻近学科和引文网络中。

所以,AI 生成的任何“首次”“尚无”“从未”“填补空白”表述,默认都应视为待核验主张。

教学案例:一种复合涂层真的有创新吗

**教学模拟案例:**材料学博士生宋遥计划研究一种含天然提取物的可降解镁合金涂层。AI 根据她提供的材料名称生成了“首次构建兼具耐腐蚀与抗菌功能的绿色复合涂层”这一创新表述。

宋遥没有直接采用,而是把主张拆开:

  1. “首次构建”要求证明此前不存在功能和构成相近的工作;
  2. “兼具耐腐蚀与抗菌”要求已有研究没有同时可靠评价两类结局;
  3. “绿色”需要明确材料来源、制备过程和环境评价,不能只是天然成分;
  4. 新涂层还要解释为什么相对于已有涂层能增加科学认识,而不只是换一种配方。

她先让 AI 从已确认的种子论文生成同义词和上位概念,再在专业数据库中运行检索,并沿种子论文的参考文献和被引文献追踪。得到的结果显示:相近提取物已经用于其他金属,兼顾两类功能的涂层也存在,但在镁合金降解环境中,抗菌结果常在与腐蚀测试不同的介质和时间尺度下报告,难以判断两种性能能否同时保持。

于是创新主张从“首次绿色复合涂层”改成了一个可检验的位置:在同一模拟生理环境和预先定义的降解阶段,联合评价涂层的腐蚀变化与抗菌表现,并检验二者是否存在时间依赖的权衡。

这个位置可能仍然不是最终创新,但它已经指出现有证据的具体不足、拟新增的比较和能够否定主张的结果。

建立创新性主张核验表

核验项宋遥的填写示例放行要求
当前主张现有研究缺少同一环境、同一时间轴上的双结局评价不使用“首次”,先描述具体不足
检索范围3个专业数据库;中文和英文同义词;种子论文前后向引文保存检索式、日期和限制
已有相近研究7篇相近功能研究,其中3篇涉及镁合金逐篇说明相似与不同,不只计数
真正差异同一试样、共同环境、多个降解阶段联合测量差异必须进入研究设计和结果
为什么重要分开测试可能掩盖性能权衡,影响材料评价说明会改变什么判断
可否证性若联合测量与分开测量结论一致,方法优势有限允许结果削弱创新主张
当前措辞“检验双性能在共同降解过程中的时间关系”避免夸大为全面突破

表中最重要的是“真正差异”和“可否证性”。如果所谓创新没有改变样本、测量、设计、分析或理论解释,只改变了标题措辞,它很可能不是研究创新。

用相似性比较,而不是只问“有没有人做过”

对每一篇最接近的研究,至少比较六项:研究对象、核心机制或干预、对照、测量、时间、分析或解释。AI 可以按固定字段提取候选差异,但原文必须由研究者核对。

维度已有研究拟研究差异是否产生新证据
对象其他金属或不同合金指定镁合金只有材料行为确实不同才有意义
环境腐蚀与抗菌分开测试共同模拟环境可能改变性能关系
时间单一终点多个降解阶段能观察权衡何时出现
指标各自独立报告预先定义联合评价必须避免随结果选择指标
解释强调双功能检验双功能是否可同时维持提供可被否定的主张

这种比较能发现两种相反情况:表面上题目相似,但研究证据确实不同;或者题目词语不同,核心设计其实只是重复。

检索不足时怎样表述

即使完成认真检索,也很难证明“世界上没有任何研究”。更稳妥的表达是说明核验范围和日期:

截至 2026 年 8 月 6 日,在已检索的数据库、检索式和引文追踪范围内,我们发现相关研究多将两类性能分开评价,尚未找到在相同试样与共同降解时间轴上报告二者关系的研究。

这句话允许别人复核,也承认检索范围。后续发现新论文时,可以更新判断,而不需要维护一个绝对的“全球首次”。

完整检索应由专业数据库和必要的信息专家支持。Cochrane 检索指南强调系统检索需要多来源、主题词与自由词结合,并保存可复现的策略;虽然普通创新性核验不必机械达到系统综述规模,但“一个关键词、一个数据库、一次聊天”显然不足以支持不存在性主张。

创新还要通过价值和可行性

文献差异本身不等于值得研究。一个从未有人比较过的无关变量组合,可能没有理论或实践意义。研究者要回答:差异为什么可能改变理解、决策或方法;得到阳性、阴性或不确定结果时,各自贡献什么;现有资源能否产生足够可靠的新证据。

如果项目只能重复已有方法,却样本更小、测量更弱、控制更少,“本地尚无”不能弥补证据质量下降。相反,一项复现研究即使不声称全新,也可能因验证稳健性、外部适用性或关键边界而具有明确价值。

什么时候应当降级或放弃创新主张

  • 最接近研究与拟研究在对象、方法、结局和解释上没有实质差异;
  • 差异只来自更换地点、模型名称或材料配方,无法说明为何改变结论;
  • 检索无法覆盖关键数据库、语言或旧术语,却要使用“首次”“尚无”;
  • 所谓空白来自论文报告不清,而拟研究也不能改善测量或设计;
  • 新问题需要的数据、样本或技术在当前项目中无法获得;
  • 研究结果无论怎样都被解释为支持创新,缺少可否证性。

降级并不等于项目失败。可以把“首次发现”改为“在明确情境中验证”“比较两种解释”或“用更透明的方法重新估计”。诚实、具体的贡献通常比不可核验的宏大创新更可信。

把“没有命中”变成可审查的检索结果

创新性判断中最有价值的产物,往往不是一句“尚无研究”,而是一份可重复的查找记录。至少要保存数据库、检索日期、概念组、完整检索式、筛选范围、相似研究和它们与当前方案的差异。AI 可以帮助扩展同义词和归纳差异,但实际命中记录必须来自可核验数据库。

假设团队最初用涂层商品名检索没有结果,AI 很容易回答“该材料组合从未用于此领域”。重新按材料通用名、化学组成、基底、性能指标和相邻应用拆分后,却找到三项高度相似研究:一项材料相同但基底不同,一项基底和指标相同但成分比例不同,另一项组合相同但只做了体外短期测试。此时真正可能成立的主张,是在特定基底、配比和长期条件下补充证据,而不是“首次提出这种材料”。

负面检索结果的强度取决于检索覆盖。只查一个综合搜索引擎,只能写“在本次有限检索中未识别到”;查过主要专业数据库、同义词、引文链、预印本和专利后,才可以更有把握地描述现有证据边界。即使如此,也应避免绝对的“世界首次”,除非目标传播场景确有充分依据且允许这种表述。

创新性结论应当能被反驳

一个可用的创新主张必须写出什么证据会推翻它。例如团队主张“现有研究没有同时评估长期腐蚀与细胞反应”,那么只要找到一项相同对象、相近材料、足够接近的条件并同时报告两类结局,主张就需要修改。若主张无论找到什么论文都能通过更换一个形容词继续成立,它只是包装,不是可检验判断。

在立项、写作和投稿前各复核一次创新性也很重要。领域会新增论文,研究方案也会改变。立项时成立的差异,可能在投稿时已有人发表;反过来,实际完成的实验也可能只支持更窄的贡献。更新时保留旧版本和变化原因,最终论文只陈述当前证据能够支持的研究位置。

可直接复用的创新性核验模板

候选研究问题:
AI最初生成的创新表述:

现有证据已经知道什么:
关键来源与证据位置:
仍然不确定什么:证据缺失/结果冲突/方法/情境/机制

检索数据库、语言、日期和限制:
同义词与旧术语:
最接近的3—8项研究:

拟研究与最接近研究的实质差异:
差异会带来什么可观察的新证据:
什么结果会削弱这项创新主张:

对理论、方法或实践的价值:
当前资源能否可靠回答:
允许使用的谨慎表述:
禁止使用的绝对表述:
下一次复核日期:

只有这份表能够由原始论文和真实研究设计支持,创新性文字才能进入开题报告或论文。AI 在这里负责扩展和比较,研究者负责证据范围、价值判断和最终承诺。