核心结论
AI 不能证明一个选题“有创新”。它可以帮助扩大检索语言、比较研究设计和整理已有证据,但创新性必须建立在可复核的文献范围、明确的差异和真实研究价值上。“没有搜到相同标题”“某地区研究较少”或“把两个热门词组合起来”,都不足以构成研究空白。
更可靠的做法是把创新性主张拆成三部分:现有研究已经知道什么;仍然不知道或不能确定什么;拟开展的研究将用什么新证据减少这项不确定性。三部分都能对应到来源、方法和可交付结果时,才形成可辩护的研究位置。
研究空白不是一个固定类别
“研究较少”把完全不同的问题混在一起。至少应区分五类空白:
- **证据缺失:**关键对象、结局或情境几乎没有直接研究;
- **结果冲突:**研究存在,但方向、效应或解释不一致;
- **方法缺口:**问题被研究过,但测量、设计、样本或分析不足以支持当前结论;
- **情境缺口:**证据集中在特定地区、人群、材料或制度,外部适用性不清;
- **机制缺口:**现象已经观察到,但过程、边界条件或替代解释尚未被区分。
这些空白需要不同研究。结果冲突不一定需要再做一个相同横断面研究,可能需要统一测量、提高样本质量或解释异质性;情境缺口也不能仅靠“换一个城市再做一次”成立,必须说明新情境为什么会改变机制、实施或结果。
AI最容易制造的三种伪创新
第一种是词语创新。模型把“数字化”“智能化”“多模态”等词加到普通问题上,标题看起来新,研究关系却没有改变。
第二种是地点创新。只因为在当前检索中没有发现某所学校或某个城市的研究,就声称填补地区空白。地点只有在制度、人口、资源或环境差异可能改变结论时,才具有研究意义。
第三种是检索盲区创新。研究者只用一个中文关键词或一个数据库,AI 没找到结果,就判断“尚无研究”。相同概念可能使用不同术语,早期研究可能不含当前流行词,相关证据也可能出现在邻近学科和引文网络中。
所以,AI 生成的任何“首次”“尚无”“从未”“填补空白”表述,默认都应视为待核验主张。
教学案例:一种复合涂层真的有创新吗
**教学模拟案例:**材料学博士生宋遥计划研究一种含天然提取物的可降解镁合金涂层。AI 根据她提供的材料名称生成了“首次构建兼具耐腐蚀与抗菌功能的绿色复合涂层”这一创新表述。
宋遥没有直接采用,而是把主张拆开:
- “首次构建”要求证明此前不存在功能和构成相近的工作;
- “兼具耐腐蚀与抗菌”要求已有研究没有同时可靠评价两类结局;
- “绿色”需要明确材料来源、制备过程和环境评价,不能只是天然成分;
- 新涂层还要解释为什么相对于已有涂层能增加科学认识,而不只是换一种配方。
她先让 AI 从已确认的种子论文生成同义词和上位概念,再在专业数据库中运行检索,并沿种子论文的参考文献和被引文献追踪。得到的结果显示:相近提取物已经用于其他金属,兼顾两类功能的涂层也存在,但在镁合金降解环境中,抗菌结果常在与腐蚀测试不同的介质和时间尺度下报告,难以判断两种性能能否同时保持。
于是创新主张从“首次绿色复合涂层”改成了一个可检验的位置:在同一模拟生理环境和预先定义的降解阶段,联合评价涂层的腐蚀变化与抗菌表现,并检验二者是否存在时间依赖的权衡。
这个位置可能仍然不是最终创新,但它已经指出现有证据的具体不足、拟新增的比较和能够否定主张的结果。
建立创新性主张核验表
| 核验项 | 宋遥的填写示例 | 放行要求 |
|---|---|---|
| 当前主张 | 现有研究缺少同一环境、同一时间轴上的双结局评价 | 不使用“首次”,先描述具体不足 |
| 检索范围 | 3个专业数据库;中文和英文同义词;种子论文前后向引文 | 保存检索式、日期和限制 |
| 已有相近研究 | 7篇相近功能研究,其中3篇涉及镁合金 | 逐篇说明相似与不同,不只计数 |
| 真正差异 | 同一试样、共同环境、多个降解阶段联合测量 | 差异必须进入研究设计和结果 |
| 为什么重要 | 分开测试可能掩盖性能权衡,影响材料评价 | 说明会改变什么判断 |
| 可否证性 | 若联合测量与分开测量结论一致,方法优势有限 | 允许结果削弱创新主张 |
| 当前措辞 | “检验双性能在共同降解过程中的时间关系” | 避免夸大为全面突破 |
表中最重要的是“真正差异”和“可否证性”。如果所谓创新没有改变样本、测量、设计、分析或理论解释,只改变了标题措辞,它很可能不是研究创新。
用相似性比较,而不是只问“有没有人做过”
对每一篇最接近的研究,至少比较六项:研究对象、核心机制或干预、对照、测量、时间、分析或解释。AI 可以按固定字段提取候选差异,但原文必须由研究者核对。
| 维度 | 已有研究 | 拟研究 | 差异是否产生新证据 |
|---|---|---|---|
| 对象 | 其他金属或不同合金 | 指定镁合金 | 只有材料行为确实不同才有意义 |
| 环境 | 腐蚀与抗菌分开测试 | 共同模拟环境 | 可能改变性能关系 |
| 时间 | 单一终点 | 多个降解阶段 | 能观察权衡何时出现 |
| 指标 | 各自独立报告 | 预先定义联合评价 | 必须避免随结果选择指标 |
| 解释 | 强调双功能 | 检验双功能是否可同时维持 | 提供可被否定的主张 |
这种比较能发现两种相反情况:表面上题目相似,但研究证据确实不同;或者题目词语不同,核心设计其实只是重复。
检索不足时怎样表述
即使完成认真检索,也很难证明“世界上没有任何研究”。更稳妥的表达是说明核验范围和日期:
截至 2026 年 8 月 6 日,在已检索的数据库、检索式和引文追踪范围内,我们发现相关研究多将两类性能分开评价,尚未找到在相同试样与共同降解时间轴上报告二者关系的研究。
这句话允许别人复核,也承认检索范围。后续发现新论文时,可以更新判断,而不需要维护一个绝对的“全球首次”。
完整检索应由专业数据库和必要的信息专家支持。Cochrane 检索指南强调系统检索需要多来源、主题词与自由词结合,并保存可复现的策略;虽然普通创新性核验不必机械达到系统综述规模,但“一个关键词、一个数据库、一次聊天”显然不足以支持不存在性主张。
创新还要通过价值和可行性
文献差异本身不等于值得研究。一个从未有人比较过的无关变量组合,可能没有理论或实践意义。研究者要回答:差异为什么可能改变理解、决策或方法;得到阳性、阴性或不确定结果时,各自贡献什么;现有资源能否产生足够可靠的新证据。
如果项目只能重复已有方法,却样本更小、测量更弱、控制更少,“本地尚无”不能弥补证据质量下降。相反,一项复现研究即使不声称全新,也可能因验证稳健性、外部适用性或关键边界而具有明确价值。
什么时候应当降级或放弃创新主张
- 最接近研究与拟研究在对象、方法、结局和解释上没有实质差异;
- 差异只来自更换地点、模型名称或材料配方,无法说明为何改变结论;
- 检索无法覆盖关键数据库、语言或旧术语,却要使用“首次”“尚无”;
- 所谓空白来自论文报告不清,而拟研究也不能改善测量或设计;
- 新问题需要的数据、样本或技术在当前项目中无法获得;
- 研究结果无论怎样都被解释为支持创新,缺少可否证性。
降级并不等于项目失败。可以把“首次发现”改为“在明确情境中验证”“比较两种解释”或“用更透明的方法重新估计”。诚实、具体的贡献通常比不可核验的宏大创新更可信。
把“没有命中”变成可审查的检索结果
创新性判断中最有价值的产物,往往不是一句“尚无研究”,而是一份可重复的查找记录。至少要保存数据库、检索日期、概念组、完整检索式、筛选范围、相似研究和它们与当前方案的差异。AI 可以帮助扩展同义词和归纳差异,但实际命中记录必须来自可核验数据库。
假设团队最初用涂层商品名检索没有结果,AI 很容易回答“该材料组合从未用于此领域”。重新按材料通用名、化学组成、基底、性能指标和相邻应用拆分后,却找到三项高度相似研究:一项材料相同但基底不同,一项基底和指标相同但成分比例不同,另一项组合相同但只做了体外短期测试。此时真正可能成立的主张,是在特定基底、配比和长期条件下补充证据,而不是“首次提出这种材料”。
负面检索结果的强度取决于检索覆盖。只查一个综合搜索引擎,只能写“在本次有限检索中未识别到”;查过主要专业数据库、同义词、引文链、预印本和专利后,才可以更有把握地描述现有证据边界。即使如此,也应避免绝对的“世界首次”,除非目标传播场景确有充分依据且允许这种表述。
创新性结论应当能被反驳
一个可用的创新主张必须写出什么证据会推翻它。例如团队主张“现有研究没有同时评估长期腐蚀与细胞反应”,那么只要找到一项相同对象、相近材料、足够接近的条件并同时报告两类结局,主张就需要修改。若主张无论找到什么论文都能通过更换一个形容词继续成立,它只是包装,不是可检验判断。
在立项、写作和投稿前各复核一次创新性也很重要。领域会新增论文,研究方案也会改变。立项时成立的差异,可能在投稿时已有人发表;反过来,实际完成的实验也可能只支持更窄的贡献。更新时保留旧版本和变化原因,最终论文只陈述当前证据能够支持的研究位置。
可直接复用的创新性核验模板
候选研究问题:
AI最初生成的创新表述:
现有证据已经知道什么:
关键来源与证据位置:
仍然不确定什么:证据缺失/结果冲突/方法/情境/机制
检索数据库、语言、日期和限制:
同义词与旧术语:
最接近的3—8项研究:
拟研究与最接近研究的实质差异:
差异会带来什么可观察的新证据:
什么结果会削弱这项创新主张:
对理论、方法或实践的价值:
当前资源能否可靠回答:
允许使用的谨慎表述:
禁止使用的绝对表述:
下一次复核日期:
只有这份表能够由原始论文和真实研究设计支持,创新性文字才能进入开题报告或论文。AI 在这里负责扩展和比较,研究者负责证据范围、价值判断和最终承诺。