如果审稿人发现伪造引文会发生什么
对不存在来源的引用不是格式问题。这是伪造,期刊现在会在论文进入印刷之前就对其进行检查。以下说明虚假引文如何进入稿件,编辑在 DOI 无法解析时会怎么做,Committee on Publication Ethics 规定的流程,以及论文之后实际会发生什么,从静默更正到公开撤稿。
编辑在检查一篇已被接受稿件的参考文献表时,将其第23条引文的 DOI 粘贴到浏览器中,结果得到一个页面,显示该标识符不存在。该参考文献看起来很真实, 一个看似合理的期刊, 一个看似合理的年份, 三个看似合理的作者姓氏。它并未关联到任何数据库曾经索引过的内容。该稿件距离印刷还有两周。
一个无法解析的 DOI,通常是编辑最终会归类为捏造引文的学术不端的第一个迹象,而不是在校样中悄悄修正的格式错误。指向不存在来源的参考文献,与捏造数据和伪造结果一样,处在期刊实际使用的严重程度等级中,远高于页码错误或首字母缺失,而审稿人如今会在稿件到达那个阶段之前就专门检查这一点。
本文从审稿人的角度沿着这一路径展开, 一条捏造的参考文献最初如何进入稿件, 一旦 DOI 无法解析,编辑会做什么, Committee on Publication Ethics 规定的流程, 以及之后论文实际上会发生什么。TextPulse 的 关于大学和期刊如何制定 AI 政策的指南 说明了旨在在提交前阻止这一问题的披露规则。本文则从这些规则已经失效之后开始。
捏造引文如何进入稿件?
几乎从不会是从头刻意编造出来的。作者在使用 AI 工具撰写文献综述时,请它总结某一主题的研究,工具便返回一段附有引文的文字,因为对模型来说,听起来合理的参考文献,是预测下一个最可能词语时所呈现的学术写作模式的一部分。该参考文献具有真实文献的外形, 一个有名有姓的作者, 一个真实的期刊标题, 一个处于合理范围内的年份。只是它并不指向任何曾经发表过的内容。
作者将段落复制进去,因周围文字看起来写得很得体而信任该引文,却从未打开来源核实其是否存在。时间压力解释了随后大多数情况的发生方式, 参考文献表通常是提交前最后检查的内容,而不是最先检查的内容,而在九十条真实条目中夹着一条伪造条目,在一次主要关注论证和结构而非每条脚注的通读中很容易被忽略。在提交前将完整的参考文献表交给 an AI citation checker 运行,可以在审稿人需要把 DOI 粘贴到浏览器之前,发现其中相当一部分问题。
模型为何以及如何首先编造出看似合理的来源,本身就是另一个问题,且有其自身的机制。TextPulse 关于 ChatGPT 是否编造参考文献的 说明文章,对这一部分的展开比本文所需更为详细。
伪造引文是否属于学术不端?
是的,期刊并不把它视为格式问题。研究不端通常分为捏造、篡改和剽窃,而对一个并不存在的来源作出引用,属于前两者中的第一类, 也就是引文本身是被编造出来的,而它的存在歪曲了文本中其上方论证实际依赖了哪些证据。这使伪造引文与编造数据属于同一类别,而不是与缺少逗号或不一致的标题格式并列。
Elsevier 自身的政策对任何使用 AI 辅助撰写的人都明确说明了这一点, 生成式工具可以帮助处理结构和语言,但捏造或修改数据或参考文献被列为禁止用途,对于最终被证明是编造而非修改的参考文献,并没有设立更轻的类别。Wiley、Springer Nature 和 Taylor and Francis 在各自的作者指南中也都划出了同样的界线。审稿人现在正是检查这一点,而一个无法解析的 DOI 通常就是暴露伪造参考文献的第一处线索。
将你自己的论文人性化
改写你的 AI 辅助文本,使其听起来更像人工撰写,同时不改动重要词语或引文。
当审稿人无法解析 DOI 时会发生什么?
这个机械性检查非常简单,少于一分钟即可完成, 将 DOI 粘贴到 doi.org 中,查看它指向何处。当 DOI 指向一个未找到页面,或者指向与所引文献完全不同的文章时,这就是一个强烈信号,表明该引文从未真实存在,尤其是在它位于由 AI 工具参与起草的参考文献列表中时。
单个失效的 DOI 本身并不会终结稿件的机会,因为真实的标识符偶尔确实会被误写。真正改变处理方式的是规模和模式。一个失效的参考文献通常会引发对作者的询问,要求提供更正后的 DOI 或原始来源。同一参考文献列表中出现多个失效参考文献,尤其是那些集中出现在快速写成的文献综述部分中的条目,会被从常规询问升级为编辑在决定进一步处理之前执行的那类引文完整性检查。
编辑遵循的 COPE 流程
COPE, the Committee on Publication Ethics 为编辑提供了一种结构化方式,用来权衡引文问题,而不是依赖单一固定规则。其关于引文完整性的指导列出了编辑在决定下一步之前应当权衡的四个因素。
- 性质: 该参考文献是部分真实还是完全伪造
- 位置: 它位于论文中的什么地方,例如元分析中,或单独的讨论段落中
- 类别: 它是一个无法找到的参考文献,还是一个真实存在但被引用来支持其实际上并未陈述内容的文献
- 规模: 受影响的是一两个参考文献,还是整个列表中的很大一部分
编辑如何权衡这四个因素,决定哪一种回应更合适, 是直接更正, 在调查进行期间发表关注声明, 或者, 对于最严重的情形, 直接联系作者所在机构。COPE 对于为什么 AI 工具不能承担责任所给出的理由, 与其通常适用于作者身份的理由相同, 即, 已提交稿件的责任属于署名作者, 他们在提交稿件的那一刻就接受了这份责任, 而不是属于在起草段落过程中提供帮助的任何工具。
“模型编造了它”解释了一个伪造的参考文献是如何进入稿件的。它并不能成为借口。每家出版机构的投稿流程都要求通讯作者确认稿件准确无误并对其内容负责, 这正是把 AI 工具的错误转化为作者自身错误的那一步。
TextPulse 自己的 AI 辅助学术写作伦理界限指南 也阐明了同样的责任原则, 即, 披露和核实发生在投稿之前, 而不是在审稿人发现缺口之后。
从更正到撤稿, 论文实际上会发生什么
更正是最轻的结果。出版机构会发布一则说明, 修正具体的参考文献, 论文本身保持不变, 已发表记录会准确显示哪些内容发生了变化以及原因。通常, 当一条伪造引文出现在不影响论文实际发现的部分, 且作者配合并提供真实来源, 或删除其所支撑的主张时, 结果就会落到这一层面。
在这一谱系的另一端,是撤稿。COPE 关于撤稿的最早一套指南,也把捏造和篡改列为撤回论文的明确理由之一,此外还有剽窃以及发现不可信的结果。这个过程不会悄然消失。被撤稿的论文仍然可见,期刊本身以及其他研究者使用的索引中都会将其标记为已撤稿。这就是为什么伪造参考文献代价如此高昂, 更正是永久且公开的,并且只要论文仍然可被检索到,就会附着在作者姓名上。
披露是实际的防御,而如何在论文中披露 AI 使用已另行说明,同时还有披露声明模板,你可以据此修改,而不是从头起草。
核查参考文献过去是审稿人工作中最不引人注意的部分,只是在真正的批评开始之前走个形式。一个无法解析的 DOI 已经把它变成了相反的东西, 它往往是最快、最清晰的信号,表明一篇稿件需要比其余部分更仔细得多地阅读。
常见问题
是。编辑将其归类为伪造引文学术不端,而不是格式失误,因为对不存在来源的引用属于捏造,与捏造数据同属一大类。审稿人和编辑现在会专门检查 DOI 和来源细节,因为 AI 起草工具会相当频繁地引入捏造参考文献,以至于在稿件进入印刷之前核实每一条引文已成为常规做法。
Content planner and copywriter at TextPulse. Sara runs the blog day to day, from planning and drafting through to publishing. She writes the practical guides: clear explanations of academic writing problems, aimed at the person who actually has to hand something in.