}

知识分子

2026年08月12日 07:59:27 来自湖南省

涉事文章。图源:PNAS

撰文|李想俣 梅宝

一个新的科研诚信问题,开始浮出水面。

(一)

上个月,《美国科学院院刊》(PNAS)发布撤稿声明,撤回了以色列阿里尔大学Iftach Shaked和特拉维夫大学Dan Frenke合作的一篇文章。

这篇被撤回的评论文章,题为“Curiouser and curiouser: Meningeal lymphoid structures in the aging brain”。该文发表于2025年9月29日,距离2026年7月6日撤稿也就九个多月。

撤稿原因是,作者在写作过程中使用生成式人工智能工具时,未核查AI生成内容,导致多篇虚构参考文献及违规AI生成图片出现在正式发表版本。

根据PNAS的撤稿说明,编辑部注意到文章存在不可验证的引用问题(unverifiable citations)。作者承认,他们使用Microsoft Copilot这个AI工具,将引用参考文献的PubMed ID自动转换为格式化的参考文献,但提交文章前并未核实。

经核查,文中列出的十几篇参考文献,大部分无法在公开数据库中检索到。该情况属于典型的AI幻觉,即凭空生成看似真实、实则并不存在的文献信息。

此外,作者使用生成式人工智能工具生成了文章中的图1。PNAS称,这同样违反期刊编辑政策。根据规定,作者需对生成式AI生成的内容负有全部责任,并需核实其准确性。除非软件本身属于研究对象,否则不应使用图像或图形生成的AI工具。

涉事文章的图1。图源:PNAS

值得注意的是,被撤回的并非原创研究论文,而是一篇学术评论文章(commentary)。这意味着,即便不涉及实验数据,学术出版对于AI辅助写作的真实性要求同样适用。

(二)

实际上,由于虚假文献引用,导致文章被撤稿的情况,这并不是第一次。

2025年12月15日,一篇题为“Forty Years of Fertility Transition in Hong Kong”(香港四十年生育率变迁)的论文被撤。该论文第一作者为香港大学社会工作及社会行政学系博士生白逸铭,通讯作者为叶兆辉教授,两个月前发表在Springer Nature旗下期刊《China Population and Development Studies》(中国人口与发展研究)。

论文被撤的原因是,部分引用文献系AI虚构生成。香港大学当时对媒体透露,叶兆辉已卸任社会科学学院学院副院长及研究事务相关职务,叶兆辉还向相关期刊申请撤稿,涉事博士生也会按港大既定纪律程序处理。

2026年5月28日,英国医学杂志(BMJ)出版集团旗下的《The Journal of Medical Ethics》(医学伦理学杂志)也撤回了一篇AI虚构参考文献的论文。

据《撤稿观察》(Retraction Watch)报道,该论文只有一位作者:美国高中生Irfan Biswas,他在论文中的署名机构是马萨诸塞州Shrewsbury公立学校。这篇2025年9月刊发的论文提出,有偏见的算法会加剧医疗领域的不平等问题。期刊后来调查确认,作者使用生成式人工智能来 “查找并理解引用文献来源”,而且在投稿前未核验参考文献。

这样一篇论文,为什么能被“医学伦理领域的国际领先期刊”接受?期刊撤稿通知透露,相关证据显示存在“同行评审操纵”。但该期刊拒绝给出细节。

(三)

撰写学术论文时,在参考文献和注释中引用已有研究成果是基本规范。然而,随着越来越多科研人员借助AI梳理文献、润色表达乃至辅助写作,凭空捏造参考文献的事情出现了。

《知识分子》此前曾报道,哥伦比亚大学马克西姆·托帕兹(Maxim Topaz)教授及其同事今年5月在《柳叶刀》(Lancet)发表研究,针对2023年1月至2026年2月收录于PubMed Central开放获取数据库的250万篇生物医学论文,共筛查1.2亿条参考文献,发现了4046条虚假引用。这些虚假引用分布在2810篇论文中,其中综述类文章的虚假引用比例,高于研究类论文(参见文章:学术不端的新战场?过去三年,生物医学论文“虚假引用”上涨了十几倍。)

图源:Lancet

更值得关注的是,虚假引用现象正快速增长。根据上述研究,2023年每2828篇论文中有一篇存在虚假引用;到2025年这一比例上升至每458篇论文中有一篇;2026年前七周,每277篇论文中有一篇。不到三年时间,存在虚假引用的论文比例,从万分之四飙升至万分之57,上涨了十几倍。

这一趋势很可能与生成式AI在科研中的快速普及有关。不过,研究者强调,AI只是工具,责任并不在AI本身。《柳叶刀》同期评论文章中,波士顿大学医学院霍华德·鲍赫纳(Howard Bauchner)指出,虚假引用的责任应该由作者来承担。如果发现某篇论文中存在伪造的参考文献,那么该论文就应被撤回。编造参考文献属于学术不端行为,理应受到相应的严肃处理。

然而,截至《柳叶刀》那项研究发表时,98.4%的涉事论文既未撤稿,也未更正。

对此,托帕兹等人建议,出版商应在同行评议前引入自动化参考文献核查系统,为论文建立引用完整性标识,并对存在虚假引用且影响论文结论的文章及时发布更正或撤稿声明。同时,研究诚信数据库也应将“虚假引用”作为独立类别来记录和追踪。

国际学术出版商们态度是怎样的呢?据STAT当时报道,《科学》(Science)系列期刊发言人表示,已经在使用自动化工具来核查参考文献,目前还未在其期刊发现任何一篇发表论文存在虚假引用的问题。《新英格兰医学杂志》(NEJM)和《美国医学会杂志》(JAMA)发言人则称都有相应工具来验证引用信息。出版商PLOS的伦理负责人雷内·霍赫(Renee Hoch)则说,“我们希望将自动化核查工具融入到出版工作中,目前正在探索相关解决方案。”

除了制度建设,更值得思考的是,生成式AI正在如何改变科研人员与文献之间的关系,如何改变科研生态。

美国西北大学研究科研诚信与AI应用伦理的穆罕默德·侯赛尼(Mohammad Hosseini)对STAT表示,“如今人们只是凭直觉给ChapGPT或其他AI工具输入提示词,然后得到一堆引用文献,随意添加在论文里......这对研究人员、学术出版方式以及社会都没有好处。”

《美国科学院院刊》此次撤稿,再次释放出一个信号:生成式人工智能工具,在助力科研的同时,也可能助长新的学术不端行为。而学术诚信的底线,不应因为技术手段的进步而降低。