作者:王方 来源: 中国科学报 发布时间:2026-8-31
选择字号:
大量生物医学论文存在AI辅助迹象

 

论文的摘要、引言与讨论部分检出AI使用痕迹的比例高于结论部分。图片来源:Laurence Dutton

本报讯 借助人工智能(AI)工具撰写科学论文的现象,可能比之前人们认为的更为普遍。一项近日公布于预印本平台arXiv的研究估计,一个大型生物医学文献数据库收录的2025年12月发表的论文中,有近九成都存在AI辅助写作的迹象。

研究表明,在PubMed Central数据库收录的论文中,2025年全年发表的论文的大语言模型(LLM)使用率为77%,而这一比例在2024年为52%,表明LLM的使用率呈上升趋势。

这一数字远高于以往对科学文献LLM使用情况的估计。研究人员在2025年发表的一篇论文中分析了PubMed中的论文摘要而非全文,认为2024年的LLM使用率至少为13.5%。此外,2026年一项覆盖多学科的研究推断,2025年发表的论文约有57%可能受到AI的影响。

这项新研究的作者、比利时根特大学的Dmitry Kobak表示,最初对这个计算结果表示怀疑,“当时认为我们哪里算错了”。但反复核验之后,他确信数据是站得住脚的。

和许多之前的研究一样,该研究通过分析LLM常用词汇的出现频率来检测它们在论文中的使用痕迹。Kobak认为更高的比例源于团队采用的一套检测方法对LLM的使用更为敏感,因此得到的数字更大。这套方法可以直接估计AI的使用情况,而不是给出下限。它将2024年论文摘要的LLM使用率从13.5%提升至31%。

作者还指出,该数据与2025年的一项调查结果相吻合,即71%的研究人员表示会借助AI辅助写作,而真实使用率可能会高于受访者在调查中承认或报告的。

其他研究人员表示,考虑到LLM的广泛应用,该研究得出的高使用率是有道理的。加拿大多伦多大学的Kyle Siler认为,结果表明LLM将继续存在。但他们同时提醒说,这项研究的数据可能无法代表全部科学文献,还需要进行更多分析才能全面掌握整体使用情况。

该研究还发现,相较于方法、结论部分,LLM在摘要、引言、讨论部分使用的频率更高。在2025年12月发表的论文中,78%的讨论部分检出AI痕迹,而结论部分为58%。

Kobak指出,结论部分由AI辅助完成可能令人担忧,因为LLM有编造数据,也就是产生“幻觉”的可能性。与此同时,用LLM撰写、修改引言,有可能扭曲一个领域的主流学术观点。“LLM自带的任何偏见都会渗透到学术文献中。”

英国伦敦大学学院的Andrew Gray指出,目前AI检测工具存在一个缺陷,即无法区分完全由AI生成的文本和仅由AI润色的文本。“这就导致期刊很难筛选出低质量的AI生成内容,因为无论LLM实际完成了多少写作工作,所有AI辅助的论文都会呈现相似的文本特征。”

该研究发现,当作者来自非英语国家时,LLM的使用更为普遍。Kobak说:“这并不意外。母语非英语的研究者常会借助LLM翻译文本、打磨语法。”Siler则提出,未来的研究不能只关注谁在用LLM,更要聚焦人们如何使用它们。

为区分是合理使用AI还是制造AI垃圾,许多期刊现在要求作者在投稿时说明AI的使用方式与场景。论文第一作者、德国图宾根大学的Lena Holzwarth提醒科研人员,使用这类工具仍需谨慎。“思考并将其落实为文字是科研过程不可或缺的一环,而完全依赖LLM写论文则会舍弃这一关键步骤。”(王方)

相关论文信息:

https://doi.org/10.48550/arXiv.2608.10715

《中国科学报》 (2026-08-31 第2版 国际)
 
 打印  发E-mail给: 
    
 
相关新闻 相关论文

图片新闻
罗曼太空望远镜将对宇宙进行全景式观测 NASA放弃空间望远镜救援任务
最快恒星或能揭示银河系巨型黑洞的自旋 科学家实验观测到真空涨落对超导增强效应
>>更多
 
一周新闻排行
 
编辑部推荐博文