2025年12月PubMed收录的论文全文中,AI使用率可能高达90%
「“10”光列车,科研探索之旅」抽大奖!>>
人工智能(AI)工具在科研论文写作中的应用,可能远比此前认为的更为普遍。最近一项研究估计,2025年12月被收录入PubMed全文数据库中的论文,近九成显示出AI辅助写作的迹象。
该研究于2026年8月12日发布于预印本平台arXiv[1],尚未经过同行评审。结果显示,PubMed Central全文库中收录的2025年全年发表的论文中,AI大语言模型(LLM)的使用率达77%,2024年发表的论文中,这一比例为52%,表明LLM使用呈上升趋势。(注:该研究仅纳入英文论文)
arXiv上研究的链接:https://arxiv.org/abs/2608.10715
该研究得出的数值明显高于此前对学术文献中LLM使用率的估计。2025年一篇论文曾分析PubMed中的论文摘要(而非全文),估算2024年LLM的使用率至少为13.5%[2]。2026年一项跨多个学科的研究估计,2025年论文中约57%可能使用过AI[3]。
2026年的预印本研究和2025年论文有部分作者是相同的,其中一位共同作者Dmitry Kobak表示,他最初对2026最新研究得到的结果持怀疑态度:“我们当时认为是哪里做错了。”但进一步的核查使他相信该数据是可靠的。
这项最新研究是通过分析LLM常用词汇的频率来检测其在论文中的使用痕迹。Kobak将最新研究得到了更高数值归因于其团队采用的特殊方法,该方法对检测LLM的使用更为敏感,因此更可能得出更高的数值。该方法直接估算AI使用率而非仅给出下限值,也将2024年摘要的LLM使用率从13.5%提升至31%。
作者还指出,这些数据与2025年一项调查的结果一致[4],该调查中,71%的研究人员表示使用过AI来辅助写作,但真实数字可能高于他们在调查中报告的数值。
摘要与方法使用AI的差异
2026年这项最新的预印本研究还发现,摘要、前言和讨论部分中LLM的使用率高于方法和结果部分。2025年12月的论文中,约78%的讨论部分显示出AI痕迹,结果部分则为58%。Kobak表示,AI辅助撰写结果部分会令人担忧,因为LLM可能捏造数据或出现幻觉。
当前AI检测方法的一个问题是,它们无法区分完全由AI生成的文本和仅经过语法润色的文本。这使得期刊更难筛选低质量AI内容,因为所有AI辅助论文都会表现出相似的特征,无论LLM实际参与了多少写作工作。
2026年的这项最新研究还发现,当论文作者来自非英语母语国家时,LLM的使用更为普遍。这不难理解,因为LLM常被非英语母语者用于翻译和语法润色。为区分AI的合理使用与AI生产的低质内容,许多期刊现要求研究人员在投稿中声明AI的使用方式。
该研究的第一作者建议,对思想反复推敲并将其成文是科学过程的重要组成部分,完全依赖LLM完成写作则会剥夺这一重要思考过程。
探讨“AI在医学研究领域的应用”的文章频频见刊,部分期刊已经对AI的使用进行了规范。感兴趣的小伙伴可以阅读小咖既往整理文章:
参考文献:
1. Preprint at arXiv. 2026. https://doi.org/10.48550/arXiv.2608.10715
2. Sci Adv. 2025 Jul 4;11(27):eadt3813.
3. Proc Natl Acad Sci U S A. 2026;123(22):e2605754123.
4. https://www.wiley.com/content/dam/wiley-com/en/pdfs/about/wiley-explanaitions-2025-the-evolution-of-ai-in-research.pdf
本文整理自Nature一篇报道:https://www.nature.com/articles/d41586-026-02551-z
