可以用AI写论文吗?《自然》调查了5000人,90%同意,但只有1/3真的这么做了|《自然》长文
本篇《自然》评论共4669字,干货满满,预计阅读时间15分钟,时间不够建议可以先“浮窗”或者收藏哦。
原文作者:Diana Kwon
对5000名研究人员的调查显示,对于哪些情况下使用AI是可接受的、哪些使用情况是需要披露的,研究人员的观点大相径庭。
插图:Acapulco Studio
人工智能(AI)革命对科学的传播过程造成了多大影响?随着ChatGPT等生成式AI工具迅速演进,对于其在学术论文写作中的使用,人们的态度也在随之变化。提示AI使用的论文迅速增多 (参见D. Kobak et al. Preprint at arXiv https://doi.org/pkhp; 2024),由此引发了关于剽窃等学术伦理方面的问题。
为了解研究人员对这一问题的看法,《自然》对全球各地的5000名学者进行了调查,了解在哪些情况下,使用AI被视为是伦理上可接受的。
调查显示,一些研究者虽认为某些做法合适,但所想和所为却千差万别。研究人员普遍认为用AI聊天机器人辅助写作论文可以接受,但较少有人报告自己确实为此使用了AI——而这样做的研究人员往往表示,他们并未披露这一点。
此前已有多项调查显示,研究人员还会使用生成式AI辅助写代码、讨论研究灵感等工作。对于一些使用AI的情况,大部分学界人士已达成一致意见,或认为合情合理,或认为不可接受(如用AI生成图像)。《自然》的最新调查聚焦于论文的写作和评审——这两方面的伦理准则尚未如此鲜明。
意见分歧
《自然》的调查虚构了一位名为“Bloggs博士”的研究人员,列出了其使用AI但未加以披露的若干种情况,如生成论文初稿、编辑自己写出的论文稿、加工论文的特定部分、翻译论文等。此外,调查列举的情况还包括Bloggs博士在审稿时用AI撰写同行评审意见、从AI获取对稿件的意见等。(调查的完整内容、数据和方法参见补充信息;读者也可尝试回答部分调查问题)。
调查询问受访人各种使用AI的情况是否可接受,以及自己是否如此使用过或愿意如此使用AI。不过,调查并未告知受访人期刊政策,这是为了得出研究人员的内心看法。调查采用匿名形式进行。
《自然》在2025年3月联系了参与调查的5229名受访人,联系途径包括随机选取世界各地新近发表论文的作者发送邮件、选取施普林格·自然(Springer Nature)市场调查作者库和审稿人库的部分成员、通过《自然》每日简讯发送邀请等。由于回复偏好无可避免,该调查的受访人并不必然能代表研究人员的普遍看法。但是,受访人的确来自全球各地——例如,在报告了国家信息的受访人中,21%来自美国,10%来自印度,8%来自德国;不仅如此,受访人的职业生涯阶段、研究领域也较为多样。(但是,此次调查未能充分反映中国论文作者的看法,主要原因是许多中国作者并未回复邮件邀请。)
调查结果显示,当下学界对AI使用问题意见不一,有时甚至分歧严重。大多数受访人(90%以上)认为运用生成式AI编辑或翻译论文可以接受,但对于是否需要披露AI使用、需以何种形式披露AI使用意见不一——例如,是简单说明使用了AI即可,还是需要详细说明向AI输入了哪些提示词。
而对于使用AI生成文本——如写作论文全文或部分内容,受访人的分歧更为明显。大体上,多数受访人(65%)认为这在伦理上可以接受,但约1/3的受访人表示反对。
在使用AI起草论文特定部分的问题上,多数研究者认为用AI起草“摘要”可以接受;但对于用AI起草其他部分,反对的人更多。
出版界一般都认为,在学术写作中使用AI生产实质内容的情况应当披露。虽然如此,但美国路易斯维尔大学的研究文献读写传播导师Alex Glynn指出,根据《自然》调查收到的回答,研究人员的看法并非完全一致。“这种隔膜是说明研究人员对这一问题缺乏了解,还是说明研究人员与出版界有着道德准则上的分歧呢?”
对于用AI生成同行评审意见的初稿,研究人员更不赞成——60%以上的受访人认为这种做法不恰当(其中约1/4是出于隐私问题)。但多数受访人(57%)认为,让AI以回答相关问题的形式辅助同行评审,是可以接受的做法。
“让AI写审稿意见不被大家接受,这让我很欣慰;但我更惊讶的是,居然有这么多人认为审稿人借助AI辅助也是不可接受的。”Chris Leonard说。Chris Leonard是一位学术传播顾问,在其通讯简报Scalene中报道了AI与同行评审问题的进展。(Leonard也在印度跨国公司Cactus Communications担任产品解决方案主管。)“人机结合审稿,可以完美发现审稿人忽略的地方。”
AI使用仍是小众行为
总体上,只有极少研究人员表示,确实曾在《自然》列出的各种情况下使用过AI。AI用得最多的情况是论文编辑,但也只有约28%受访人表示曾这样做过(不过,另有43%的受访人表示愿意这样做)。至于用AI写作初稿、生成其他文献的概述用于本人论文、翻译论文、辅助审稿等做法,使用过AI的受访人比例更少,只有8%左右。
插图:Acapulco Studio
总体上,约65%受访人表示从未在调查列出的任何情况下使用过AI,不过处于生涯较早阶段的受访人中,更大一部分人在至少一种情况下使用过AI。不过,在报告使用过AI的受访人中,多数人表示当时并未披露使用AI的情况。
“这些结果印证了我们从研究人员那里听到的反馈——人们使用AI辅助研究过程的热情很高,但实际上用得很少。”跨国学术出版公司威立(Wiley)高级副总裁Josh Jarrett说道。威立也调查过研究人员使用AI的情况。
看法分歧
此次调查中,受访人可以留言说明自己的看法;结果显示,研究者的看法相当不一致。一方面,有人表示,生成式AI工具已经很广泛了,所以根本没必要披露使用情况。“使用AI将会是——或者说已经是——像使用计算器一样的惯例了。”泰国朱拉隆功大学生物医学学者Aisawan Petchlorlian说,“‘披露与否’将不再重要。”
另一方面,一些人认为使用AI是无论如何不能接受的。“我绝不会容忍用生成式AI写作或评审论文的行为,欺骗和弄虚作假是可悲的。”一位加拿大的地球科学学者说。
其他人的态度则更模糊一些。例如,在英国剑桥大学研究传染病的Daniel Egan认为,虽然AI能节省时间,而且极其擅长把来源多样的复杂信息整合起来,但过度依赖AI就像是自我欺骗。“我们使用AI时,也就剥夺了自己的学习机会:各环节的工作有时很累人,但亲自去做能学到东西。”
受访人也表示了种种担忧,从关于剽窃、破坏信任等方面的伦理问题,以及发表和同行评审机制的问责问题,到对AI影响环境的担忧。
一些人表示,他们虽然基本认同使用AI工具符合伦理,但从亲身使用的经验看,AI产出的结果往往不如人类——虚假的参考文献、不准确的陈述,甚至用某位受访人的话说,“一本正经地胡说八道”。受访人还注意到,使用不同AI工具,得到的回答质量可能会有很大差别。
当然也有积极的看法:许多受访人指出,AI能够帮助英语非母语的学者更公平地开展研究活动。
还有一些学者解释了他们赞成一些使用AI的情况,而认为另一些情况不可接受的原因。“我会使用AI在西班牙语和英语之间自动互译,再精细编辑译文文本,但我绝不会用AI起草文章,因为我享受写作、编辑和评审的过程。”西班牙的一位人文学科研究人员如是说。“我也绝不会用AI审稿,因为换作我被AI审稿,我会觉得很恐怖。”
职业生涯与不同地区
可能有些意外的是,总体上,不同地区、研究领域和生涯阶段的研究人员之间意见差别并不大。不过,受访人报告使用AI写作或评阅论文的亲身经历,的确与对此类做法表示赞同的情况高度相关,这一点与预期相符。
对于AI使用最普遍的情况——论文编辑的看法,似乎确会因所处生涯阶段而异。对此,较年轻的研究人员不仅更容易接受这种做法,表示自己曾如此做过的人也更多。
不仅如此,英语非母语的学者使用AI的各种亲身经历总体比说英语的学者更多。不过,两者在AI使用伦理上的根本看法并没有太大区别。
其他相关调查
若干研究人员和出版机构已对AI在学术界中的使用情况进行了调查,考察了在科学活动过程中使用AI的诸多情况。2025年1月,加拿大渥太华医院研究所健康研究员Jeremy Ng及其同事共同发表了一则面向2000余名医学研究人员的调查,调查显示,45%的受访人表示用过AI聊天机器人(参见J. Y. Ng et al. Lancet Dig. Health7, e94–e102; 2025)。其中,2/3以上表示曾用AI写作或编辑稿件——也就是说,用AI写作或编辑稿件的受访人大概占了总数的1/3,略多于《自然》调查的结果。
“我们的结果显示,人们对此热情很高,但也有犹豫。”Ng说。“调查结果进一步证实,对于聊天机器人在科学研究中的使用方式、使用场景和使用目的,目前并没有多少共识。”
2025年2月,威立发表了一项调查,检视了学术界的AI使用情况,来自世界各地的近5000名研究人员参与了调查(参见 go.nature.com/438yngu)。调查的其中一项结果是,研究人员认为,大多数使用AI的做法(如撰写文件、让同行评审更快更轻松)将在未来数年内得到普遍接受。不过,只有不足一半的受访人表示真正在工作中使用过AI,其中40%曾用AI进行翻译,38%曾用AI进行论文校对或编辑。
“绝大多数人认为,AI将在未来两年内显著改变他们的工作,无论是作为研究人员还是论文作者的工作。”Jarrett说。“不过,一个主要障碍是AI使用规范的问题——怎样的AI使用才安全而符合伦理;在使用AI后,又应如何披露才恰当。”
要不要披露?
大多数学术出版机构的AI使用规范都禁止使用AI创作、修改或操控数据或结果(如图片),也基本禁止将AI工具署名为作者,因为AI工具无法为研究负责。不过不同机构的政策区别很大,尤其是在AI使用的披露上。
如今,许多出版机构会对AI使用情况加以区分。AI使用往往被分为两大类——一类是完善文本(包括使用AI润色拼写和语法、增强文字可读性等),一类是生成新内容。一般地,后一类使用情况要求披露,前一类则无需披露。2023年,位于荷兰海牙的国际科学、技术和医学出版商协会(STM)建议,使用AI为论文进行润色、校准、编辑或编辑格式等情况可以不披露;但是,若AI的使用超出了上述基本工作的范畴,则需进行披露。
一些期刊(如美国医学期刊JAMA)实施了严格的AI使用情况报告规定,要求使用AI的作者提供AI软件及其开发者的详细信息,并简要描述AI在研究中是如何使用的(但对使用AI完成拼写语法检查等简单任务的情况不做上述要求);同时,要求作者确认对AI生成的内容负责。
“目前,我觉得这有点像披露利益冲突——披露得越多越好。”美国JAMA 期刊的执行经理编辑、编辑业务副主任 Annette Flanagin说。
威立也要求作者说明使用AI的详细情况。还有一些期刊,例如美国科学促进会(AAAS)出版的《科学》(Science),要求作者在AI使用说明中列出提示词。出版《自然》的总部位于英国的施普林格·自然表示,生成式AI的使用情况需“妥善记录”,但无需披露用AI辅助编辑润色的情况。(《自然》新闻团队在编辑上独立于《自然》出版方)。
另一些出版机构则走向了另一方向。例如,英国的IOP出版社起初要求作者披露AI使用,后来又取消了这一强制要求;取而代之的政策是,鼓励作者如实说明情况,并强调作者对AI工具产出的一切内容负有责任。2025年4月,IOP出版社同行评审和学术道德负责人Kim Eggleton告知《自然》,这一改变是为了顺应AI使用的普遍程度。
出版机构对使用AI进行同行评审的接受度普遍较低。荷兰爱思唯尔(Elsevier)和AAAS目前都禁止审稿人使用生成式AI直接评审或辅助评审论文,威立和施普林格·自然则允许有限使用AI,但必须披露使用情况,且出于对秘密信息泄露的顾虑,禁止将相关材料上传到联网聊天中。
《自然》调查的受访人也意识到了上述隐私问题。部分受访人表示,用AI辅助审稿可以接受,但条件是使用本地部署的AI,这样不至于让信息泄露上网。
清晰与透明
由于AI使用及其披露中的不确定之处太多,STM于2025年4月发表了一份报告草案,为论文写作过程中的各种AI使用情况进行了分类(参见go.nature.com/4tz8bkj)。
“我们希望出版机构——以及整个生态系统——能采用这些术语。”STM子公司STM Solutions项目主任Joris van Rossum说。Michael Wise指出,对于学术写作中的AI使用伦理,研究人员仍处于早期摸索阶段。Wise是西澳大利亚大学的生物信息学家、计算机科学家,也在出版伦理委员会担任理事;该顾问组织负责给出关于学术出版恰当行为的建议。
“需要强调的是,出版的伦理规范仍然没变:以透明的方式准确报告做了什么和为什么,以及可以从中得出的结论。”Wise说。
© nature
Doi: 10.1038/d41586-025-01463-8
点击阅读原文查看英文原文
点击文字或图片阅读相关文章
版权声明:
本文由施普林格·自然上海办公室负责翻译。中文内容仅供参考,一切内容以英文原版为准。欢迎转发至朋友圈,如需转载,请邮件[email protected]。未经授权的翻译是侵权行为,版权方将保留追究法律责任的权利。
© 2025 Springer Nature Limited. All Rights Reserved
星标我们🌟,记得点赞、在看+转发哦!