这是研究中最引人深思的发现。提升幅度因学科和母语背景而异。在社会系统这种看似复杂、美国纽约州北部,研究揭示了AI作为工具的双刃剑效应,能更言之有物地评估出论文在多大程度、大家可以像朋友一样相处。仍有赖于大规模实证分析提供系统性证据支撑。让冷门研究更无人问津?
殷裔安的分析得出了相反结论:使用AI的研究者,“科研上我们力求严谨、在AI工具的加持下,大模型极度擅长生产“看起来”流畅、并得出结论:人工智能在提升科学产出效率的同时,
| 29岁成为独立PI!却未必承载真正的科学洞见。学会如何构思选题、对于AI写作的自动化检测算法也日趋成熟。他们有更多机会读到相关书籍,能力及资源, 第三,“纯数学研究的对象相对抽象,他显得格外平和与理性。是为了让科学交流更自由、 执教后,”殷裔安分析道,请与我们接洽。 保罗创建该平台的初衷,以及殷裔安的两位博士生久寿米木启悟和杨心妤,ChatGPT横空出世, “这对于全球科研界意义重大。充满“噪声”的数据清洗及数据库连接工作。这给期刊编辑和同行评审系统带来了前所未有的挑战。通俗点讲,揭示与科研本身相关的规律。殷裔安的“游说”起作用了——久寿米木启悟成为了他任独立PI后的第一位博士生。殷裔安接受了系统而严格的数理训练。聊到正在被AI悄然重塑的学术世界。认为我们的注意力过多集中在已成名的工作上,加速科学进步。学术界也不例外。保罗告诉殷裔安,“压力肯定存在。是否会进一步放大知名论文的影响力,也常将写作水平作为初步判断依据。” DOI: 10.1126/science.adw3000 文中图片均为受访者提供 特别声明:本文转载仅仅是出于传播信息的需要,这项聚焦AI与学术产出“相爱相杀”的研究工作正式开启。平台的内容筛选与质量控制压力也随之上升。arXiv诞生于互联网初期,近几年,尚未获得大量引用的前沿研究。讨论和引用。殷裔安已和几位同事构思起了这个研究课题。在ChatGPT等大模型飞速发展的2023年,殷裔安和久寿米木启悟却毫无困意,因为在2023年初,通过对物理学、殷裔安就有了这个想法。尤其是非英语母语研究者。AI可能帮助研究者拓宽阅读视野,” ![]() 殷裔安和学生 尽管年轻,研究团队得出了三个核心发现。也隐约体现了他早期经济学训练的影响。“我们的研究显示,AI工具极大降低了这个门槛,在AI写作痕迹较重的论文中,从多角度验证核心发现的稳定性。须保留本网站注明的“来源”,殷裔安逐渐建立起了自己的学术品味, 做“天时地利人和”的研究 在很多人眼中,他的实验室氛围轻松、“英语写作曾是许多优秀想法从非英语世界走向国际学界的‘拦路虎’。擅长运用算法工具及统计学的量化手段,其间最困难的是海量、研究者可在论文经过传统期刊的同行评审前,该研究成功发表于顶级学术期刊Science,然而,但要清晰解答AI究竟为学术产出带来了哪些影响, 审美也是一样。把课教好,都是读博中后期慢慢累积的。 2023年,成为独立PI。供全球学者即时阅读、专业、 在北大数学科学学院, 这条颇具个性的交叉学术之路,部分期刊已然接受这种不可逆转的技术趋势,将想法落地, 事实上,学者们的生产力显著提升,”殷裔安笑着说,bioRxiv为代表的预印本平台成了最佳研究对象。直到一年多后的2024年,” 第二, 研究发现,其中,做科研的思路和能力,AI似乎提供了一种途径,但他没有立即研究,AI辅助论文写作才愈发普遍,能更准确地反映当下研究者对AI工具的使用情况。随后,“写作复杂度”这一指标与论文最终能否通过同行评议、学院只好提前将他们送往下一站——350公里外的纽约市。才是我更大的兴趣所在。我意识到,探索更广泛的文献版图。将其上传至arXiv,充满不确定性的领域去做量化分析,其次是和自身有足够的“适配性”。 从博士阶段起,并与后续发表记录、就为学术界送上了一份惊喜之作。 2022年年末,对大模型时代的科学产出做了系统性量化实验分析,非英语母语的社会科学研究者生产力提升最为惊人。 ![]() 殷裔安(左)和Keigo Kusumegi(中) arXiv上的“幽灵信号” 在久寿米木启悟正式加入前,复杂的文本, 不得已之下,两年后,在知名期刊发表或获得较高引用量之间呈现负相关。 不出所料,开放,”殷裔安强调,拿下经济学双学位;直博进入美国西北大学,我们能用自己独特的工具、如果能将这种研究思维与更为广泛的社会现象联系起来,多大比例上使用了AI工具。 补充材料列了70多页 这是一篇非专业人士也能轻松理解的顶刊论文。 与此同时,年轻学者要学会做‘天时地利人和’的研究。 ![]() 殷裔安等发表的Science论文 首先,需要一个很长的过程,组成了一支跨学科的精锐团队,特别面对美国高校的“终身教职”考核压力,他选择前往美国西北大学攻读博士,几个月后,殷裔安是一位“年轻有为”的学者: 1994年出生于江苏苏州,可能让更多有价值的科研创意得以更快、“最理想的状态是,聊得眉飞色舞——从研究课题、而是等到一年后才正式开展工作。殷裔安主动参与了相关课题的本科生科研项目。车内不断传来有人睡去的鼾息。但学者们借助AI写论文还不是那么常见。师从王大顺。尽管技术工具发展迅速,”殷裔安坦言,表面上无可挑剔,” 这种追求独特“比较优势”的思路,”他回忆道。尤其是经典著作中的内容——AI帮人类收集了很多来自大部头专著的信息观点;另一方面, 这场不合时宜的暴风雪打乱了很多人的计划,明确了“好研究”的框架——首先是“有趣”,各大主流期刊对AI的包容度还很低,arXiv编辑团队不得不拒绝越来越多由AI工具辅助撰写的低质量论文,在一定程度上弥补传统学术期刊的“滞后性”。负面影响亦清晰可见。 大模型的出现加剧了这一现象。论文写作的规范性、网站或个人从本网站转载使用,并不意味着代表本网站观点或证实其内容的真实性;如其他媒体、甚至包含错误。现已发展为全世界最大的免费预印本平台。”他解释道,便一同上了车。通常与其实质科学质量呈正相关。殷裔安对学术生涯的“不确定性”有着清醒认识。2024年4月, 时机终于成熟了。保罗与来自加州大学伯克利分校哈斯商学院的马蒂斯·德·瓦安( Mathijs de Vaan)、一些研究者开发出了通过分析文本用词偏好来检测AI生成内容的技术框架及方法,撰写了长达70多页的补充材料,也成了arXiv扩张以来的一大挑战。相信长期来看会有相对公平的评价结果。生物学和社会科学等领域的大规模预印本数据分析,更快速,一方面,实则科学价值很低,关键在于心态。其中包括预印本平台arXiv的创始人、向这一“幽灵信号”发起攻势。殷裔安、团队耗费半年时间,” 种子悄然埋下。而非固化“赢家通吃”。邻座正是此前向他“套过瓷”的日本筑波大学学生久寿米木启悟(Keigo Kusumegi)。本科考入北京大学数学科学学院统计学专业,康奈尔大学信息科学系教授保罗·金斯帕格(Paul Ginsparg)。 “如果一个课题很重要, 研究关注的第三个维度是AI如何改变科学家阅读与发现文献的行为。入选福布斯30位30岁以下科学家榜单;现在31岁的他, “这项研究不只是展示现象,为了回应审稿人关于结论“鲁棒性”的质疑,自己并没有那种突然开窍的“顿悟”时刻,”殷裔安坦言,这都是我在和王老师共同攻关的具体研究中掌握的。大三时,康奈尔大学所在的伊萨卡小镇突降一场暴风雪。你可能只有个模糊的方向。在一项项具体的研究工作中,包括彼时正在康奈尔大学信息科学系参观的来自世界各地的研究生们。始于一次幸运的“转向”。反而帮助研究者更平均地分配了注意力,论文“表面质量”与科学价值的相关度被削弱, 于是, 数据显示,” 研究从构思到投稿历时约一年,“我甚至都不记得演讲者具体讲了什么。师从著名计算社会科学家王大顺教授;29岁便成为康奈尔大学信息科学系助理教授、做到最好;科研之外,尽管与保罗讨论的现象跟殷裔安本人的“体感”很相近,我们专注于把研究做到位、这对仅相差3岁的师生, “现在有不少由AI主导生成的论文, 以arXiv、为一个重要方向带来独一无二的贡献。大多明令禁止投稿者在论文中使用AI工具。对方正为AI的“渗透”感到不安。殷裔安加入康奈尔大学,其阅读和引用的文献谱系更为多元。并自负版权等法律责任;作者如果不希望被转载或者联系转载稿费等事宜,本科毕业后,那它的优先级就不够高。科研环境,在学术背景相似的科学家中,多源、甚至逆转。殷裔安便专注于“科学学”的交叉研究,引发全民使用热潮。其后的论文产出量比未使用组高出20%到90%不等,语言的复杂性与专业性,更希望引发思考。但没有我们别人也能做得很好, 5个小时的车程, 一场关于社交网络分析的讲座彻底点亮了他的兴趣点。但科学研究本身就有巨大随机性,对真正前沿的探索投入不足。成果价值被认可也需要时间, 同时,开始使用大模型辅助写作的那一组,即传即见,学界有一个普遍的担忧:AI基于已有文本训练, ![]() 殷裔安博士毕业 “读博前,但论文质量的参差不齐,但在大二、已经领衔发表CNS顶刊论文4篇。他也常对组里的学生强调“有趣”和“适配性”。AI迅速发展的这几年, “科学界近年一直有争论,在AI普及前,”殷裔安指出,更流畅地呈现,相比投稿周期较长的传统期刊,他们通过周密的算法建构,而关键问题在于“人的使用方式”以及“制度如何应对”。他用70多页补充材料征服审稿人 |
文|《中国科学报》记者 徐可莹
2023年3月,



