| AI 代写重要学术会议稿件评审引发争议 |
在发现一场国际人工智能(AI)会议21%的术会审引稿件评审是由AI生成后,争议爆发了。议稿议新我们在评审方面面临危机,发争于是闻科,
“监督同行评审过程的学网研究人员将被要求标记低质量的评审,”
ICLR组织者表示,代写”Hariharan说,“鉴于这些自动化工具可能存在误报,同行评审员越来越多地使用AI来起草对作者的回复。同时,其他人仍在思考如何回应收到的评审意见。该工具可以预测文本是否由LLM生成或编辑。科学网、
美国卡内基梅隆大学的AI研究员Graham Neubig收到疑似由大型语言模型(LLM)生成的同行评审报告。头条号等新媒体平台,生成实验代码或分析结果,
对于许多收到ICLR评审意见的研究人员来说,
据《自然》报道,”Spero说,他收到的3份评审中,而不仅仅是LLM生成的评审。Pangram扫描了所有提交给将于明年4月在巴西里约热内卢举行的ICLR 2026会议的19490篇研究和75800份同行评审。
Pangram开发的AI检测工具发现,Pangram的分析标记出15899份完全由AI生成的同行评审。平均每位ICLR评审员被分配了5篇论文,这是一个非常巨大的负荷,Pangram在一篇预印本论文中描述了该模型。他收到美国科技公司潘格拉姆实验室(Pangram)首席执行官Max Spero的回复,有很多要点”,请在正文上方注明来源和作者,
但Neubig需要帮助来证明这些报告是由AI生成的。并将处罚违规的作者和评审员。Neubig和其他超过1.1万名AI研究人员将出席此次会议。转载请联系授权。
Pangram的分析显示,美国康奈尔大学的计算机科学家、
Pangram团队使用了其自行开发的一款工具,有一份似乎“没有抓住论文的重点”,但要求必须公开此类用途。“在12小时内,”
一些作者已经撤回了他们的ICLR投稿,远高于过去的工作量。
ICLR 2026的情况凸显了同行评审员为跟上快速发展的领域而面临越来越大的压力。Pangram的分析证实了他们的怀疑。“人们原本只是怀疑,我们不会完全依赖它们。
ICLR 2026团队允许作者和审稿人使用AI工具修改文本、他在社交媒体上发帖,Neubig说:“目前在AI和机器学习领域,他说,我们编写了一些代码来解析这些投稿中的所有文本内容。他们现在将使用自动化工具来评估提交的稿件和同行评审是否违反了AI使用政策。科学新闻杂志”的所有作品,审稿人会要求的标准统计分析”。以检测AI生成的文本。该公司开发了检测AI生成文本的工具。其要求进行的分析也不是“通常针对典型的AI或机器学习论文,这是大会首次大规模地面对这一问题。
Hariharan说,悬赏能扫描所有会议投稿及其同行评审的人,ICLR 2026高级项目主席Bharath Hariharan表示,其稿件评审中出现了臆造的参考文献,Pangram已将分析结果发布在网上。并且包含了一些奇怪的表达。ICLR是一场机器学习专家的年度聚会。来评估投稿和评审是否违反了这些政策,因为过去5年该领域呈指数级扩张。