预印本平台 ArXiv:对 AI 包办论文的作者实施一年禁令

内容管家 AI领域评论38字数 691阅读2分18秒阅读模式
预印本平台 ArXiv:对 AI 包办论文的作者实施一年禁令

背景:AI 滥用问题倒逼平台出手

作为全球最大的学术预印本存储库,arXiv(发音为 "archive")早已成为计算机科学、数学等领域研究成果流通的核心渠道——论文在正式同行评审前便可发布,平台因此积累了大量科研趋势数据。

然而,随着大语言模型(LLM)的普及,平台上低质量 AI 生成论文的数量急剧增加。arXiv 此前已采取措施:首次投稿用户必须获得资深作者的背书方可提交。此外,在 Cornell 托管 20 余年后,arXiv 正宣布独立为非营利组织,以便筹集更多资金应对 AI 垃圾内容问题。

核心变化:判定标准与处罚机制

本周四,arXiv 计算机科学分部主席 Thomas Dietterich 发文明确划定红线:若提交论文中出现无可辩驳的证据表明作者未核查 LLM 生成结果,则该论文内容整体不可信。 具体而言,以下情形可作为"无可辩驳证据":

  • 幻觉引用(hallucinated references):引用来源实际不存在或内容不匹配
  • LLM 对话痕迹:论文中保留了与 LLM 的交互记录

一旦证据成立,作者将面临:

  1. 被禁止在 arXiv 投稿一年
  2. 后续投稿须先经权威同行评审期刊/会议接收,方可提交

Dietterich 强调,这并非全面禁止使用 LLM,而是要求作者对内容承担"全部责任"——无论内容如何生成。若研究者直接复制粘贴不当语言、剽窃内容、偏见内容、错误、虚假引用或误导性内容,仍须自担其责。

此外,该规则为"一击出局"机制:须由版主提起、板块主席确认后方可执行处罚,作者也有权申诉。

影响与建议:学术诚信面临新考验

值得关注的是,近期同行评审研究已发现伪造引用在生物医学领域呈上升趋势00603-3/fulltext),LLM 被认为是主要诱因之一——科研人员并非唯一被 AI 虚假引用"坑害"的群体。

这意味着:

  • 平台层面:独立后的 arXiv 将有更大灵活度引入更严格的审核机制
  • 作者层面:使用 LLM 辅助写作时,必须对每一条引用、每一处数据负责到底
  • 审稿方:未来或将更依赖人工核查,而非简单信任预印本内容

延伸阅读

 
内容管家

发表评论