📰較早收集於 22m

ArXiv 將封禁上傳 AI 生成垃圾內容的研究人員

ArXiv 將封禁上傳 AI 生成垃圾內容的研究人員
PostLinkedIn
📰閱讀原文: The Verge

💡學術標準正在收緊;了解如何避免因 AI 生成內容而在 ArXiv 上遭到一年封禁。

⚡ 30-Second TL;DR

有什麼變化

若論文包含虛構參考文獻或 LLM 元註解,作者將被封禁一年。

為什麼重要

此政策提高了學術發表的門檻,迫使研究人員必須優先對 AI 輔助寫作進行嚴格的人工驗證。這象徵學術界正轉向拒絕未經審查的 AI 內容。

下一步行動

在將論文上傳至 ArXiv 前,請務必手動審核所有引用文獻,並刪除任何殘留的 LLM 元提示詞或格式化痕跡。

誰應關注:Researchers & Academics

關鍵要點

  • 若論文包含虛構參考文獻或 LLM 元註解,作者將被封禁一年。
  • ArXiv 要求未來的投稿必須先被具公信力的同儕審查平台接受。
  • 此政策旨在遏止預印本平台上大量湧入低品質的 AI 生成垃圾內容。

🧠 深度解析

Web-grounded analysis with 19 cited sources.

🔑 增強重點摘要

  • ArXiv的電腦科學部門主席Thomas G. Dietterich在X上宣布了這項政策變革,強調作者對其論文內容負有全部責任,無論內容是如何生成的。
  • 被禁令觸發的「無可辯駁的證據」包括幻覺式參考文獻,以及大型語言模型(LLM)留下的元註解,例如「這是一份200字的摘要」或「此表格中的數據僅供說明,請填入實驗的真實數字」。
  • 此新政策是在ArXiv於六個月前(約2025年10月)收緊電腦科學類別的評論文章和立場文件提交規則之後實施的,這些文章現在也需要預先經過同儕審查,以應對AI生成內容的「難以管理的大量湧入」。
  • 一項研究估計,僅在2025年,就有近147,000個完全捏造的參考文獻進入主要的科學資料庫,其中電腦科學和社會科學的幻覺率最高。
  • 日本報紙《日經》發現,有17篇ArXiv預印本中包含「僅限正面評論」等隱藏提示,這些提示旨在操縱AI驅動的審稿人。
📊 競品分析▸ Show
平台名稱AI內容政策
ArXiv若論文包含未經核實的LLM生成內容(如虛構參考文獻、LLM元註解),作者將被封禁一年;未來投稿需先被具公信力的同儕審查平台接受。
bioRxiv & medRxiv作者需對AI生成內容負責,必須在手稿中詳細說明AI工具的使用,且AI工具不能列為作者。
SSRN要求披露AI使用情況,禁止將AI列為作者,並強調作者對內容負最終責任。
OSF Preprints不歡迎完全或大部分由LLM工具或其他AI工具生成的內容。
Preprints.org遵循出版倫理委員會(COPE)的立場聲明,要求在手稿的「方法」部分適當記錄生成式AI的使用,且AI不能作為作者。

🛠️ 技術深入

目前關於ArXiv如何技術性地檢測AI生成內容的具體細節有限,但其政策主要依賴於人類審核員識別「無可辯駁的證據」:

  • 幻覺式內容識別:政策明確指出,虛構的參考文獻和LLM留下的元註解(例如「這是一份200字的摘要」)是判斷作者未驗證AI輸出內容的關鍵證據。
  • 作者責任制:ArXiv強調,無論內容如何生成,作者都需對其論文的全部內容負全責。這意味著即使AI工具生成了內容,人類作者也有責任進行嚴格的驗證。
  • AI檢測工具的普遍挑戰:雖然有如Turnitin等AI檢測工具利用轉換器深度學習架構分析語言模式和機率訊號來預測AI生成內容的比例,但這些工具在內容被改寫或遇到新型AI模型時,準確性會下降,且可能產生誤報。
  • LLM生成內容的難辨性:研究顯示,LLM能夠生成人類和機器都難以區分的「完美無瑕」文本,這使得檢測變得更具挑戰性。
  • AI輔助引用問題:LLM能夠進行資料庫和HTTP查詢來搜尋、購買和交叉引用文獻,這既可能用於驗證,也可能被用於生成虛假引用。

🔮 前景展望AI analysis grounded in cited sources

學術界對預印本平台內容品質的信任度將會提高。
嚴格的政策和懲罰措施將促使研究人員更負責任地使用AI工具,減少低品質內容的湧入,從而提升預印本的整體可信度。
研究人員在提交預印本前將更傾向於尋求正式的同儕審查。
ArXiv要求未來投稿必須先被具公信力的同儕審查平台接受,這將改變研究人員的發表流程,促使他們優先進行正式審查。
AI輔助寫作工具的開發將更注重準確性和可驗證性。
由於對幻覺內容的嚴格懲罰,AI工具開發者將需要改進其模型以減少錯誤和虛假資訊的生成,以滿足學術界對內容完整性的要求。

時間線

2021-10
ArXiv提交指南強調所有投稿需為「可審閱的科學貢獻」,並經過志願主題專家審核,但提交過程不包含同儕審查。
2022-11
ChatGPT發布,大幅提升了生成式AI在學術寫作中的使用,並引發了學術界對AI生成內容的關注。
2023-03
SSRN發布AI政策,要求作者披露AI工具使用情況,並強調作者對內容負全責,以應對AI技術的興起。
2025-10
ArXiv電腦科學類別更新審核慣例,要求評論文章和立場文件在提交前必須先被期刊或會議接受並完成同儕審查,以應對AI生成內容的「難以管理的大量湧入」。
2025-12
一項研究指出,大型語言模型在學術寫作中引入了「幻覺」引用,估計2025年有近147,000個完全捏造的參考文獻進入主要科學資料庫。
2026-05-15
ArXiv宣布新政策,若論文包含未經核實的LLM生成內容(如虛構參考文獻或LLM元註解),作者將被封禁一年,且未來投稿需先被具公信力的同儕審查平台接受。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: The Verge