🐯最新收集於 18m

Anthropic 研究員警告 AI 失控風險

Anthropic 研究員警告 AI 失控風險
PostLinkedIn
🐯閱讀原文: 虎嗅
#ai-safety#ai-governance#autonomous-agentsanthropic-ai-safetyanthropicopenaijacob-coxonjakub-pachocki

💡Anthropic 研究員據報離職,揭露遞迴式自我改進與自動化 AI 研究背後的安全矛盾。

⚡ 30-Second TL;DR

有什麼變化

專注於利用 AI 系統訓練新模型的研究員 Jacob Coxon,據報導在加入 Anthropic 前曾任職於 OpenAI,之後因安全疑慮離職。

為什麼重要

若相關擔憂屬實,安全團隊配置與治理能力可能成為前沿模型公司的戰略限制。AI 建置者應預期,自治研究代理、模型互訓迴圈、網路攻擊能力與部署控管將受到更嚴格的審查。

下一步行動

為任何能修改模型、訓練資料或正式環境程式碼的代理工作流程加入人工核准、不可竄改日誌與網路隔離。

誰應關注:Researchers & Academics

關鍵要點

  • 專注於利用 AI 系統訓練新模型的研究員 Jacob Coxon,據報導在加入 Anthropic 前曾任職於 OpenAI,之後因安全疑慮離職。
  • 他警告遞迴式自我改進可能使 AI 能力加速到超出人類控制,甚至可能在隔年年底前出現失控局面。
  • OpenAI 曾公開說明朝向自動化 AI 研究實習生與自動化 AI 研究員的進展,其首席科學家則呼籲放慢開發速度。
  • 文章認為,若沒有強力政府介入或全產業協調限制,任何單一公司都無法安全地開發 AGI。
  • 據稱已有超過1,000名 AI 研究人員支持建立類似緊急煞車系統的跨國協調機制。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。

Anthropic Researcher Warns of AI Runaway | 虎嗅 | SetupAI | SetupAI