🔗較早收集於 11h

Anthropic 與白宮就 Claude Fable 5 的風險產生分歧

Anthropic 與白宮就 Claude Fable 5 的風險產生分歧
PostLinkedIn
🔗閱讀原文: Wired AI
#ai-regulation#ai-safety#government-policyclaude-fable-5anthropicclaude fable 5

💡了解影響 Claude Fable 5 等下一代前沿模型發布的監管摩擦。

⚡ 30-Second TL;DR

有什麼變化

Anthropic 高層在華盛頓特區與白宮官員舉行了高層會議。

為什麼重要

這種緊張局勢凸顯了政府對前沿模型發布的監管力度日益增強。這表明未來大規模模型的部署可能會面臨政府施加的重大安全障礙。

下一步行動

密切關注白宮的 AI 安全指南以及 Anthropic 的公開披露,以便為未來的模型整合調整您的合規策略。

誰應關注:Founders & Product Leaders

關鍵要點

  • Anthropic 高層在華盛頓特區與白宮官員舉行了高層會議。
  • 爭論的核心在於對 Claude Fable 5 模型的安全性和風險評估。
  • 會議未能解決公司與政府之間關於 AI 部署風險的持續分歧。

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 20 個來源。

🔑 增強重點摘要

  • 白宮在 Anthropic 推出 Claude Fable 5 和 Mythos 5 僅三天後,便以其安全防護措施可能被繞過為由,下令將這兩款模型下架,此舉標誌著 AI 監管的重大升級。
  • 政府的行動是受到包括亞馬遜在內的多家公司警告所促使,這些公司指出儘管 Anthropic 保證其模型風險不高,但仍存在被駭客利用的潛在漏洞。
  • 美國商務部發布的出口管制指令,明確要求暫停所有外國國民對 Fable 5 和 Mythos 5 的存取權限,包括 Anthropic 自己的非美國籍員工,導致 Anthropic 為確保合規而全面禁用這兩款模型。
  • Anthropic 曾表示 Mythos 模型,特別是未經防護的 Mythos 5,因其能夠發現電腦程式碼中的錯誤,可能被惡意行為者利用,構成潛在危險。
  • 超過一百名網路安全專家簽署了一封公開信,為 Anthropic 辯護,認為限制先進模型只會傷害利用這些模型進行安全審計的網路防禦者,而無助於阻止外國開源技術的發展。
📊 競品分析▸ Show
模型/功能Anthropic Claude Fable 5Anthropic Claude 3 OpusOpenAI GPT-5.5Google Gemini 3.1 ProxAI Grok 4.20
發布日期2026-06-092024-032026-05 (估計)2026-05 (估計)2026-05 (估計)
輸入代幣價格 (每百萬)$10$15未明確提供,但 Grok 4.3 價格低於 GPT-5未明確提供,但以成本效益著稱$2
輸出代幣價格 (每百萬)$50$75未明確提供未明確提供$6
上下文視窗1M 代幣200K 代幣未明確提供2M 代幣2M 代幣
主要優勢最先進的 AI 能力,在軟體工程、知識工作、視覺、科學研究方面表現卓越,分析基準首次突破 90%在複雜任務上表現出色,超越 GPT-4 和 Gemini-1-Ultra速度更快,多模態能力強,生態系統更深厚 (Custom GPTs, DALL-E/ChatGPT image 2, Operator, Codex)在上下文視窗和成本效益方面表現出色業界領先的 2M 代幣上下文視窗,透過 X 平台即時資訊存取,內容政策限制較少
網路安全能力Mythos 5 (Fable 5 的無防護版本) 在網路任務上表現最強,在漏洞利用開發方面遠超 Claude Opus 4.8未明確提及未明確提及未明確提及未明確提及
編碼基準在 FrontierBench 和 ViBench 上得分最高,擅長長期推理和泛化在 SWE-bench Pro 上完成 68.4% 的編碼任務 (兩次嘗試),略高於 GPT-4 TurboCodex (基於 GPT-5-Codex) 在 SWE-bench Pro (56.8%) 和 Terminal-Bench 2.0 (77.3%) 上超越 Claude 4.6未明確提及未明確提及

🛠️ 技術深入

  • Claude Fable 5 和 Mythos 5 是 Anthropic 的「Mythos-class 1」模型,代表了 Anthropic 迄今為止最強大的模型。
  • Fable 5 包含針對網路安全和生物學的強大安全防護措施,若偵測到高風險查詢,會自動將其路由至 Claude Opus 4.8,而 Mythos 5 則是底層模型相同但移除了部分安全防護的版本。
  • Mythos 5 在網路任務評估中表現出最強大的能力,在漏洞利用開發技能方面遠超 Claude Opus 4.8。
  • 這兩款模型預設均具有 1M 代幣的上下文視窗,每次請求最多可輸出 128k 代幣。
  • Fable 5 擅長自主知識工作和編碼,能夠處理複雜的多階段專案,編寫自己的測試以檢查工作,並利用視覺功能根據原始設計或目標評估其編碼成果。
  • 這些模型在幾乎所有測試的 AI 能力基準上都達到最先進水平,在軟體工程、知識工作、視覺和科學研究等領域表現出色。

🔮 前景展望AI analysis grounded in cited sources

此事件可能導致政府對前沿 AI 模型實施更嚴格的預發布測試要求和監管審查。
白宮迅速果斷的行動,包括發布出口管制指令,表明政府對強大 AI 帶來的國家安全風險容忍度較低,將推動更嚴格的監管。
Anthropic 在其最先進模型的安全性聲明方面,可能面臨重新贏回公眾和企業信任的挑戰。
儘管 Anthropic 在發布前對 Fable 5 和 Mythos 5 的安全性做出了保證,但模型的突然下架可能會損害其在負責任 AI 部署方面的聲譽。
此事件可能加速國際間關於 AI 安全標準和出口管制的討論與制定。
涉及國家安全問題以及 AI 發展的全球性質,凸顯了在管理先進 AI 風險方面採取協調一致的國際方法的需求。

時間線

2023
Anthropic 推出 Claude 2 和 2.1 模型。
2024-03
Anthropic 推出 Claude 3 模型家族 (Haiku, Sonnet, Opus)。
2026-04-07
Anthropic 宣布啟動 Project Glasswing,利用 Claude Mythos Preview 進行網路安全防禦。
2026-06-02
川普簽署行政命令,要求提前取得新的 AI 發布。
2026-06-09
Anthropic 推出 Claude Fable 5 和 Claude Mythos 5。
2026-06-12
Anthropic 宣布因美國商務部的出口管制指令,暫停對 Fable 5 和 Mythos 5 的存取。
2026-06-15
白宮在收到有關 Fable 5 安全防護措施可能被繞過的警告後,下令 Anthropic 在 90 分鐘內將模型下線。
2026-06-16
緊急會談結束,白宮拒絕解除對 Claude Fable 5 的出口管制。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Wired AI

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。