🇬🇧較早收集於 15m

Anthropic 將就 AI 工具暫停服務與白宮會面

Anthropic 將就 AI 工具暫停服務與白宮會面
PostLinkedIn
🇬🇧閱讀原文: BBC Technology
#ai-regulation#safety-compliance#government-policyanthropic-ai-modelsanthropicwhite house

💡政府對 AI 發布的緊急干預,標誌著所有 AI 開發者將面臨監管審查的新時代。

⚡ 30-Second TL;DR

有什麼變化

Anthropic 被迫封鎖用戶對近期發布之 AI 模型的存取權限。

為什麼重要

此事件標誌著政府對 AI 模型發布採取更主動的干預措施。開發者應為未來更嚴格的合規要求與公開部署前的安全測試做好準備。

下一步行動

審查您的模型安全護欄與紅隊測試文件,確保其符合新興的聯邦安全標準。

誰應關注:Founders & Product Leaders

關鍵要點

  • Anthropic 被迫封鎖用戶對近期發布之 AI 模型的存取權限。
  • 白宮要求召開緊急會議以討論此次暫停服務事件。
  • 此事件凸顯了監管機構對 AI 安全與部署規範的壓力日益增加。

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 27 個來源。

🔑 增強重點摘要

  • 美國政府的命令具體針對Anthropic的「Fable 5」(消費者版本)和「Mythos 5」(無限制版本)模型,其中Mythos 5以其強大的網絡安全能力而聞名,但也被認為可能被濫用。
  • 美國政府的出口管制指令是由川普政府發布的,理由是國家安全擔憂,因為據稱Fable 5存在一種「越獄」方法,可以繞過安全防護措施並協助電腦駭客。
  • Anthropic被給予90分鐘的期限來遵守命令,該命令禁止所有外國國民(包括Anthropic的外國員工)存取這些模型,實際上迫使公司全面停止服務。
  • 此次事件發生在Anthropic與美國政府之間長期爭議之後,此前五角大廈曾將Anthropic列為「供應鏈風險」,原因是該公司拒絕允許美國軍方將其AI模型用於全自主武器系統和大規模國內監控。
  • 據報導,亞馬遜(Amazon)向白宮通報了Fable 5的「越獄」漏洞,亞馬遜執行長Andy Jassy也與政府官員進行了溝通,促成了此次出口管制。
📊 競品分析▸ Show
特性/公司Anthropic (Claude Fable 5/Mythos 5, Opus 4.6)OpenAI (GPT-5.5, GPT-5.4, GPT-5)Google Gemini (3.1 Pro, 2.5 Pro, 2.5 Flash)
核心理念安全即基礎設施,可靠、可控、可解釋的AI系統,強調憲法式AI。垂直整合,擁有模型、API和消費者平台,追求通用AI。平台深度和數據存取,整合Google生態系統。
最新模型Fable 5 (消費者版), Mythos 5 (無限制版), Claude Opus 4.6。GPT-5.5 (旗艦), GPT-5.4, GPT-5。Gemini 3.1 Pro (旗艦), 2.5 Pro, 2.5 Flash。
安全重點強調AI安全、減少有害或偏見輸出,透過憲法式AI和安全分類器。致力於減少幻覺 (GPT-5比GPT-4o減少65%)。內在智能的「思考模型」。
上下文窗口Claude 3 可處理高達200,000個token。GPT-5具有1M token上下文窗口。Gemini 3.1 Pro在200K輸入後翻倍。
定價 (API)(未明確提供Fable 5/Mythos 5的API定價,但通常與企業級應用相關)GPT-5.5 旗艦版:輸入 $5/輸出 $30 (每百萬token);GPT-5.4:輸入 $2.50/輸出 $15;GPT-5:輸入 $1.25/輸出 $10。Gemini 3.1 Pro:輸入 $2/輸出 $12 (每百萬token)。
主要應用受監管行業、知識密集型應用(如法律、政策分析)、複雜指令遵循、敏感工作流程。面向產品團隊、客戶應用、內部工具,需要靈活、高性能語言能力。嵌入Google生態系統的團隊、處理實時或大規模數據。
獨特賣點「憲法式AI」實現無害性,可見的「擴展思維」提供透明度。最成熟的生態系統和最廣泛的社區支持。多模態應用和移動整合,最長的上下文窗口。

🛠️ 技術深入

  • 憲法式AI (Constitutional AI, CAI):Anthropic的核心方法,旨在訓練無害、有用且誠實的AI系統,而無需完全依賴人類對無害性的反饋。它使用一套自然語言原則(即「憲法」)來指導AI的行為和自我改進。
    • 兩個階段:監督學習階段(AI根據原則批判並修改自己的回應)和強化學習階段(AI根據原則從自身反饋中學習,使用「來自AI反饋的強化學習」或RLAIF)。
    • 憲法內容:靈感來自聯合國世界人權宣言等外部來源,可由Anthropic員工或公眾意見策劃。
  • 模型架構:Claude的架構基於Transformer模型,並進行了修改以提高效率和安全性。它結合了監督學習和來自人類反饋的強化學習(RLHF)來優化其回應。
  • 上下文窗口:Claude模型(例如Claude 3)能夠處理擴展的上下文窗口,例如Claude 3可以處理多達200,000個token。
  • Claude Code的三層記憶架構(針對編碼代理)
    • 持久的memory.md文件。
    • 基於grep的搜索層,用於導航實時代碼庫(作為外部記憶)。
    • Chyros守護程序(一個尚未發布的後台組件)。
  • 安全防護措施:Anthropic實施了強大的防護措施,包括安全分類器,用於檢測濫用和越獄嘗試,尤其是在網絡安全相關任務中。

🔮 前景展望AI analysis grounded in cited sources

AI監管將加速並可能變得更具侵入性。
美國政府對Anthropic模型的突然出口管制,即使公司對風險評估有異議,也表明監管機構願意採取果斷行動,這可能為未來對AI部署的更嚴格審查和干預開創先例。
AI公司的IPO和市場估值可能面臨更大的不確定性。
此次事件發生在Anthropic預期IPO之前,且與OpenAI同時面臨監管壓力,這凸顯了地緣政治和國家安全考量對AI公司商業運營和市場前景的潛在重大影響。
AI安全研究和負責任的AI開發將成為行業的關鍵差異化因素,並可能導致技術主權的討論。
Anthropic長期以來強調AI安全,但仍面臨政府的強制性停用,這將促使所有AI開發者重新評估其安全措施,並可能導致各國政府對其AI技術的控制和國內開發的重視。

時間線

2021-01
Anthropic由前OpenAI員工創立,專注於AI安全研究。
2022-12
Anthropic發布關於「憲法式AI」的研究論文。
2023-03
Anthropic發布其首個AI助理Claude。
2023-09
Amazon宣布對Anthropic進行高達40億美元的投資。
2026-02
Anthropic與美國國防部因拒絕將其AI模型用於自主武器和大規模監控而產生爭議,隨後被列為「供應鏈風險」。
2026-06-12
美國政府發布出口管制指令,要求Anthropic暫停Fable 5和Mythos 5模型對所有外國國民的存取權限,理由是國家安全問題。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: BBC Technology

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。