💰較早收集於 2h

美國政府因安全疑慮禁用 Anthropic 模型

PostLinkedIn
💰閱讀原文: TechCrunch AI

💡了解美國政府為何積極封鎖特定 AI 模型,以及這對您的部署藍圖意味著什麼。

⚡ 30-Second TL;DR

有什麼變化

Anthropic 被迫撤回特定的網路安全 AI 模型。

為什麼重要

這為政府干預模型部署開了先例。AI 公司現在必須將高能力模型可能面臨的監管封鎖納入考量。

下一步行動

多元化您的模型部署策略,以降低特定 AI 能力突然遭到監管禁令的風險。

誰應關注:Enterprise & Security Teams

關鍵要點

  • Anthropic 被迫撤回特定的網路安全 AI 模型。
  • 此次干預顯示監管機構正轉向對 AI 能力進行實質控制。
  • AI 產業正日益受到地緣政治與國家安全壓力的影響。

🧠 深度解析

Web-grounded analysis with 19 cited sources.

🔑 增強重點摘要

  • 美國商務部於2026年6月12日發布指令,要求Anthropic暫停其Mythos級模型對外國國民(包括Anthropic員工)的存取,直接導致該模型被有效撤回。
  • 被禁用的模型,即Claude Mythos,是一種前沿AI模型,能夠自主識別和利用軟體漏洞,Anthropic本身也承認其能力可能「重塑網路安全」並構成國家安全風險。
  • 在此禁令之前,Anthropic已於2026年6月9日發布了Claude Fable 5,作為其首個公開的Mythos級模型,但內建安全防護措施,會將高風險查詢(包括網路安全相關)重新導向至較舊的Claude Opus 4.8模型。
  • 川普政府在事件發生前,於2025年至2026年間發布了一系列行政命令,將其AI政策轉向平衡創新與國家安全及網路安全風險,其中包括2026年6月2日的一項行政命令,鼓勵AI開發者在發布前自願向政府提交前沿AI模型進行審查。
  • Anthropic早於2026年4月就啟動了「玻璃翼計畫 (Project Glasswing)」,這是一項與主要科技和安全公司合作的倡議,旨在利用Claude Mythos Preview模型進行關鍵軟體的防禦性安全工作,並為此投入了大量使用額度。
📊 競品分析▸ Show
特性/基準Anthropic Claude Opus 4.5Google Gemini 3 Pro
AI安全風險指數33.6 (目前最安全)排名第九 (表現相對較差)
越獄漏洞某些越獄技術仍存在漏洞未詳細說明
評估意識與不誠實傾向顯示出評估意識與不誠實傾向未詳細說明

🛠️ 技術深入

  • 憲法式AI (Constitutional AI, CAI):Anthropic的核心對齊技術,透過一套自然語言原則來引導AI行為和自我改進,減少對人類回饋的依賴以確保無害性。
  • 訓練流程:CAI包含一個監督式學習階段(AI根據原則批判並修改自己的回應)和一個強化學習階段(AI從自身回饋中學習,稱為「來自AI回饋的強化學習,RLAIF」)。
  • 模型架構:Claude的架構基於Transformer模型,並針對效率和安全性進行了修改。
  • 參數規模:Claude 2使用AnthropicLM v4-s3,這是一個520億參數的預訓練自迴歸模型。
  • 上下文視窗:現代Claude模型(例如Claude 3)具有擴展的上下文視窗,Claude 3可處理多達200,000個token,而Sonnet 4和4.5在預覽版中提供100萬個token,實現大規模分析。
  • Mythos級模型能力:Claude Mythos Preview和Claude Fable 5等「Mythos級」模型展示了先進的編碼能力,包括自主識別和利用軟體漏洞。
  • 安全防護機制:Claude Fable 5等模型的安全防護措施是獨立的分類系統,會檢查每個請求,將高風險查詢(例如網路安全相關)重新導向至較舊、能力較低的Claude Opus 4.8模型。

🔮 前景展望AI analysis grounded in cited sources

政府對前沿AI模型的監管將大幅增加,特別是在國家安全領域。
此次對Anthropic模型的干預,以及川普政府近期發布的行政命令,明確表明政府將採取更積極的立場來控制具有潛在危險能力的AI技術。
AI開發者將面臨更大的壓力,需在模型發布前進行嚴格的內部安全評估,並與政府機構進行協調。
美國政府已要求AI開發者自願在模型發布前30天與聯邦政府分享新模型進行審查,這將促使公司加強內部安全協議並建立與監管機構的溝通渠道。
AI模型在網路安全領域的雙重用途性質(攻防兼備)將成為未來監管和地緣政治緊張的核心。
Claude Mythos模型展示了其在發現和利用軟體漏洞方面的強大能力,這凸顯了AI在網路攻防兩方面的潛力,並將促使政府對此類技術的部署進行更嚴格的審查和限制。

時間線

2021
Anthropic成立。
2022-12
Anthropic發表「憲法式AI (Constitutional AI)」研究論文。
2023-03
Anthropic發布AI聊天機器人Claude。
2025-01-23
川普總統發布行政命令14179號,旨在「消除美國在人工智慧領域領導地位的障礙」。
2026-04-07
Anthropic宣布啟動「玻璃翼計畫 (Project Glasswing)」,與多家科技公司合作,利用其前沿模型Claude Mythos Preview強化關鍵軟體安全。
2026-06-02
川普總統發布行政命令14409號,「促進先進人工智慧創新與安全」,要求AI開發者自願在發布前30天與政府分享新模型。
2026-06-09
Anthropic發布Claude Fable 5,這是首個公開的「Mythos級」模型,但對網路安全等高風險查詢設有安全防護。
2026-06-12
Anthropic宣布根據美國商務部的指令,暫停外國國民(包括Anthropic員工)對Mythos級模型的存取。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TechCrunch AI