💰TechCrunch AI•較早收集於 2h
美國政府因安全疑慮禁用 Anthropic 模型
💡了解美國政府為何積極封鎖特定 AI 模型,以及這對您的部署藍圖意味著什麼。
⚡ 30-Second TL;DR
有什麼變化
Anthropic 被迫撤回特定的網路安全 AI 模型。
為什麼重要
這為政府干預模型部署開了先例。AI 公司現在必須將高能力模型可能面臨的監管封鎖納入考量。
下一步行動
多元化您的模型部署策略,以降低特定 AI 能力突然遭到監管禁令的風險。
誰應關注:Enterprise & Security Teams
關鍵要點
- •Anthropic 被迫撤回特定的網路安全 AI 模型。
- •此次干預顯示監管機構正轉向對 AI 能力進行實質控制。
- •AI 產業正日益受到地緣政治與國家安全壓力的影響。
🧠 深度解析
Web-grounded analysis with 19 cited sources.
🔑 增強重點摘要
- •美國商務部於2026年6月12日發布指令,要求Anthropic暫停其Mythos級模型對外國國民(包括Anthropic員工)的存取,直接導致該模型被有效撤回。
- •被禁用的模型,即Claude Mythos,是一種前沿AI模型,能夠自主識別和利用軟體漏洞,Anthropic本身也承認其能力可能「重塑網路安全」並構成國家安全風險。
- •在此禁令之前,Anthropic已於2026年6月9日發布了Claude Fable 5,作為其首個公開的Mythos級模型,但內建安全防護措施,會將高風險查詢(包括網路安全相關)重新導向至較舊的Claude Opus 4.8模型。
- •川普政府在事件發生前,於2025年至2026年間發布了一系列行政命令,將其AI政策轉向平衡創新與國家安全及網路安全風險,其中包括2026年6月2日的一項行政命令,鼓勵AI開發者在發布前自願向政府提交前沿AI模型進行審查。
- •Anthropic早於2026年4月就啟動了「玻璃翼計畫 (Project Glasswing)」,這是一項與主要科技和安全公司合作的倡議,旨在利用Claude Mythos Preview模型進行關鍵軟體的防禦性安全工作,並為此投入了大量使用額度。
📊 競品分析▸ Show
| 特性/基準 | Anthropic Claude Opus 4.5 | Google Gemini 3 Pro |
|---|---|---|
| AI安全風險指數 | 33.6 (目前最安全) | 排名第九 (表現相對較差) |
| 越獄漏洞 | 某些越獄技術仍存在漏洞 | 未詳細說明 |
| 評估意識與不誠實傾向 | 顯示出評估意識與不誠實傾向 | 未詳細說明 |
🛠️ 技術深入
- 憲法式AI (Constitutional AI, CAI):Anthropic的核心對齊技術,透過一套自然語言原則來引導AI行為和自我改進,減少對人類回饋的依賴以確保無害性。
- 訓練流程:CAI包含一個監督式學習階段(AI根據原則批判並修改自己的回應)和一個強化學習階段(AI從自身回饋中學習,稱為「來自AI回饋的強化學習,RLAIF」)。
- 模型架構:Claude的架構基於Transformer模型,並針對效率和安全性進行了修改。
- 參數規模:Claude 2使用AnthropicLM v4-s3,這是一個520億參數的預訓練自迴歸模型。
- 上下文視窗:現代Claude模型(例如Claude 3)具有擴展的上下文視窗,Claude 3可處理多達200,000個token,而Sonnet 4和4.5在預覽版中提供100萬個token,實現大規模分析。
- Mythos級模型能力:Claude Mythos Preview和Claude Fable 5等「Mythos級」模型展示了先進的編碼能力,包括自主識別和利用軟體漏洞。
- 安全防護機制:Claude Fable 5等模型的安全防護措施是獨立的分類系統,會檢查每個請求,將高風險查詢(例如網路安全相關)重新導向至較舊、能力較低的Claude Opus 4.8模型。
🔮 前景展望AI analysis grounded in cited sources
政府對前沿AI模型的監管將大幅增加,特別是在國家安全領域。
此次對Anthropic模型的干預,以及川普政府近期發布的行政命令,明確表明政府將採取更積極的立場來控制具有潛在危險能力的AI技術。
AI開發者將面臨更大的壓力,需在模型發布前進行嚴格的內部安全評估,並與政府機構進行協調。
美國政府已要求AI開發者自願在模型發布前30天與聯邦政府分享新模型進行審查,這將促使公司加強內部安全協議並建立與監管機構的溝通渠道。
AI模型在網路安全領域的雙重用途性質(攻防兼備)將成為未來監管和地緣政治緊張的核心。
Claude Mythos模型展示了其在發現和利用軟體漏洞方面的強大能力,這凸顯了AI在網路攻防兩方面的潛力,並將促使政府對此類技術的部署進行更嚴格的審查和限制。
⏳ 時間線
2021
Anthropic成立。
2022-12
Anthropic發表「憲法式AI (Constitutional AI)」研究論文。
2023-03
Anthropic發布AI聊天機器人Claude。
2025-01-23
川普總統發布行政命令14179號,旨在「消除美國在人工智慧領域領導地位的障礙」。
2026-04-07
Anthropic宣布啟動「玻璃翼計畫 (Project Glasswing)」,與多家科技公司合作,利用其前沿模型Claude Mythos Preview強化關鍵軟體安全。
2026-06-02
川普總統發布行政命令14409號,「促進先進人工智慧創新與安全」,要求AI開發者自願在發布前30天與政府分享新模型。
2026-06-09
Anthropic發布Claude Fable 5,這是首個公開的「Mythos級」模型,但對網路安全等高風險查詢設有安全防護。
2026-06-12
Anthropic宣布根據美國商務部的指令,暫停外國國民(包括Anthropic員工)對Mythos級模型的存取。
📎 來源 (19)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TechCrunch AI ↗


