🇨🇳較早收集於 12h

Anthropic 將向全球監管機構通報安全漏洞

Anthropic 將向全球監管機構通報安全漏洞
PostLinkedIn
🇨🇳閱讀原文: cnBeta (Full RSS)

💡Anthropic 透過與全球監管機構分享模型發現的風險,為 AI 安全透明度樹立了新標準。

⚡ 30-Second TL;DR

有什麼變化

Anthropic 將揭露 Claude Mythos 所發現的網路安全風險

為什麼重要

此舉為 AI 實驗室與金融監管機構在系統性風險上進行主動合作樹立了先例,可能導致對高能力模型採取更嚴格的監管。

下一步行動

審查您自身模型的金融基礎設施數據安全防護,以確保符合新興的 AI 金融法規。

誰應關注:Enterprise & Security Teams

關鍵要點

  • Anthropic 將揭露 Claude Mythos 所發現的網路安全風險
  • 合作對象包含各國主要央行與金融穩定委員會
  • 此舉由英國央行總裁 Andrew Bailey 發起請求

🧠 深度解析

Web-grounded analysis with 35 cited sources.

🔑 增強重點摘要

  • Anthropic 的 Claude Mythos(特別是「Mythos Preview」)是一款於2026年4月7日作為「Project Glasswing」計畫一部分推出的前沿AI模型,因其強大的網路安全能力而未公開發布,僅限於有限的合作夥伴使用。
  • Mythos 模型已展現出發現數千個高嚴重性漏洞(包括零日漏洞)的能力,涵蓋所有主流作業系統和網路瀏覽器,甚至能將多個漏洞串聯起來進行利用。
  • 該模型的能力引起了全球金融監管機構(包括金融穩定委員會 (FSB) 和國際貨幣基金組織 (IMF))的擔憂,認為若被濫用或防禦措施無法跟上,可能對金融系統穩定性造成衝擊。
  • 為應對潛在風險,Anthropic 已應白宮要求限制 Mythos 的廣泛分發,並將其提供給約40個主要位於美國的組織(包括亞馬遜、微軟和摩根大通),以協助他們識別和修復漏洞。
  • 英國AI安全研究所 (AISI) 評估了 Mythos,指出其能力有「顯著提升」,並首次成功完成了一項先前未解決的網路安全測試(「冷卻塔」測試),在十次嘗試中成功了三次。
📊 競品分析▸ Show
特性/模型Anthropic Claude Mythos (Preview)OpenAI GPT-5.5-Cyber (Preview)Anthropic Claude for Financial ServicesGPT-4 (金融應用)
主要用途網路安全漏洞發現與利用 (防禦性優先)網路安全防禦 (專門化、受限)金融專業用途 (市場報告摘要、合規分析、程式碼生成)通用LLM,可適應金融任務
漏洞識別能自主發現數千個高嚴重性零日漏洞,包括作業系統和瀏覽器假設漏洞和攻擊將增加,強調快速大規模裝備防禦者否 (非主要功能)否 (非主要功能)
風險評估引起全球金融穩定性擔憂,被視為可能「打開整個網路風險世界」專注於強化防禦,以應對AI驅動的攻擊協助合規與風險管理,但本身非漏洞發現工具需額外努力以符合合規標準
可用性僅限於約40個組織的「門控研究預覽」;白宮要求限制廣泛分發有限預覽,提供給網路安全防禦者透過Amazon Bedrock等平台提供廣泛可用
安全機制憲法式AI、強化安全措施、受限出站網路流量、紅隊測試預期具備強大安全治理憲法式AI,強調合規與指令遵循需客製化以滿足金融合規要求
金融穩定性影響被IMF警告可能引發系統性金融風險旨在協助金融系統應對網路威脅旨在提高金融研究效率和合規性廣泛應用可能帶來第三方依賴、市場關聯等風險

🛠️ 技術深入

  • Claude Mythos Preview 是一款前沿的通用大型語言模型 (LLM),但在網路安全任務方面表現出卓越的能力,遠超Anthropic之前訓練的任何模型,包括Claude Opus。
  • 該模型具有1M token的上下文窗口和128K的最大輸出token。
  • 它支援「自適應思維」(adaptive thinking) 功能,允許模型在即時響應和擴展思考之間切換。
  • Mythos Preview 的知識截止日期為2025年12月。
  • 在測試中,Mythos Preview 能夠自主識別並利用零日漏洞,包括在所有主流作業系統和網路瀏覽器中發現的漏洞。
  • 它曾自主編寫一個網路瀏覽器漏洞,將四個漏洞串聯起來,成功逃脫渲染器和作業系統沙箱。
  • 該模型還能自主獲取Linux和其他作業系統上的本地權限提升漏洞,並編寫FreeBSD NFS伺服器上的遠端程式碼執行漏洞。
  • Anthropic 的模型(包括Claude系列)採用「憲法式AI」(Constitutional AI) 方法來確保安全性,這涉及實時憲法分類器、增強的安全措施、限制出站網路流量以及由外部安全專家進行的密集紅隊測試。
  • 「Project Glasswing」是Anthropic的一項計畫,旨在將Claude Mythos Preview 發布給有限的「關鍵行業合作夥伴和開源開發者」,並限制其僅用於網路安全目的。

🔮 前景展望AI analysis grounded in cited sources

全球金融監管機構將加速制定AI在金融領域的監管框架。
Claude Mythos揭示的AI網路安全風險,促使英國央行和金融穩定委員會等機構積極評估並準備發布AI使用指南,預計下個月將發布諮詢文件。
AI模型開發商將面臨更嚴格的安全披露和合作要求。
Anthropic與全球監管機構的合作開創了先例,表明未來AI模型在發布前可能需要與監管機構進行更深入的安全評估和資訊共享。
金融機構將大幅增加對AI驅動網路安全防禦的投資。
鑑於Mythos等AI模型能以前所未有的速度發現高嚴重性漏洞,金融機構將被迫加速審查其網路安全安排並部署軟體補丁,同時也可能採用AI工具來強化防禦。

時間線

2021-01
Anthropic 成立,專注於AI安全研究。
2022
Anthropic 完成 Claude 1 模型訓練,並在有限訪問環境中提供。
2023
Claude 模型公開發布。
2024-11-14
金融穩定委員會 (FSB) 發布報告,指出AI可能加劇網路風險等金融部門漏洞。
2025-05-22
Anthropic 發布 Claude 4,並在同年7月為Claude Opus 4啟用ASL-3保護。
2026-04-07
Anthropic 推出 Claude Mythos Preview 模型,作為「Project Glasswing」的一部分,並發現了數千個高嚴重性漏洞。
2026-05-18
Anthropic 同意應英國央行總裁 Andrew Bailey 的要求,向金融穩定委員會 (FSB) 簡報 Claude Mythos 模型發現的網路安全漏洞。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: cnBeta (Full RSS)