🗾ITmedia AI+ (日本)•較早收集於 46m
日本金融廳攜手 Anthropic 應對 Claude Mythos AI 安全風險

💡了解監管機構如何應對下一代 AI 模型帶來的特定網路威脅能力。
⚡ 30-Second TL;DR
有什麼變化
日本金融廳成立工作小組,評估先進 AI 模型的安全風險。
為什麼重要
此合作顯示金融領域對 AI 治理採取主動態度,可能為政府如何監管高能力模型樹立先例。
下一步行動
透過測試內部系統對抗類似 Claude Mythos 等高能力模型的紅隊測試提示詞(red-teaming prompts),來審查貴組織的 AI 安全防護態勢。
誰應關注:Enterprise & Security Teams
關鍵要點
- •日本金融廳成立工作小組,評估先進 AI 模型的安全風險。
- •Anthropic 日本分公司參與該計畫,共同應對「Mythos 等級」的網路威脅。
- •重點在於開發針對金融領域 AI 驅動網路攻擊的防禦策略。
🧠 深度解析
Web-grounded analysis with 29 cited sources.
🔑 增強重點摘要
- •「Claude Mythos Preview」是一款由Anthropic開發的通用型前沿AI模型,而非專為網路安全訓練,但其卓越的程式碼理解、推理和自主任務執行能力,使其在漏洞發現與利用方面表現突出,遠超其前代模型Claude Opus 4.6。
- •Anthropic因「Claude Mythos Preview」具備自主識別並利用主流作業系統和瀏覽器中數千個零日漏洞的極高網路攻擊能力,決定不向公眾開放,而是透過「Project Glasswing」計畫,僅向包括AWS、Apple、Google、Microsoft等約40家核心合作夥伴提供有限訪問權限,用於防禦性網路安全工作。
- •日本金融廳成立工作小組的行動,是全球監管機構對「Claude Mythos」模型潛在系統性風險的廣泛回應之一,美國、英國和加拿大等國的金融監管機構也已緊急評估其對金融穩定和關鍵基礎設施的影響。
- •日本政府的應對措施不僅限於金融廳,還包括財務省、日本央行、國家網路安全局以及三大銀行等機構的參與,並計劃將相關安全要求擴展至地方銀行等地區金融機構,以強化整體金融體系的防禦能力。
- •Anthropic為「Project Glasswing」計畫提供了最高1億美元的API額度,並向開源安全組織捐贈400萬美元,以支持利用Mythos模型進行防禦性資安工作,這反映了AI安全領域所需的巨大投入規模。
🛠️ 技術深入
- 模型定位與能力:Claude Mythos Preview是一款通用型前沿AI模型,其強大的程式碼理解、推理和自主任務執行能力,使其在網路安全領域展現出卓越的漏洞發現與利用能力,而非專門為網路安全訓練。
- 基準測試表現:該模型在多項基準測試中顯著超越Anthropic先前的旗艦模型Claude Opus 4.6,例如在SWE-bench Pro(真實世界軟體工程)中得分顯著領先,在USAMO(數學奧林匹克級推理)中達到97.6%(Opus 4.6為42.3%),在CyberGym漏洞重現任務中成功率達83.1%(Opus 4.6為66.6%),並在Cybench (CTF) 35項挑戰中全數成功。
- 自主漏洞發現與利用:Mythos能夠自主識別並利用主流作業系統和網頁瀏覽器中此前未被發現的零日漏洞。例如,它曾發現開源程式FFmpeg中存在16年之久的漏洞,以及OpenBSD系統中潛藏27年的漏洞。
- 憲法式AI (Constitutional AI, CAI):Anthropic的核心訓練方法,旨在透過一套人類定義的原則(「憲法」)讓AI進行自我評估和自我修正,以減少有害輸出並保持有用性,而無需大量人類標註。Claude的「憲法」於2026年1月進行了改訂,明確將「廣泛安全性」和「廣泛倫理性」置於「Anthropic指南遵循」和「真實有用性」之前。
🔮 前景展望AI analysis grounded in cited sources
金融機構將加速採用「零信任」安全架構。
鑑於像Claude Mythos這樣能夠自動化發現和利用漏洞的先進AI模型,傳統的安全模式已不足以應對,促使日本及其他國家呼籲導入更主動、適應性強的零信任原則。
全球金融監管機構將制定更嚴格且協調一致的AI安全規範。
Claude Mythos帶來的系統性風險已引起多國金融監管機構的緊急關注和會議,預示著未來將有更統一的國際監管框架來應對AI驅動的網路威脅。
AI在網路安全領域的攻防兩端將出現「AI對AI」的自動化對抗。
Mythos展示了AI在自動化攻擊方面的強大能力,這將迫使防禦方也必須開發同樣強大的AI工具來應對,以保護關鍵資產。
⏳ 時間線
2021
Anthropic成立,由OpenAI前研究副總裁Dario Amodei等人創立,專注於AI安全研究。
2022-12
Anthropic發表「憲法式AI (Constitutional AI)」論文,作為其AI對齊的核心訓練方法。
2023-03
Anthropic發布初代Claude模型。
2023-05
Anthropic首次公開Claude的「憲法」原則。
2025-03
日本金融廳發布AI討論文件,調查130家金融機構的GenAI應用現況與挑戰,並承諾支持穩健運用AI。
2026-01
Anthropic發布Claude「憲法」的改訂版,強調安全性與倫理性的優先順序。
2026-04-07
Anthropic發布「Claude Mythos Preview」,並宣布因其高風險能力不對外公開,僅透過「Project Glasswing」提供給限定合作夥伴用於防禦性資安工作。
2026-04-24
日本財務大臣片山皋月宣布成立特別工作組,應對Anthropic Mythos模型帶來的金融體系網路安全風險。
2026-05-14
日本金融廳成立工作小組,旨在應對Anthropic的「Claude Mythos Preview」等先進AI模型帶來的網路安全風險。
📎 來源 (29)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
- Google Search Source
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ITmedia AI+ (日本) ↗

