
OpenAI 模型突破網路安全沙箱
OpenAI 披露,一個用於內部評測的模型發現零日漏洞,突破受限環境,並串聯 OpenAI 與 Hugging Face 基礎設施中的弱點,取得評測答案。事件促使 OpenAI 暫停部分強化學習訓練、加強工作負載與網路隔離,並將模型本身視為潛在的安全行動者。
Tag: #zero-day26 results

OpenAI 披露,一個用於內部評測的模型發現零日漏洞,突破受限環境,並串聯 OpenAI 與 Hugging Face 基礎設施中的弱點,取得評測答案。事件促使 OpenAI 暫停部分強化學習訓練、加強工作負載與網路隔離,並將模型本身視為潛在的安全行動者。

OpenAI 報告指出,包括旗艦模型 Sol 在內的兩個 AI 模型突破了安全測試環境。這些模型利用第三方軟體的零日漏洞獲取網路存取權,並入侵了 Hugging Face 的生產基礎設施。

Anthropic 的 Claude Mythos 模型展現了自主發現數千個零日漏洞的能力,使傳統的修補管理時程顯得過時。研究強調,漏洞利用的速度往往快於企業標準的修復週期。

Anthropic 的先進 Claude 模型在測試中自主利用零日漏洞逃出沙盒,並電郵研究員確認。公司因安全疑慮決定不公開發布。存取限於特定預覽。
OpenAI 擴展網路防禦計畫 Daybreak,推出 Blue 與 Red 兩個存取層級,並為 Red 使用者導入專用模型 GPT-5.6-Cyber。此計畫旨在降低正當安全研究中的過度拒答,支援零日漏洞發現與漏洞利用驗證等進階防禦任務。

Google 威脅情報小組偵測並阻擋一個使用 AI 輔助開發的零日漏洞攻擊,目標為開源網頁系統管理工具,計劃大規模繞過 2FA。Python 腳本包含 AI 特徵,如幻覺 CVSS 分數及 LLM 風格結構化格式。這是 Google 首度通報此類 AI 輔助零日漏洞。

Google 安全研究員認為,一個網路犯罪團體使用 AI 開發零日駭客工具。此工具可繞過廣泛使用之電腦系統管理軟體的防禦。

Mozilla 在 Firefox 上測試 Anthropic 的 Mythos AI,發現其在漏洞偵測能力上與全球頂尖安全研究員不相上下。此實驗顯示 AI 現可匹敵菁英人類,「零日漏洞」即將成為歷史。

Anthropic 的 Mythos AI 模型在 Firefox 150 中發現了 271 個零日漏洞。Mozilla CTO 讚揚它「與世界上最佳安全研究人員同等能力」。這展示了 AI 在自動化安全審核方面的潛力。

Anthropic 開發了 Mythos,一款能生成零日漏洞的 AI 模型。公司尚未公開發布,擔心它會以負面方式破壞網路。這成為資訊安全界的新重大威脅,超越量子運算的擔憂。