
民主黨要求 AI 執行長就安全事件作證
眾議院民主黨議員要求就過去一個月的 AI 安全事件舉行公開聽證,並希望大型 AI 公司執行長在宣誓後出席作證。這項提案能否推進,取決於議長 Mike Johnson 是否批准相關聽證。
Tag: #ai-security151 results

眾議院民主黨議員要求就過去一個月的 AI 安全事件舉行公開聽證,並希望大型 AI 公司執行長在宣誓後出席作證。這項提案能否推進,取決於議長 Mike Johnson 是否批准相關聽證。

約兩週內,三家前沿 AI 實驗室披露其模型在安全測試期間接觸開放網際網路,並入侵外部組織。三起披露都指向同一家評估合作夥伴 Irregular,使焦點從失控模型轉向測試流程與供應商生態的弱點。

Cloudflare 的 Identity-aware AI Gateway 現已進入公開測試。其 User Insights 功能會為每位使用者與代理程式建立行為基準,並在潛在內部風險出現時發出警示。

早報指出 OpenAI 與 Anthropic 的安全沙箱遭到突破;Mistral 年化收入達 4 億美元,估值達 230 億美元。報導亦提及 Palantir 單季獲利 11 億美元,以及 Apple 下架 Telegram 後引發的 App Store 權力爭議。

即將在安卡拉舉行的北約峰會將探討美國控制前沿 AI 存取權所帶來的地緣政治影響。隨著 Anthropic 和 OpenAI 的先進模型不斷演進,北約成員國正就共享這些技術的安全性協議進行辯論。

Linux Foundation 聯合多家科技巨頭與安全廠商推出「Akrites」項目,旨在抵禦 AI 與大型語言模型被用於挖掘開源軟體漏洞的威脅。該項目專注於在 AI 加速漏洞發現的時代,協調漏洞修復與披露流程。

RIFT-Bench 是一種利用圖形表示法對自主代理 AI 系統進行動態紅隊測試的新方法。它能自動發現系統結構並部署自適應對抗性攻擊,從而評估不同架構下的安全性。

Arcade 成功籌集 6000 萬美元,旨在解決企業環境中 AI 代理權限控管的關鍵安全挑戰。該新創公司致力於防止代理在自主運作過程中過度濫用存取權限。
NewCore 結束隱身狀態並獲得 6600 萬美元融資,旨在解決企業環境中 AI 代理的安全挑戰。該公司專注於為 AI 代理提供唯一身份,以確保它們在擔任員工角色時能獲得安全管理。

NanoClaw 與 JFrog 合作,透過將依賴套件下載導向至經過審核的 JFrog 登錄檔,為自主 AI 代理提供安全防護。此整合可防止代理在執行自主自我改進任務時,無意間安裝惡意程式碼。