
為何 Agent 安全需要系統層級控制
Docker 分析一宗涉及 OpenAI 與 Hugging Face、包含 17,600 次攻擊者操作的事件,說明人工作業審查對 AI Agent 的限制。文章主張,Agent 需要能大規模約束、觀察與治理其行為的控制機制。
Tag: #governance131 results

Docker 分析一宗涉及 OpenAI 與 Hugging Face、包含 17,600 次攻擊者操作的事件,說明人工作業審查對 AI Agent 的限制。文章主張,Agent 需要能大規模約束、觀察與治理其行為的控制機制。

本文剖析 Dario Amodei 同時身為 AI 安全倡議者,以及 Anthropic 前沿模型加速開發領導者的雙重角色。文章追溯他在科學研究、OpenAI、規模定律與組織衝突中的經歷,如何塑造 Anthropic 的策略與治理理念。
文章探討外界日益要求對前沿 AI 開發者進行獨立監督的呼聲,包括 Demis Hassabis 提議成立仿效 FINRA、由產業出資並由獨立技術專家組成的標準機構。文章也討論 OpenAI 與 Anthropic 的 AI Agent 評測事故,主張 AI 能力的創造者不應獨自界定安全邊界與責任歸屬。
文章指出隨著 AI Agent 獲得自主權,企業必須從「築牆」轉向「築壩」以管理風險。重點在於控制自動化系統的「災難半徑」,而非單純限制流動。

本文概述了 EU AI Act 在不同風險等級下的合規要求。它為工程團隊提供了在 2027 年前落實 AI 治理的執行路徑。

OpenAI、Anthropic 與 Google DeepMind 的執行長將出席在法國舉行的 G7 峰會。他們將與各國領袖共同探討人工智慧的監管與安全未來。

伊隆·馬斯克與山姆·奧特曼在一場高風險審判中對決,此審判可能塑造 OpenAI 的未來方向。馬斯克對 AI 危險的立場不斷變化,可能使關於 OpenAI 原先非營利使命的論點變得複雜。

OpenAI 從非營利轉為營利涉嫌違反慈善信託,奧克蘭聯邦法院週一開始陪審團選拔。共同創辦人 Elon Musk 捐款至少 3800 萬美元,起訴 Sam Altman。Brockman 日記稱其為謊言,將作為證據呈堂。

南非推出新AI政策,強調靈活性而非嚴格控制。責任分散至現有政府機構。此方法偏好協調而非自上而下監督。
獲核准的 Daybreak 合作夥伴現在可以使用 OpenAI 的前沿網路安全模型,為客戶提供經授權且受治理的網路安全服務。這項更新透過經審核的合作夥伴擴大模型存取,而非向大眾無限制開放。