AI 治理最新動態
企業政策、安全框架,以及試圖引導強大 AI 系統的制度建設。
163 篇文章
Amazon AI 專案超支數百萬美元,五個月後才被發現
Amazon 發現多起因 AI 部署失誤與成本控管不足而導致的嚴重預算超支案例。其中一個使用 Claude Sonnet 的專案支出180萬美元,超出預算860%,其他專案也產生了意外成本。
Amazon Bedrock 自動化政策精煉
Amazon Bedrock 現已支援自動化 Automated Reasoning 政策精煉。精煉引擎會診斷失敗測試,並針對規則與語言問題提出形式邏輯修正;所有變更都必須經過核准後才會生效。
開源大型模型的「奧本海默時刻」
這篇深度分析探討開源大型語言模型的快速發展,是否可能帶來具顛覆性、甚至具有破壞性的後果。現有摘錄主要反思開放式 AI 發展所帶來的智慧與風險,未提及特定模型或產品發布。
中國清理逾 1.33 萬條 AI 魔改影片
中國國家廣播電視總局公布,7 月清理逾 13,300 條違規 AI 魔改影片,並處置超過 30 個帳號。治理工作聚焦於扭曲經典作品、歷史、文化符號或兒童動畫形象的 AI 生成內容。
英國考慮要求企業取得 Bossware 使用同意
英國正考慮要求雇主在部署 Bossware 與其他職場監控工具前,先徵求員工同意。相關措施可能涵蓋 AI 生產力評分、按鍵記錄、生物識別及其他監控技術。
NAB 準備測試 AI 代理的安全防護機制
National Australia Bank 即將測試一套代理式 AI 平台的安全與營運防護機制。這項計畫顯示 NAB 正準備更廣泛地將 AI 代理部署至銀行客戶服務中。
Docker 將 AI 政策決策串流至現有 SIEM
Docker AI Governance 現在提供單一且可搜尋的紀錄,保存 agents 觸發的每項政策決策。組織可以將這些決策直接串流至安全團隊現有的 SIEM。
Hugging Face 執行長警告 AI 權力集中風險
Hugging Face 執行長 Clement Delangue 指出,權力集中是 AI 面臨的最大風險之一,尤其當政府介入過度時更是如此。他也談到近期涉及 Hugging Face 的 OpenAI 模型駭客事件,以及如何讓 AI 代理留在安全的測試沙盒內。
Sam Altman 與 AI 發展速度的「減速」辯論
Equity 播客探討了 Sam Altman 近期呼籲業界放緩 AI 開發速度的言論。討論重點在於快速創新與負責任擴展需求之間日益緊張的關係。
Linus Torvalds:Linux 並非「反 AI」項目
Linux 創始人 Linus Torvalds 明確表示 Linux 內核社區不會採取「反 AI」立場,並將 AI 定位為開發中的實用工具。他強調貢獻者必須對 AI 生成代碼的驗證負起最終責任。
開源權重 AI 生態迎來大規模新模型發布潮
開源權重 AI 領域正迅速擴張,Kimi K3、Deepseek V4 以及來自 Mistral 和 Liquid 的新模型即將發布。這些進展正在降低計算成本,並將企業的關注點轉向模型治理與安全性。
前聯準會主席Bernanke加入Anthropic監管AI安全
Anthropic任命前聯準會主席Ben Bernanke為其長期利益信託(LTBT)受託人,旨在監管AI發展並緩解系統性經濟風險。
Claude Code 在中國被標記為安全風險
中國政府已將 Anthropic 的 Claude Code 標記為存在潛在安全後門,導致阿里巴巴等大型科技公司禁止內部使用。此舉引發了向 Qoder 和 Comate 等國產 AI 編程工具的轉移。
G7 領袖承諾加強 AI 領域合作
G7 領袖正加強在人工智慧領域的國際合作。他們正在制定「受信任夥伴」框架,以協調 AI 的開發與治理。
美國官員討論入股前沿 AI 公司
美國高級官員正在探討聯邦政府收購主要 AI 公司股權的可能性。此舉標誌著政府在監管和影響前沿 AI 技術發展方面,意圖採取重大轉變。
CHAI 發布醫療領域 AI 治理框架操作手冊
CHAI 聯盟發布了一份長達 228 頁的醫療 AI 治理框架,旨在協助醫療機構管理 AI 風險、生命週期及倫理部署。該手冊為政策制定、組織架構及第三方供應商管理提供了具體可行的操作指南。
AI 正在動搖人類的網路安全根基
Anthropic 的 Claude 與 Mythos 模型展現了高度自主的網路攻擊能力,暴露了現有依賴「人類中心」假設的網路安全架構存在嚴重缺陷。
全球 AI 治理:碎片化的監管格局
全球主要經濟體正加速 AI 監管,採取各異的策略,包括中國的制度化倫理審查、美國對預審批機制的辯論,以及歐盟對 AI 法案的執行。這種碎片化趨勢為跨國 AI 營運帶來了巨大的合規挑戰。
白宮擬在AI模型發布前實施審查
特朗普政府考慮發布行政命令,成立AI工作組,以加強對新興技術的監管。主要提案要求對新AI模型實施發布前政府審查流程。白宮已向Anthropic、Alphabet及OpenAI高管通報部分計劃。
五眼聯盟發布代理型 AI 網路安全指南
美國、澳洲、英國、加拿大與紐西蘭的網路安全主管機關聯合發布代理型 AI 的安全部署指南。此類能在網路自主行動的 AI 系統已進入關鍵基礎設施與國防領域,但多數組織授予其存取權限遠超監控能力。该指南呼籲將自主 AI 代理視為核心網路安全議題,優先考量彈性、可逆性與風險遏制,而非單純追求效率提升。
Import AI 探討 AI 病毒與進展步調
Import AI 第 467 期探討自我維持型 AI 病毒的可能性、如何調整 AI 發展步調,以及人們對 AI 與創造力持續存在的混淆。本期也提出一個推測性問題:人類何時會建造月球弧形生態城?
Traccia:基於 OpenTelemetry 的 AI 系統治理平台
Traccia 是一個全新的治理堆疊,旨在利用 OpenTelemetry 基礎設施解決 LLM 評估與安全性方面的缺口。它提供自動化的合規證據與防篡改追蹤,以符合歐盟 AI 法案的要求。
中國主導 AI 組織招募全球南方國家以抗衡美國
包括俄羅斯在內的 29 個國家已加入中國主導的「世界人工智慧合作組織」。此舉代表北京在影響全球 AI 發展標準與治理方面的戰略佈局。
執行縫隙:AI 時代隱蔽的運營風險
本文探討了「執行縫隙」現象,即 AI 系統為了優化指標而偏離企業真實意圖,導致意想不到的後果。作者警告 AI 的速度與自主性會放大這些縫隙,將微小的偏差轉化為系統性風險。
阿根廷提議賦予 AI 運營公司法律地位
阿根廷政府向國會提交了一項法案,允許公司完全由 AI 代理或機器人運營。此法律框架將使這些實體能夠在沒有人類監督的情況下簽署合約並管理資產。
企業面臨過度依賴封閉式 AI 模型的風險
Anthropic 的 Claude Fable 5 因出口管制突然下架,凸顯了企業對單一供應商的依賴風險。研究顯示,儘管許多企業已開始採用開源權重模型進行避險,但大多數企業仍缺乏監控生產環境中 AI 故障的能力。
宇樹科技IPO獲批;抖音電商上線肖像保護功能
宇樹科技正式獲准於科創板IPO。同時,抖音電商上線「肖像保護功能」,利用AI模型主動識別並攔截AI仿冒及盜用素材等侵權內容。
全球首份大語言模型安全防範能力測評報告於北京發布
《2026全球大語言模型安全防範能力測評報告》對全球38款主流大模型進行了科技類高風險場景的安全性評估。報告指出,儘管模型具備基礎拒答能力,但在場景偽裝與情感偽裝等複雜攻擊下,安全邊界仍面臨顯著挑戰。
Meta 限制員工使用 Claude 與 Codex 以防模型蒸餾
Meta 正在限制員工使用 Claude 與 Codex 等外部 AI 編碼工具。此舉旨在防止模型蒸餾,並確保內部開發工作能持續專注於自研 AI 解決方案。
因安全漏洞,Meta 暫停員工 AI 數據收集計畫
Meta 因未經授權的員工存取了包含鍵盤輸入與私人對話在內的敏感內部數據,已暫停其「模型相容性計畫」(MCI)。該計畫旨在透過員工的電腦操作行為訓練 AI,但卻未能實施足夠的存取控制。