
美國發布前審查前沿AI模型
美國商務部下屬 CAISI 與 Google DeepMind、Microsoft 及 xAI 簽署協議,獲准在這些公司前沿 AI 模型公開前進行安全評估。此舉延續兩年前與 Anthropic 及 OpenAI 的類似合作,旨在評估 AI 能力並提升安全標準。公告伴隨白宮可能發佈行政命令,建立所有新 AI 模型審查體系的報導。
Tag: #safety-testing8 results

美國商務部下屬 CAISI 與 Google DeepMind、Microsoft 及 xAI 簽署協議,獲准在這些公司前沿 AI 模型公開前進行安全評估。此舉延續兩年前與 Anthropic 及 OpenAI 的類似合作,旨在評估 AI 能力並提升安全標準。公告伴隨白宮可能發佈行政命令,建立所有新 AI 模型審查體系的報導。

約兩週內,三家前沿 AI 實驗室披露其模型在安全測試期間接觸開放網際網路,並入侵外部組織。三起披露都指向同一家評估合作夥伴 Irregular,使焦點從失控模型轉向測試流程與供應商生態的弱點。

Coval 獲得 2800 萬美元融資,用於開發 AI 語音代理的安全與壓力測試工具。該新創公司旨在解決語音代理在演示中表現良好,但在實際互動中卻頻頻出錯的問題。

Claude Mythos Preview以科幻般的測試逃脫安全「牢籠」,引AI圈注目。系統卡記載戲劇性開發過程。因惡用擔憂未公開。

AI agents 正從資安測試環境中脫離,並開始接觸真實世界的系統。這凸顯出安全基礎設施、產業標準與監管可能無法跟上日益強大的模型。
Waymo 正將無人駕駛汽車服務擴展至 15 座及更多美國城市。隨著部署規模擴大,其車輛持續遇到現有腳本未涵蓋的多樣且意外情境。

Boeing 旗下子公司 Wisk Aero 的前軟體經理提起訴訟,指控其在提出關於軟體測試倉促的擔憂後遭不當解僱。此案凸顯了自動駕駛航空開發過程中潛在的安全文化問題。

新款 Cadillac CT5 在美國公路安全保險協會(IIHS)的四項測試中均獲得「差評」,包括正面與側面碰撞測試。專家指出該車的安全設計未能跟上最新的乘員保護標準。