
Tesla FSD 在德州致命車禍後引發審查
一場涉及 Tesla Model 3 的德州致命車禍導致駕駛面臨刑事指控,據稱該駕駛在手動加速衝入住宅前,曾搜尋過「FSD 太保守」相關資訊。
Tag: #ai-safety536 results

一場涉及 Tesla Model 3 的德州致命車禍導致駕駛面臨刑事指控,據稱該駕駛在手動加速衝入住宅前,曾搜尋過「FSD 太保守」相關資訊。
騰訊遊戲發布 2026 年暑期未成年人保護專項行動,採用 AI 雙引擎防沉迷模式。整合 Hunyuan 與 DeepSeek 模型,提供家長對話式管理與遊戲內多模態身份驗證。

一份最新的行業報告指出頂尖 AI 模型在惡意部署能力方面存在結構性脆弱。同時,Anthropic 因國家安全考量限制了歐洲的存取權限,而中國開發者則持續透過 API 代理繞過封鎖。

AI 代理測試新創公司 Patronus AI 獲得 5,000 萬美元融資,將用於開發專門對 AI 代理進行壓力測試的「數位世界」。該公司由前 Meta AI 研究人員創立,目前市場對其安全性與評估基礎設施的需求極高。

研究人員證實 ChatGPT 仍可被操縱以生成色情與暴力圖像。這凸顯了大型語言模型在 AI 安全與內容審核方面持續面臨的挑戰。

Pramaana Labs 獲得 Khosla Ventures 2,700 萬美元種子輪融資,旨在為 AI 系統開發形式驗證方法。該公司致力於提升法律、藥物研發及稅務準備等高風險領域的 AI 可靠性。
DeepMind 推出了 AI 控制路線圖以確保內部系統安全。該策略結合了傳統防護措施與即時監控,以管理代理行為。

OSGuard 是一個雙粒度基準測試,旨在透過評估本地防護決策與端到端執行,來檢測電腦操作代理的安全性。它能協助識別代理程式在桌面或網頁環境中,透過不安全捷徑達成任務目標的潛在風險。

Anthropic 領導層與白宮官員會面,討論即將推出的 Claude Fable 5 模型的安全性。儘管進行了高層對話,雙方對於該 AI 系統可能帶來的風險仍存在分歧。
研究人員發現了「驗證者稅」現象,即隨著任務複雜度增加,為工具使用型 LLM 代理實施安全檢查會降低任務完成率。該研究提出了一種雙層驗證架構,旨在平衡安全約束與操作成功率。