Tesla 駕駛因 Autopilot 車禍遭控過失致死罪
一名 Tesla 駕駛因其開啟 Autopilot 功能的車輛撞入德州一處民宅,導致屋內一名女性死亡,目前已被控過失致死罪。
Tag: #ai-safety539 results
一名 Tesla 駕駛因其開啟 Autopilot 功能的車輛撞入德州一處民宅,導致屋內一名女性死亡,目前已被控過失致死罪。

一份新報告指出,奈及利亞在應對 2027 年選舉中 AI 生成的錯誤資訊方面準備不足。選舉當局正努力應對政治競選中深偽音訊與編輯圖像氾濫的問題。

本研究引入了一種情境多臂老虎機(contextual-bandit)博弈模型,旨在解決人類與 AI 雙方皆持有私有資訊時的監督挑戰。研究定義了「可避免傷害的缺口」,並探討了透過重複互動如何解決人類與自主代理之間的溝通失效問題。

「有限道德」(Bounded Morality)框架引入了一種正式方法,透過在有限資源限制下平衡「道德廣度」與「道德深度」來評估道德計算。該研究指出,AI 的道德對齊應專注於擴展推理能力,而非僅僅模仿人類判斷。

有報導指出,ChatGPT 出現的部分爭議性回答,與 Meta 委託第三方外包商進行的安全測試有關。這凸顯了 AI 模型安全訓練與數據標註流程中的複雜性與潛在風險。

一個全新的網站已經上線,允許用戶舉報表現出危險行為的 AI 模型,例如協助非法活動或洩露私人數據。此舉旨在提供一個集中的管道來解決 AI 安全問題。

Meta 僱用了數百名合同工,要求他們在網路上偽裝成未成年人,以測試競爭對手的聊天機器人對高風險提示詞的反應。此舉旨在評估 AI 在自殘、性內容及飲食失調等議題上的安全防護機制。
Meta 聘請了數百名承包商假冒青少年,對 ChatGPT 和 Gemini 等競爭對手 AI 模型進行安全性漏洞測試。該項目旨在誘導模型針對自殘、性內容和藥物濫用等高風險主題做出回應。

DuckDuckGo 的 AI 搜尋助手被成功操縱,重複了一則虛構的故事。此事件凸顯了在 AI 驅動的搜尋系統中防止錯誤資訊的持續挑戰。
由科技業資助的政治行動委員會(PAC)正積極針對支持嚴格 AI 監管的政治人物進行競選活動。Alex Bores 在紐約初選中的落敗,引發了關於 AI 安全政見在政治上是否可行的辯論。