Nvidia 致力於提升人形機器人的安全性與感知能力
Nvidia 正優先開發人形機器人的安全關鍵 AI,專注於即時危險識別。該公司旨在讓機器人能在動態環境中與人類安全地協作。
Tag: #safety85 results
Nvidia 正優先開發人形機器人的安全關鍵 AI,專注於即時危險識別。該公司旨在讓機器人能在動態環境中與人類安全地協作。

Waymo 針對近 4,000 輛自動駕駛計程車發布了第六次召回,原因是在 13 起事故中,車輛駛入了高速公路施工區域。目前軟體修復程式正在開發中。

Anthropic 應美國政府要求,將 Claude Fable 5 模型下架。此舉源於政府發現該模型存在可繞過安全防護機制的「越獄」漏洞。
Anthropic 正開放 150 個額外組織存取 Mythos,這是一款旨在識別網路安全漏洞的 AI 模型。該模型先前因其潛在危險性而受到限制。

美國財政部長貝森特與聯邦儲備主席鮑威爾在 Anthropic 公布最新「最強」AI 模型當天,召集華爾街高管舉行緊急會議。會議聚焦該模型的安全風險,反映政府對先進 AI 的擔憂。此舉顯示對先進 AI 部署的審查加劇。

OpenAI 公布「北極星」計畫,在 2028 前建成全自動多智能體研究系統,第一階段「自主 AI 研究實習生」於 2026 年 9 月落地。整合推理、智能體、可解釋性打造自運作 AI 研究員。人類對策推出 Claude Code Channels 嵌入開發流程。

這篇立場論文指出,現有的 LLM 道德評估主要關注模型輸出是否符合人類價值觀,卻忽略模型能否正確識別並應用具情境性的道德規範。論文提議建立標準化規範表示法、專家標註資料集,以及區分價值層級與規範層級能力的評估方法。

這項研究介紹了一種代理框架,利用架構師代理和圖像生成器為 MLLM 合成對抗性範例。透過自動發現邊緣案例,該系統在無需人工標註的情況下顯著提升了模型的穩健性。

NTSB 確認一名特斯拉駕駛在致命車禍前,將油門踩到底,手動覆蓋了全自動輔助駕駛(FSD)系統。電子數據顯示該車在限速 30 英里的區域內時速超過 70 英里。

在調查揭露 Instagram 在印度批准並投放宣傳兒童性虐待內容的廣告後,Meta 正面臨嚴格審查。儘管該內容在報導後已被移除,但此事件凸顯了廣告審核系統的重大缺失。