Search

Tag: #safety85 results

REVELIO:揭示 VLM 的可解釋性失效模式

REVELIO:揭示 VLM 的可解釋性失效模式

REVELIO 是一個旨在系統性識別視覺語言模型 (VLM) 可解釋失效模式的新框架。透過結合多樣性感知束搜尋與高斯過程湯普森採樣,該框架能找出模型在特定場景(如自動駕駛或機器人技術)中持續失敗的具體原因。

ArXiv AIResearchMay 14#vlm#safety#robotics
📰

OpenClaw團隊應對安全、成本與中國熱潮

OpenClaw核心維護者Josh與Vincent討論專案起源於個人需求、快速成長及支援非技術用戶。他們強調透過沙盒與社群審核的安全措施、優化提示詞控制token帳單的策略,以及多模型相容性挑戰。未來代理將自我演化,中國企業採用強勁。

虎嗅MediaMay 13#agent#safety#community
Page 2 of 9