Search

Tag: #safety-benchmark5 results

BeSafe-Bench 揭露 AI 代理安全風險

BeSafe-Bench 揭露 AI 代理安全風險

BeSafe-Bench 推出基準,用於評估情境 AI 代理在網頁、手機、具身 VLM 和 VLA 功能環境中的行為安全風險。它以九類安全關鍵風險擴充任務,並採用規則檢查與 LLM 作為評審的混合評估框架。對 13 個代理的測試顯示,即使最佳代理也僅能完全安全完成不到 40% 的任務,凸顯安全對齊的迫切需求。