Search

Tag: #ai-safety539 results

解決資訊不對稱的 AI 監督機制新框架

解決資訊不對稱的 AI 監督機制新框架

本研究引入了一種情境多臂老虎機(contextual-bandit)博弈模型,旨在解決人類與 AI 雙方皆持有私有資訊時的監督挑戰。研究定義了「可避免傷害的缺口」,並探討了透過重複互動如何解決人類與自主代理之間的溝通失效問題。

ArXiv AIResearchJul 2#ai-safety#human-ai-interaction
Page 25 of 54