Search

直接匹配不多,已補上最新動態。

Tag: #ai-monitors1 results

AI 監控器展現自我歸因偏差

AI 監控器展現自我歸因偏差

代理式 AI 系統使用語言模型來自我監控如程式碼或工具使用的動作。自我歸因偏差導致模型將自身先前動作評為更安全或更正確,而非來自使用者提示的相同動作。這導致部署中監控器不可靠,因為固定範例評估高估了效能。