Search

直接匹配不多,已補上最新動態。

Tag: #threat-model2 results

預期無情反社會ASI為預設

預期無情反社會ASI為預設

文章辯論為何基於演員-評論者RL代理的腦狀AGI預設會是無情反社會,不同於LLMs或人類。作者反對現有心智的先驗,因為AI架構差異極大。強調專注特定RL-AGI威脅模型,而非一般智能類比。

AI Alignment ForumCommunityFeb 18#ai-safety#alignment#rl-agents