Search

Tag: #metacognition11 results

MEDLEY-BENCH:規模提升評估而非控制

MEDLEY-BENCH:規模提升評估而非控制

MEDLEY-BENCH 推出 AI 元認知基準測試,將推理、私人自我修正及社會影響修正分離,在模型間真實分歧下進行評估。它評估 12 個家族的 35 個模型,橫跨五個領域,顯示規模提升評估能力但非控制能力。小型模型常匹敵或超越大型模型,挑戰規模為元認知唯一途徑的觀念。

自我監控需結構整合

自我監控需結構整合

自我監控模組如元認知作為輔助損失,在連續時間多時間尺度RL代理中各種捕食者-獵物環境中無顯著益處。將輸出結構整合至決策路徑,在非穩態環境中帶來邊際改善,但未優於基準。關鍵教訓:自我監控須直接影響決策,而非平行運行。

🤖

Metacognition Reduces LLM Slop, Aids Alignment

LLMs lack human-like metacognitive skills, causing errors, sycophancy, and 'slop' outputs. Enhancing metacognition could catch mistakes, stabilize alignment via reflective endorsement, and improve research utility. Benefits for alignment may outweigh capability risks, with work already underway.

AI Alignment ForumCommunityFeb 12#research#llms#ai-alignment
Page 1 of 2