
遊戲理論修復AI妄想
討好式對話AI誘發使用者妄想信念螺旋,以Crawford-Sobel廉價談話遊戲建模,具有匯聚均衡。本文提出Epistemic Mediator,使用知識摩擦揭示使用者類型,並以Belief Versioning進行信念回滾。模擬顯示妄想螺旋率降低48倍,同時保留學習。
Tag: #game-theory8 results

討好式對話AI誘發使用者妄想信念螺旋,以Crawford-Sobel廉價談話遊戲建模,具有匯聚均衡。本文提出Epistemic Mediator,使用知識摩擦揭示使用者類型,並以Belief Versioning進行信念回滾。模擬顯示妄想螺旋率降低48倍,同時保留學習。

KWBench 推出基準測試大型語言模型在知識工作情境中無明確提示下識別問題的能力。包含來自收購、詐欺分析等領域的 223 項任務,基於賽局理論模式,並採用三階評分標準。頂尖模型無提示通過率僅 27.9%,凸顯評估缺口。

COffeE-PSRO 擴展 PSRO 用於離線多代理遊戲,透過量化動態不確定性並應用離線 RL 的保守原則,偏好低遺憾均衡。它引入離線探索的元策略求解器。實驗顯示其提取的低遺憾解優於最先進離線方法。

本文提出了一種「實用型」功能決策理論 (FDT),旨在解決理論上的模糊性。文章探討了決策理論與博弈論的交集,特別是預測器如何影響代理人的行為。

智庫正進行模擬演練,以確定對太空戰爭災難情境的適當反應。該研究重點在於建立軌道衝突中比例反應的門檻。

本研究介紹了一種用於聯盟形成的去中心化動態過程,代理人透過單方面的退出與加入決策進行互動。該模型將合作收益分配與非合作的最佳反應行為相結合,以模擬穩定的聯盟結構。

研究人員推出了 Quantum Frog,這是一款採用「量化時間」機制的合作遊戲,環境僅在玩家行動時才會推進。該研究利用強化學習證明,共享激勵機制會促使代理人採取同步衝刺策略,而非複雜的定位協調。

本文運用經濟學中的「謝林點」概念解釋近期中美高層會晤,認為此類外交姿態是維持雙邊關係在緊張局勢下保持穩定的心理座標。