Search

直接匹配不多,已補上最新動態。

Tag: #game-agents3 results

COSPLAY:共同演化LLM代理用於長時程任務

COSPLAY:共同演化LLM代理用於長時程任務

COSPLAY是一個共同演化框架,其中LLM決策代理從可學習技能庫檢索技能來引導行動,同時技能管道從滾動中發現並精煉可重用技能。它提升了遊戲中長時程決策能力,適用於部分可觀測性和延遲獎勵環境。使用8B模型,在單人遊戲基準上比基準提升平均25.1%獎勵。

ArXiv AIResearchApr 24#co-evolution#skill-bank#long-horizon
🔬

影像解析度會改變模型的類腦評估結果

一篇預印本指出,在 V1 比較中,評估影像解析度會大幅改變哪種 CNN 學習規則看起來最接近人腦。研究涵蓋六種影像解析度,發現未訓練模型在 V1 的表面優勢很大程度上是評估解析度造成的,而 backpropagation 在 LOC 仍保有優勢。

Reddit r/MachineLearningCommunity4h ago#visual-cortex#rsa