Search

直接匹配不多,已補上最新動態。

Tag: #meta-rl1 results

MAGE:元強化學習驅動策略性語言代理

MAGE:元強化學習驅動策略性語言代理

MAGE 是一種元強化學習框架,讓大型語言模型代理在多代理環境中具備策略性探索與利用能力。它採用多回合訓練,將互動歷史與反思整合進上下文視窗,並以最終回合獎勵作為優化目標。實驗顯示其超越基準,並對未見對手展現強大泛化能力。

ArXiv AIResearchMar 5#meta-rl#llm-agents#multi-agent