Search

Tag: #continual-learning27 results

調查:LLM代理記憶機制演進

調查:LLM代理記憶機制演進

這篇arXiv調查提出LLM代理記憶的三階段演進框架:儲存(軌跡保存)、反思(軌跡精煉)和經驗(軌跡抽象)。它分析了長程一致性、動態環境和持續學習等核心驅動因素。特別強調經驗階段的前瞻探索和跨軌跡抽象機制。

ArXiv AIResearchMay 11#agent-memory#continual-learning
模仿無法教會持續學習

模仿無法教會持續學習

本文主張,LLMs 使用的模仿學習無法實現如 Deep Q-Network、AlphaZero 或人類大腦般的真正持續學習。真正持續學習能建立新知識結構、支援從零開始的開放式成長,並在無專家範例下發明新概念。LLM 討論常將其窄化為記憶問題,可用更長上下文或 RAG 解決。

Page 2 of 3