Search

Tag: #kv-cache63 results

⚙️

蘋果 KV 快取驅逐強化學習

大型 LLM 推理受 KV 快取記憶體需求限制。蘋果將驅逐問題重構為強化學習,依未來效用排序權杖,並推出 KVP 框架。此法避免如最近性等啟發式代理,降低額外運算負荷。

Apple Machine LearningOfficialFeb 23#kv-cache#llm-inference
Qwen 3.6 內建 preserve_thinking 功能

Qwen 3.6 內建 preserve_thinking 功能

Qwen 3.6 新增 preserve_thinking 旗標,可保留完整推理脈絡,解決先前模板的 KV 快取無效問題。此功能有利代理情境,減少權杖消耗並提升推理效率。可用簡單的兩個數字測試驗證是否啟用。

Reddit r/LocalLLaMACommunityApr 16#kv-cache#agent-reasoning
Page 5 of 7