Yandex 研究團隊探討將 KV-cache 作為代理執行階段,藉修改推論狀態提升 LLM 互動性團隊指出推論設計是代理能力中被低估的發展方向,並預告將展示 Qwen3.8-27B 透過此技術互動遊玩 DOOM 的實測成果。Reddit r/MachineLearning單一來源