TY - RPRT TI - From Player to Master: Enhancing Test-Time Learning of LLM Agents via Reinforcement Learning over Memory AU - Yishuo Cai AU - Xingyu Guo AU - Xuancheng Huang AU - Jinhua Du AU - Can Huang AU - Wenxuan Huang AU - Wenhan Ma AU - Yuyang Hu AU - Aohan Zeng AU - Jie Tang AU - Xu Sun PY - 2026 UR - https://arxiv.org/abs/2606.08656 ID - 2606.08656 ER -