TY - RPRT TI - Scalable In-Context Reinforcement Learning with Recurrent Algorithm Distillation AU - Yuanqing Ma AU - Zhenrui Zheng AU - Chenjun Xiao PY - 2026 UR - https://arxiv.org/abs/2609.35333 ID - 2609.35333 ER -