TY - RPRT TI - Self-Composing Policies for Scalable Continual Reinforcement Learning AU - Mikel Malagón AU - Josu Ceberio AU - Jose A. Lozano PY - 2025 UR - https://arxiv.org/abs/2506.14811 ID - 2506.14811 ER -