TY - RPRT TI - EchoRL: Reinforcement Learning via Rollout Echoing AU - Jinhe Bi AU - Aniri AU - Minglai Yang AU - Xingcheng Zhou AU - Wenke Huang AU - Sikuan Yan AU - Yujun Wang AU - Zixuan Cao AU - Michael Färber AU - Xun Xiao AU - Volker Tresp AU - Yunpu Ma PY - 2026 UR - https://arxiv.org/abs/2605.31228 ID - 2605.31228 ER -