TY - RPRT TI - One Step, One Lead: Mitigating Higher-Order Interference in Multi-Domain Reinforcement Learning via Cross-Step Control AU - Zihan Lin AU - Xiaohan Wang AU - Jie Cao AU - Jiajun Chai AU - Guojun Yin AU - Wei Lin AU - Ran He PY - 2026 UR - https://arxiv.org/abs/2609.06469 ID - 2609.06469 ER -