TY - RPRT TI - Learning Reach-Avoid Task with Reinforcement Learning: Vectorized Simulation and Benchmark AU - Jonas Weihing AU - Shahram Eivazi PY - 2026 UR - https://arxiv.org/abs/2607.15935 ID - 2607.15935 ER -