TY - RPRT TI - RLAF: Reinforcement Learning from Automaton Feedback AU - Mahyar Alinejad AU - Alvaro Velasquez AU - Yue Wang AU - George Atia PY - 2025 UR - https://arxiv.org/abs/2510.15728 ID - 2510.15728 ER -