TY - RPRT TI - RLAC: Reinforcement Learning with Adversarial Critic for Free-Form Generation Tasks AU - Mian Wu AU - Gavin Zhang AU - Sewon Min AU - Sergey Levine AU - Aviral Kumar PY - 2025 UR - https://arxiv.org/abs/2511.01758 ID - 2511.01758 ER -