TY - RPRT TI - EXPO: Stable Reinforcement Learning with Expressive Policies AU - Perry Dong AU - Qiyang Li AU - Dorsa Sadigh AU - Chelsea Finn PY - 2026 UR - https://arxiv.org/abs/2507.07986 ID - 2507.07986 ER -