TY - RPRT TI - Max-Entropy Reinforcement Learning with Flow Matching and A Case Study on LQR AU - Yuyang Zhang AU - Yang Hu AU - Bo Dai AU - Na Li PY - 2025 UR - https://arxiv.org/abs/2512.23870 ID - 2512.23870 ER -