TY - RPRT TI - Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning AU - Abdelghani Ghanem AU - Mounir Ghogho PY - 2026 UR - https://arxiv.org/abs/2605.06156 ID - 2605.06156 ER -