TY - RPRT TI - Learning to Trust Bellman Updates: Selective State-Adaptive Regularization for Offline RL AU - Qin-Wen Luo AU - Ming-Kun Xie AU - Ye-Wen Wang AU - Sheng-Jun Huang PY - 2025 UR - https://arxiv.org/abs/2505.19923 ID - 2505.19923 ER -