TY - RPRT TI - Offline Meta-Reinforcement Learning with Flow-Based Task Inference and Adaptive Correction of Feature Overgeneralization AU - Min Wang AU - Xin Li AU - Mingzhong Wang AU - Hasnaa Bennis PY - 2026 UR - https://arxiv.org/abs/2601.07164 ID - 2601.07164 ER -