TY - RPRT TI - Achieving the Asymptotically Optimal Sample Complexity of Offline Reinforcement Learning: A DRO-Based Approach AU - Yue Wang AU - Jinjun Xiong AU - Shaofeng Zou PY - 2024 UR - https://arxiv.org/abs/2305.13289 ID - 2305.13289 ER -