TY - RPRT TI - On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond AU - Thanh Nguyen-Tang AU - Raman Arora PY - 2024 UR - https://arxiv.org/abs/2401.03301 ID - 2401.03301 ER -