TY - RPRT TI - Beyond Uniform Sampling: Offline Reinforcement Learning with Imbalanced Datasets AU - Zhang-Wei Hong AU - Aviral Kumar AU - Sathwik Karnik AU - Abhishek Bhandwaldar AU - Akash Srivastava AU - Joni Pajarinen AU - Romain Laroche AU - Abhishek Gupta AU - Pulkit Agrawal PY - 2023 UR - https://arxiv.org/abs/2310.04413 ID - 2310.04413 ER -