TY - RPRT TI - PerSim: Data-Efficient Offline Reinforcement Learning with Heterogeneous Agents via Personalized Simulators AU - Anish Agarwal AU - Abdullah Alomar AU - Varkey Alumootil AU - Devavrat Shah AU - Dennis Shen AU - Zhi Xu AU - Cindy Yang PY - 2021 UR - https://arxiv.org/abs/2102.06961 ID - 2102.06961 ER -