@misc{indiciae7980dc98af15, title = {Parallel \$Q\$-Learning: Scaling Off-policy Reinforcement Learning under Massively Parallel Simulation}, author = {Zechu Li and Tao Chen and Zhang-Wei Hong and Anurag Ajay and Pulkit Agrawal}, year = {2023}, url = {https://arxiv.org/abs/2307.12983}, note = {Source identifier: 2307.12983} }