@misc{indiciae13eaf50490ef, title = {On Multi-objective Policy Optimization as a Tool for Reinforcement Learning: Case Studies in Offline RL and Finetuning}, author = {Abbas Abdolmaleki and Sandy H. Huang and Giulia Vezzani and Bobak Shahriari and Jost Tobias Springenberg and Shruti Mishra and Dhruva TB and Arunkumar Byravan and Konstantinos Bousmalis and Andras Gyorgy and Csaba Szepesvari and Raia Hadsell and Nicolas Heess and Martin Riedmiller}, year = {2023}, url = {https://arxiv.org/abs/2106.08199}, note = {Source identifier: 2106.08199} }