TY - RPRT TI - Global Reinforcement Learning: Beyond Linear and Convex Rewards via Submodular Semi-gradient Methods AU - Riccardo De Santi AU - Manish Prajapat AU - Andreas Krause PY - 2024 UR - https://arxiv.org/abs/2407.09905 ID - 2407.09905 ER -