@misc{indiciae9b371ea324a6, title = {Learning to Explore in Diverse Reward Settings via Temporal-Difference-Error Maximization}, author = {Sebastian Griesbach and Carlo D'Eramo}, year = {2025}, url = {https://arxiv.org/abs/2506.13345}, note = {Source identifier: 2506.13345} }