@misc{indiciaee126fca3624e, title = {Discovering Diverse Solutions in Deep Reinforcement Learning by Maximizing State-Action-Based Mutual Information}, author = {Takayuki Osa and Voot Tangkaratt and Masashi Sugiyama}, year = {2022}, url = {https://arxiv.org/abs/2103.07084}, note = {Source identifier: 2103.07084} }