TY - RPRT TI - Control as Probabilistic Inference as an Emergent Communication Mechanism in Multi-Agent Reinforcement Learning AU - Tomoaki Nakamura AU - Akira Taniguchi AU - Tadahiro Taniguchi PY - 2023 UR - https://arxiv.org/abs/2307.05004 ID - 2307.05004 ER -