TY - RPRT TI - Data-driven simulator of multi-animal behavior with unknown dynamics via offline and online reinforcement learning AU - Keisuke Fujii AU - Kazushi Tsutsui AU - Yu Teshima AU - Makoto Itoh AU - Naoya Takeishi AU - Nozomi Nishiumi AU - Ryoya Tanaka AU - Shunsuke Shigaki AU - Yoshinobu Kawahara PY - 2025 UR - https://arxiv.org/abs/2510.10451 ID - 2510.10451 ER -