TY - RPRT TI - Q-based Variational Inverse Reinforcement Learning AU - Ondrej Bajgar AU - Peter Tisnikar AU - Alessandro Abate AU - Konstantinos Gatsis AU - Maike Osborne PY - 2026 UR - https://arxiv.org/abs/2608.16888 ID - 2608.16888 ER -