TY - RPRT TI - VariBASed: Variational Bayes-Adaptive Sequential Monte-Carlo Planning for Deep Reinforcement Learning AU - Joery A. de Vries AU - Jinke He AU - Yaniv Oren AU - Pascal R. van der Vaart AU - Mathijs M. de Weerdt AU - Matthijs T. J. Spaan PY - 2026 UR - https://arxiv.org/abs/2602.18857 ID - 2602.18857 ER -