TY - RPRT TI - Directly Forecasting Belief for Reinforcement Learning with Delays AU - Qingyuan Wu AU - Yuhui Wang AU - Simon Sinong Zhan AU - Yixuan Wang AU - Chung-Wei Lin AU - Chen Lv AU - Qi Zhu AU - Jürgen Schmidhuber AU - Chao Huang PY - 2025 UR - https://arxiv.org/abs/2505.00546 ID - 2505.00546 ER -