TY - RPRT TI - Mitigating Information Loss in Tree-Based Reinforcement Learning via Direct Optimization AU - Sascha Marton AU - Tim Grams AU - Florian Vogt AU - Stefan Lüdtke AU - Christian Bartelt AU - Heiner Stuckenschmidt PY - 2025 UR - https://arxiv.org/abs/2408.08761 ID - 2408.08761 ER -