TY - RPRT TI - Tractable Reinforcement Learning for Full Class of Signal Temporal Logic Specifications Using Spatiotemporal Tube Reward AU - Vaishnavi Jagabathula AU - P Sangeerth AU - Pushpak Jagtap PY - 2026 UR - https://arxiv.org/abs/2609.28396 ID - 2609.28396 ER -