TY - RPRT TI - Reinforcement Learning for Long-Horizon Unordered Tasks: From Boolean to Coupled Reward Machines AU - Kristina Levina AU - Nikolaos Pappas AU - Athanasios Karapantelakis AU - Aneta Vulgarakis Feljan AU - Jendrik Seipp PY - 2026 UR - https://arxiv.org/abs/2510.27329 ID - 2510.27329 ER -