TY - RPRT TI - Reinforcement Learning for Adaptive Composition of Quantum Circuit Optimisation Passes AU - Daniel Mills AU - Ifan Williams AU - Jacob Swain AU - Gabriel Matos AU - Enrico Rinaldi AU - Alexander Koziell-Pipe PY - 2026 UR - https://arxiv.org/abs/2601.21629 ID - 2601.21629 ER -