TY - RPRT TI - Hybrid Reward-Driven Reinforcement Learning for Efficient Quantum Circuit Synthesis AU - Sara Giordano AU - Kornikar Sen AU - Miguel A. Martin-Delgado PY - 2026 DO - 10.1007/s42484-026-00359-8 UR - https://arxiv.org/abs/2507.16641 ID - 2507.16641 ER -