TY - RPRT TI - Extending a Quantum Reinforcement Learning Exploration Policy with Flags to Connect Four AU - Filipe Santos AU - João Paulo Fernandes AU - Luís Macedo PY - 2025 UR - https://arxiv.org/abs/2505.04371 ID - 2505.04371 ER -