TY - RPRT TI - Provably Efficient Exploration in Quantum Reinforcement Learning with Logarithmic Worst-Case Regret AU - Han Zhong AU - Jiachen Hu AU - Yecheng Xue AU - Tongyang Li AU - Liwei Wang PY - 2024 UR - https://arxiv.org/abs/2302.10796 ID - 2302.10796 ER -