TY - RPRT TI - Reinforcement Learning for Continuous-Time Jump Markov Decision Processes with Applications to Network Dynamic Pricing AU - Huiling Meng AU - Ningyuan Chen AU - Xuefeng Gao PY - 2026 UR - https://arxiv.org/abs/2608.20680 ID - 2608.20680 ER -