TY - RPRT TI - Parametrized Deep Q-Networks Learning: Reinforcement Learning with Discrete-Continuous Hybrid Action Space AU - Jiechao Xiong AU - Qing Wang AU - Zhuoran Yang AU - Peng Sun AU - Lei Han AU - Yang Zheng AU - Haobo Fu AU - Tong Zhang AU - Ji Liu AU - Han Liu PY - 2018 UR - https://arxiv.org/abs/1810.06394 ID - 1810.06394 ER -