TY - RPRT TI - Reinforcement Learning with Continuous Actions Under Unmeasured Confounding AU - Yuhan Li AU - Eugene Han AU - Yifan Hu AU - Wenzhuo Zhou AU - Zhengling Qi AU - Yifan Cui AU - Ruoqing Zhu PY - 2025 UR - https://arxiv.org/abs/2505.00304 ID - 2505.00304 ER -