TY - RPRT TI - Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic AU - Thanh Vinh Vo AU - Young Lee AU - Haozhe Ma AU - Chien Lu AU - Tze-Yun Leong PY - 2025 UR - https://arxiv.org/abs/2506.05445 ID - 2506.05445 ER -