TY - RPRT TI - Finite-Time Convergence and Sample Complexity of Actor-Critic Multi-Objective Reinforcement Learning AU - Tianchen Zhou AU - FNU Hairi AU - Haibo Yang AU - Jia Liu AU - Tian Tong AU - Fan Yang AU - Michinari Momma AU - Yan Gao PY - 2024 UR - https://arxiv.org/abs/2405.03082 ID - 2405.03082 ER -