TY - RPRT TI - Enabling Pareto-Stationarity Exploration in Multi-Objective Reinforcement Learning: A Multi-Objective Weighted-Chebyshev Actor-Critic Approach AU - Fnu Hairi AU - Jiao Yang AU - Tianchen Zhou AU - Haibo Yang AU - Chaosheng Dong AU - Fan Yang AU - Michinari Momma AU - Yan Gao AU - Jia Liu PY - 2025 UR - https://arxiv.org/abs/2507.21397 ID - 2507.21397 ER -