TY - RPRT TI - FBOS-RL: Feedback-Driven Bi-Objective Synergistic Reinforcement Learning AU - Xikai Zhang AU - Yongzhi Li AU - Likang Xiao AU - Yingze Zhang AU - Yanhua Cheng AU - Quan Chen AU - Peng Jiang AU - Wenjun Wu AU - Liu Liu PY - 2026 UR - https://arxiv.org/abs/2605.20256 ID - 2605.20256 ER -