TY - RPRT TI - Enhancing sample efficiency in reinforcement-learning-based flow control: replacing the critic with an adaptive reduced-order model AU - Zesheng Yao AU - Zhen-Hua Wan AU - Canjun Yang AU - Qingchao Xia AU - Mengqi Zhang PY - 2026 UR - https://arxiv.org/abs/2604.04986 ID - 2604.04986 ER -