TY - RPRT TI - LAPP: Large Language Model Feedback for Preference-Driven Reinforcement Learning AU - Pingcheng Jian AU - Xiao Wei AU - Yanbaihui Liu AU - Samuel A. Moore AU - Michael M. Zavlanos AU - Boyuan Chen PY - 2025 UR - https://arxiv.org/abs/2504.15472 ID - 2504.15472 ER -