TY - RPRT TI - Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search AU - Max Liu AU - Chan-Hung Yu AU - Wei-Hsu Lee AU - Cheng-Wei Hung AU - Yen-Chun Chen AU - Shao-Hua Sun PY - 2025 UR - https://arxiv.org/abs/2405.16450 ID - 2405.16450 ER -