@misc{indiciae3dab2b37d97d, title = {QPO: Query-dependent Prompt Optimization via Multi-Loop Offline Reinforcement Learning}, author = {Yilun Kong and Hangyu Mao and Qi Zhao and Bin Zhang and Jingqing Ruan and Li Shen and Yongzhe Chang and Xueqian Wang and Rui Zhao and Dacheng Tao}, year = {2025}, url = {https://arxiv.org/abs/2408.10504}, note = {Source identifier: 2408.10504} }