TY - RPRT TI - RLPrompt: Optimizing Discrete Text Prompts with Reinforcement Learning AU - Mingkai Deng AU - Jianyu Wang AU - Cheng-Ping Hsieh AU - Yihan Wang AU - Han Guo AU - Tianmin Shu AU - Meng Song AU - Eric P. Xing AU - Zhiting Hu PY - 2022 UR - https://arxiv.org/abs/2205.12548 ID - 2205.12548 ER -