TY - RPRT TI - Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards AU - Shuze Daniel Liu AU - Claire Chen AU - Jiabao Sean Xiao AU - Lei Lei AU - Yuheng Zhang AU - Yisong Yue AU - David Simchi-Levi PY - 2026 UR - https://arxiv.org/abs/2604.09855 ID - 2604.09855 ER -