@misc{indiciaea61e2f003c86, title = {Dream to Chat: Model-based Reinforcement Learning on Dialogues with User Belief Modeling}, author = {Yue Zhao and Xiaoyu Wang and Dan Wang and Zhonglin Jiang and Qingqing Gu and Teng Chen and Ningyuan Xi and Jinxian Qu and Yong Chen and Luo Ji}, year = {2025}, url = {https://arxiv.org/abs/2508.16876}, note = {Source identifier: 2508.16876} }