@misc{indiciae12e758fd88ba, title = {An Efficient Task-Oriented Dialogue Policy: Evolutionary Reinforcement Learning Injected by Elite Individuals}, author = {Yangyang Zhao and Ben Niu and Libo Qin and Shihan Wang}, year = {2025}, url = {https://arxiv.org/abs/2506.03519}, note = {Source identifier: 2506.03519} }