@misc{indiciaece82a211c3ff, title = {From Solver Feedback to Faithful Plans: Multi-Role Reinforcement Learning for Symbolic Planning}, author = {Chenghao Zhang and Yikai Mao and Haoyu Gao and Saisai Hu and Yuxi Cheng and Shanqi Liu and Dan Roth}, year = {2026}, url = {https://arxiv.org/abs/2608.21897}, note = {Source identifier: 2608.21897} }