@misc{indiciae19bd11c05f4d, title = {Training Task Reasoning LLM Agents for Multi-turn Task Planning via Single-turn Reinforcement Learning}, author = {Hanjiang Hu and Changliu Liu and Na Li and Yebin Wang}, year = {2025}, url = {https://arxiv.org/abs/2509.20616}, note = {Source identifier: 2509.20616} }