TY - RPRT TI - Prompt reinforcing for long-term planning of large language models AU - Hsien-Chin Lin AU - Benjamin Matthias Ruppik AU - Carel van Niekerk AU - Chia-Hao Shen AU - Michael Heck AU - Nurul Lubis AU - Renato Vukovic AU - Shutong Feng AU - Milica Gašić PY - 2026 UR - https://arxiv.org/abs/2510.05921 ID - 2510.05921 ER -