TY - RPRT TI - Mutual Enhancement of Large Language and Reinforcement Learning Models through Bi-Directional Feedback Mechanisms: A Planning Case Study AU - Shangding Gu PY - 2025 UR - https://arxiv.org/abs/2401.06603 ID - 2401.06603 ER -