TY - RPRT TI - Policy-Invariant Reward Shaping from LLM Feedback: A Framework for Hybrid RL Agents AU - Christophe D. Hounwanou AU - John Emeka Eze AU - YaƩ U. Gaba PY - 2026 UR - https://arxiv.org/abs/2608.18008 ID - 2608.18008 ER -