TY - RPRT TI - Reasoning or Memorization? Direction-Aware Diversity Exploration in LLM Reinforcement Learning AU - Jiangnan Xia AU - Yucheng Shi AU - Yu Yang AU - Kishan Panaganti AU - Zhenwen Liang AU - Ninghao Liu PY - 2026 UR - https://arxiv.org/abs/2606.10346 ID - 2606.10346 ER -