TY - RPRT TI - Adaptive Negative Reinforcement for LLM Reasoning:Dynamically Balancing Correction and Diversity in RLVR AU - Yash Ingle AU - Jaival Chauhan AU - Ankit Yadav AU - Sudhakar Mishra PY - 2026 UR - https://arxiv.org/abs/2605.07137 ID - 2605.07137 ER -