TY - RPRT TI - Do We Need Adam? Surprisingly Strong and Sparse Reinforcement Learning with SGD in LLMs AU - Sagnik Mukherjee AU - Lifan Yuan AU - Pavan Jayasinha AU - Dilek Hakkani-Tür AU - Hao Peng PY - 2026 UR - https://arxiv.org/abs/2602.07729 ID - 2602.07729 ER -