@misc{indiciaed2f63e6afd6c, title = {Aryabhata 2: Scaling Reinforcement Learning for Advanced STEM Reasoning}, author = {Ritvik Rastogi and Vishal Singh and Tejas Chaudhari and Sandeep Varma}, year = {2026}, url = {https://arxiv.org/abs/2605.28829}, note = {Source identifier: 2605.28829} }