TY - RPRT TI - Aryabhata 2: Scaling Reinforcement Learning for Advanced STEM Reasoning AU - Ritvik Rastogi AU - Vishal Singh AU - Tejas Chaudhari AU - Sandeep Varma PY - 2026 UR - https://arxiv.org/abs/2605.28829 ID - 2605.28829 ER -