@misc{indiciaefc75fb31e60a, title = {LearnAlign: Data Selection for LLM Reinforcement Learning with Improved Gradient Alignment}, author = {Shipeng Li and Zhiqin Yang and Shikun Li and Xiaobo Xia and Hengyu Liu and Xinghua Zhang and Gaode Chen and Dong Fang and Ying Tai and Zhe Peng}, year = {2026}, url = {https://arxiv.org/abs/2506.11480}, note = {Source identifier: 2506.11480} }