TY - RPRT TI - Efficient Post-Training Refinement of Latent Reasoning in Large Language Models AU - Xinyuan Wang AU - Dongjie Wang AU - Wangyang Ying AU - Haoyue Bai AU - Nanxu Gong AU - Sixun Dong AU - Kunpeng Liu AU - Yanjie Fu PY - 2025 UR - https://arxiv.org/abs/2506.08552 ID - 2506.08552 ER -