TY - RPRT TI - Hybrid Latent Reasoning via Reinforcement Learning AU - Zhenrui Yue AU - Bowen Jin AU - Huimin Zeng AU - Honglei Zhuang AU - Zhen Qin AU - Jinsung Yoon AU - Lanyu Shang AU - Jiawei Han AU - Dong Wang PY - 2025 UR - https://arxiv.org/abs/2505.18454 ID - 2505.18454 ER -