TY - RPRT TI - ECHO: Entropy-Confidence Hybrid Optimization for Test-Time Reinforcement Learning AU - Chu Zhao AU - Enneng Yang AU - Yuting Liu AU - Jianzhe Zhao AU - Guibing Guo PY - 2026 UR - https://arxiv.org/abs/2602.02150 ID - 2602.02150 ER -