TY - RPRT TI - Beyond Test-Time Memory: State-Space Optimal Control for LLM Reasoning AU - Peihao Wang AU - Shan Yang AU - Xijun Wang AU - Tesi Xiao AU - Xin Liu AU - Changlong Yu AU - Yu Lou AU - Pan Li AU - Zhangyang Wang AU - Ming Lin AU - René Vidal PY - 2026 UR - https://arxiv.org/abs/2603.09221 ID - 2603.09221 ER -