TY - RPRT TI - Control Reinforcement Learning: Interpretable Token-Level Steering of LLMs via Sparse Autoencoder Features AU - Seonglae Cho AU - Zekun Wu AU - Adriano Koshiyama PY - 2026 UR - https://arxiv.org/abs/2602.10437 ID - 2602.10437 ER -