TY - RPRT TI - Back to Basics: Revisiting Exploration in Reinforcement Learning for LLM Reasoning via Generative Probabilities AU - Pengyi Li AU - Elizaveta Goncharova AU - Andrey Kuznetsov AU - Ivan Oseledets PY - 2026 UR - https://arxiv.org/abs/2602.05281 ID - 2602.05281 ER -