TY - RPRT TI - Hierarchical Reinforcement Learning for Sparse-Reward Search in Commutative Algebra AU - Giorgi Butbaia AU - Paul Orland AU - Coco Huang AU - Davide Passaro AU - Lucas Fagan AU - Michele Tarquini AU - Hailong Dao AU - David Eisenbud AU - Ali Shehper AU - Sergei Gukov PY - 2026 UR - https://arxiv.org/abs/2606.22922 ID - 2606.22922 ER -