TY - RPRT TI - Deep Symbolic Optimization: Reinforcement Learning for Symbolic Mathematics AU - Conor F. Hayes AU - Felipe Leno Da Silva AU - Jiachen Yang AU - T. Nathan Mundhenk AU - Chak Shing Lee AU - Jacob F. Pettit AU - Claudio Santiago AU - Sookyung Kim AU - Joanne T. Kim AU - Ignacio Aravena Solis AU - Ruben Glatt AU - Andre R. Goncalves AU - Alexander Ladd AU - Ahmet Can Solak AU - Thomas Desautels AU - Daniel Faissol AU - Brenden K. Petersen AU - Mikel Landajuela PY - 2025 UR - https://arxiv.org/abs/2505.10762 ID - 2505.10762 ER -