@misc{indiciae4870232545fc, title = {Bi-Level Reinforcement Learning Pathway for Sim-to-Real Optimality}, author = {Akhil S Anand and Shambhuraj Sawant and Paavo Parmas and Jasper Hoffmann and Dirk Reinhardt and Sebastien Gros}, year = {2026}, url = {https://arxiv.org/abs/2510.17709}, note = {Source identifier: 2510.17709} }