@misc{indiciaef43274c6ffac, title = {Benchmark Success, Clinical Failure: When Reinforcement Learning Optimizes for Benchmarks, Not Patients}, author = {Armin Berger and Manuela Bergau and Helen Schneider and Saad Ahmad and Tom Anglim Lagones and Gianluca Brugnara and Martha Foltyn-Dumitru and Kai Schlamp and Philipp Vollmuth and Rafet Sifa}, year = {2026}, url = {https://arxiv.org/abs/2512.23090}, note = {Source identifier: 2512.23090} }