TY - RPRT TI - IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation AU - Johannes Schmitt AU - Gergely Bérczi AU - Jasper Dekoninck AU - Jeremy Feusi AU - Tim Gehrunger AU - Raphael Appenzeller AU - Pieter Belmans AU - Alessio Bottini AU - Jim Bryan AU - João Camarneiro AU - Ana Cannas da Silva AU - Niklas Canova AU - Ana-Maria Castravet AU - Timo de Wolff AU - Claudio Fontanari AU - Filippo Gaia AU - Baran Hashemi AU - Daniel Holmes AU - David Holmes AU - Aitor Iribar Lopez AU - Victor Jaeck AU - Martina Jørgensen AU - Steven Kelk AU - Martijn Kool AU - Stefan Kuhlmann AU - Adam Kurpisz AU - Johannes Lengler AU - Chiara Meroni AU - Ingmar Metzler AU - Martin Möller AU - Samuel Muñoz-Echániz AU - David Muñoz-Lahoz AU - Robert Nowak AU - Georg Oberdieck AU - Daniel Platt AU - Dylan Possamaï AU - Gabriel Ribeiro AU - Aluna Rizzoli AU - Daria Sakhanda AU - Raúl Sánchez Galán AU - Zheming Sun AU - Diaaeldin Taha AU - Josef Teichmann AU - Richard P. Thomas AU - Henk van der Pol AU - Michel van Garrel AU - Charles Vial AU - Ignacio Barros AU - Benjamin Doerr AU - Peter Grünwald AU - Henry Liu AU - David Martins AU - Aleksandar Mijatović AU - Sergej Monavari AU - Marc Roth AU - Patrick Schnider AU - Yannik Schuler AU - Pim Spelier AU - Yuuji Tanaka AU - Ronald van Luijk PY - 2026 UR - https://arxiv.org/abs/2509.26076 ID - 2509.26076 ER -