TY - RPRT TI - MedHELM: Holistic Evaluation of Large Language Models for Medical Tasks AU - Suhana Bedi AU - Hejie Cui AU - Miguel Fuentes AU - Alyssa Unell AU - Michael Wornow AU - Juan M. Banda AU - Nikesh Kotecha AU - Timothy Keyes AU - Yifan Mai AU - Mert Oez AU - Hao Qiu AU - Shrey Jain AU - Leonardo Schettini AU - Mehr Kashyap AU - Jason Alan Fries AU - Akshay Swaminathan AU - Philip Chung AU - Fateme Nateghi AU - Asad Aali AU - Ashwin Nayak AU - Shivam Vedak AU - Sneha S. Jain AU - Birju Patel AU - Oluseyi Fayanju AU - Shreya Shah AU - Ethan Goh AU - Dong-han Yao AU - Brian Soetikno AU - Eduardo Reis AU - Sergios Gatidis AU - Vasu Divi AU - Robson Capasso AU - Rachna Saralkar AU - Chia-Chun Chiang AU - Jenelle Jindal AU - Tho Pham AU - Faraz Ghoddusi AU - Steven Lin AU - Albert S. Chiou AU - Christy Hong AU - Mohana Roy AU - Michael F. Gensheimer AU - Hinesh Patel AU - Kevin Schulman AU - Dev Dash AU - Danton Char AU - Lance Downing AU - Francois Grolleau AU - Kameron Black AU - Bethel Mieso AU - Aydin Zahedivash AU - Wen-wai Yim AU - Harshita Sharma AU - Tony Lee AU - Hannah Kirsch AU - Jennifer Lee AU - Nerissa Ambers AU - Carlene Lugtu AU - Aditya Sharma AU - Bilal Mawji AU - Alex Alekseyev AU - Vicky Zhou AU - Vikas Kakkar AU - Jarrod Helzer AU - Anurang Revri AU - Yair Bannett AU - Roxana Daneshjou AU - Jonathan Chen AU - Emily Alsentzer AU - Keith Morse AU - Nirmal Ravi AU - Nima Aghaeepour AU - Vanessa Kennedy AU - Akshay Chaudhari AU - Thomas Wang AU - Sanmi Koyejo AU - Matthew P. Lungren AU - Eric Horvitz AU - Percy Liang AU - Mike Pfeffer AU - Nigam H. Shah PY - 2025 UR - https://arxiv.org/abs/2505.23802 ID - 2505.23802 ER -