TY - RPRT TI - When Can We Trust LLMs in Mental Health? Large-Scale Benchmarks for Reliable LLM Evaluation AU - Abeer Badawi AU - Elahe Rahimi AU - Md Tahmid Rahman Laskar AU - Sheri Grach AU - Lindsay Bertrand AU - Lames Danok AU - Jimmy Huang AU - Frank Rudzicz AU - Elham Dolatabadi PY - 2025 UR - https://arxiv.org/abs/2510.19032 ID - 2510.19032 ER -