TY - RPRT TI - Towards Safer AI Moderation: Evaluating LLM Moderators Through a Unified Benchmark Dataset and Advocating a Human-First Approach AU - Naseem Machlovi AU - Maryam Saleki AU - Innocent Ababio AU - Ruhul Amin PY - 2025 DO - 10.1007/978-3-032-13184-3_24 UR - https://arxiv.org/abs/2508.07063 ID - 2508.07063 ER -