TY - RPRT TI - FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models AU - Dahyun Jung AU - Seungyoon Lee AU - Hyeonseok Moon AU - Chanjun Park AU - Heuiseok Lim PY - 2025 UR - https://arxiv.org/abs/2503.19540 ID - 2503.19540 ER -