TY - RPRT TI - Conv-to-Bench: Evaluating Language Models Via User-Assistant Dialogues In Code Tasks AU - Victor M. dos Santos AU - Andre C. Castro AU - Samuel L. de S. Toledo AU - Bruno M. L. Calura AU - Lisandra C. de M. Menezes AU - Raul C. R. Mata AU - Telma W. de L. Soares AU - Bryan L. M. de Oliveira PY - 2026 UR - https://arxiv.org/abs/2605.26440 ID - 2605.26440 ER -