TY - RPRT TI - Comprehensive Evaluation of Large Language Models on Software Engineering Tasks: A Multi-Task Benchmark AU - Go Frendi Gunawan AU - Mukhlis Amien PY - 2026 UR - https://arxiv.org/abs/2602.07079 ID - 2602.07079 ER -