TY - RPRT TI - Domain-Adaptable Reinforcement Learning for Code Generation with Dense Rewards AU - Erfan Aghadavoodi Jolfaei AU - Daniel Maninger AU - Abhinav Anand AU - Mert Tiftikci AU - Mira Mezini PY - 2026 UR - https://arxiv.org/abs/2605.21180 ID - 2605.21180 ER -