TY - RPRT TI - Principled Fine-tuning of LLMs from User-Edits: A Medley of Preference, Supervision, and Reward AU - Dipendra Misra AU - Aldo Pacchiano AU - Ta-Chung Chi AU - Ge Gao PY - 2026 UR - https://arxiv.org/abs/2601.19055 ID - 2601.19055 ER -