TY - RPRT TI - LLMR: Knowledge Distillation with a Large Language Model-Induced Reward AU - Dongheng Li AU - Yongchang Hao AU - Lili Mou PY - 2024 UR - https://arxiv.org/abs/2409.12500 ID - 2409.12500 ER -