TY - RPRT TI - Debate, Reflect, and Distill: Multi-Agent Feedback with Tree-Structured Preference Optimization for Efficient Language Model Enhancement AU - Xiaofeng Zhou AU - Heyan Huang AU - Lizi Liao PY - 2025 UR - https://arxiv.org/abs/2506.03541 ID - 2506.03541 ER -