TY - RPRT TI - Direct Post-Training Preference Alignment for Multi-Agent Motion Generation Models Using Implicit Feedback from Pre-training Demonstrations AU - Ran Tian AU - Kratarth Goel PY - 2025 UR - https://arxiv.org/abs/2503.20105 ID - 2503.20105 ER -