TY - RPRT TI - Representation Alignment from Human Feedback for Cross-Embodiment Reward Learning from Mixed-Quality Demonstrations AU - Connor Mattson AU - Anurag Aribandi AU - Daniel S. Brown PY - 2024 UR - https://arxiv.org/abs/2408.05610 ID - 2408.05610 ER -