TY - RPRT TI - Learning Reward for Robot Skills Using Large Language Models via Self-Alignment AU - Yuwei Zeng AU - Yao Mu AU - Lin Shao PY - 2024 UR - https://arxiv.org/abs/2405.07162 ID - 2405.07162 ER -