TY - RPRT TI - TGRPO :Fine-tuning Vision-Language-Action Model via Trajectory-wise Group Relative Policy Optimization AU - Zengjue Chen AU - Runliang Niu AU - He Kong AU - Qi Wang AU - Qianli Xing AU - Zipei Fan PY - 2025 UR - https://arxiv.org/abs/2506.08440 ID - 2506.08440 ER -