TY - RPRT TI - Phase-and-First-Arrival VLM Feedback for Sparse-Reward Reinforcement Learning in Surgical Manipulation AU - Wanli Liuchen AU - Fangyuan Wang AU - Bin Li AU - Anqing Duan AU - Yunhui Liu AU - Peng Zhou AU - David Navarro-Alarcon PY - 2026 UR - https://arxiv.org/abs/2609.07211 ID - 2609.07211 ER -