@misc{indiciae8d1ad3363c03, title = {Self-Refining Vision Language Model for Robotic Failure Detection and Reasoning}, author = {Carl Qi and Xiaojie Wang and Silong Yong and Stephen Sheng and Huitan Mao and Sriram Srinivasan and Manikantan Nambi and Amy Zhang and Yesh Dattatreya}, year = {2026}, url = {https://arxiv.org/abs/2602.12405}, note = {Source identifier: 2602.12405} }