@misc{indiciae17f29c24a2e2, title = {RoboSurg-VQA: A Multimodal Benchmark for Surgical Segmentation-Aware Visual Question Answering}, author = {Chengyi Zhang and Zi Ye and Ziyang Wang}, year = {2026}, url = {https://arxiv.org/abs/2605.23068}, note = {Source identifier: 2605.23068} }