@misc{indiciae6f235edb640c, title = {Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery}, author = {Guankun Wang and Long Bai and Wan Jun Nah and Jie Wang and Zhaoxi Zhang and Zhen Chen and Jinlin Wu and Mobarakol Islam and Hongbin Liu and Hongliang Ren}, year = {2025}, url = {https://arxiv.org/abs/2405.10948}, note = {Source identifier: 2405.10948} }