@misc{indiciaee05efadaf086, title = {Shifting More Attention to Visual Backbone: Query-modulated Refinement Networks for End-to-End Visual Grounding}, author = {Jiabo Ye and Junfeng Tian and Ming Yan and Xiaoshan Yang and Xuwu Wang and Ji Zhang and Liang He and Xin Lin}, year = {2022}, url = {https://arxiv.org/abs/2203.15442}, note = {Source identifier: 2203.15442} }