@misc{indiciae341df6cf356a, title = {VISTAQA: Benchmarking Joint Visual Question Answering and Pixel-Level Evidence}, author = {Mozhgan Nasr Azadani and Yimu Wang and Yongpeng Zhu and Lihong Chen and Milan Ganai and Sean Sedwards and Marco Pavone and Krzysztof Czarnecki}, year = {2026}, url = {https://arxiv.org/abs/2605.20676}, note = {Source identifier: 2605.20676} }