@misc{indiciae36c0932202b2, title = {VTAgent: Agentic Keyframe Anchoring for Evidence-Aware Video TextVQA}, author = {Haibin He and Maoyuan Ye and Jing Zhang and Juhua Liu and Bo Du}, year = {2026}, url = {https://arxiv.org/abs/2605.04870}, note = {Source identifier: 2605.04870} }