@misc{indiciae166798ca8e7b, title = {TDBench: A Benchmark for Top-Down Image Understanding with Reliability Analysis of Vision-Language Models}, author = {Kaiyuan Hou and Minghui Zhao and Lilin Xu and Yuang Fan and Xiaofan Jiang}, year = {2025}, url = {https://arxiv.org/abs/2504.03748}, note = {Source identifier: 2504.03748} }