@misc{indiciae1b0440f0efc6, title = {SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories}, author = {Muzhi Zhu and Yuzhuo Tian and Hao Chen and Chunluan Zhou and Qingpei Guo and Yang Liu and Ming Yang and Chunhua Shen}, year = {2025}, url = {https://arxiv.org/abs/2503.08625}, note = {Source identifier: 2503.08625} }