@misc{indiciae3834f3baff33, title = {ActionArt: Advancing Multimodal Large Models for Fine-Grained Human-Centric Video Understanding}, author = {Yi-Xing Peng and Qize Yang and Yu-Ming Tang and Shenghao Fu and Kun-Yu Lin and Xihan Wei and Wei-Shi Zheng}, year = {2025}, url = {https://arxiv.org/abs/2504.18152}, note = {Source identifier: 2504.18152} }