@misc{indiciae9adcc4fb411d, title = {AnyCap Project: A Unified Framework, Dataset, and Benchmark for Controllable Omni-modal Captioning}, author = {Yiming Ren and Zhiqiang Lin and Yu Li and Gao Meng and Weiyun Wang and Junjie Wang and Zicheng Lin and Jifeng Dai and Yujiu Yang and Wenhai Wang and Ruihang Chu}, year = {2025}, url = {https://arxiv.org/abs/2507.12841}, note = {Source identifier: 2507.12841} }