@misc{indiciaeced58d40e728, title = {OmAgent: A Multi-modal Agent Framework for Complex Video Understanding with Task Divide-and-Conquer}, author = {Lu Zhang and Tiancheng Zhao and Heting Ying and Yibo Ma and Kyusong Lee}, year = {2024}, url = {https://arxiv.org/abs/2406.16620}, note = {Source identifier: 2406.16620} }