@misc{indiciaeb4afa69e0012, title = {Zero-Shot Character Identification and Speaker Prediction in Comics via Iterative Multimodal Fusion}, author = {Yingxuan Li and Ryota Hinami and Kiyoharu Aizawa and Yusuke Matsui}, year = {2024}, url = {https://arxiv.org/abs/2404.13993}, note = {Source identifier: 2404.13993} }