@misc{indiciae500b3bd35670, title = {Towards Multimodal Empathetic Response Generation: A Rich Text-Speech-Vision Avatar-based Benchmark}, author = {Han Zhang and Zixiang Meng and Meng Luo and Hong Han and Lizi Liao and Erik Cambria and Hao Fei}, year = {2025}, url = {https://arxiv.org/abs/2502.04976}, note = {Source identifier: 2502.04976} }