TY - RPRT TI - Show and Speak: Directly Synthesize Spoken Description of Images AU - Xinsheng Wang AU - Siyuan Feng AU - Jihua Zhu AU - Mark Hasegawa-Johnson AU - Odette Scharenborg PY - 2020 UR - https://arxiv.org/abs/2010.12267 ID - 2010.12267 ER -