@misc{indiciae6a56ea1fc23f, title = {Learning Word-Like Units from Joint Audio-Visual Analysis}, author = {David Harwath and James R. Glass}, year = {2017}, url = {https://arxiv.org/abs/1701.07481}, note = {Source identifier: 1701.07481} }