TY - RPRT TI - Grounding Language Models to Images for Multimodal Inputs and Outputs AU - Jing Yu Koh AU - Ruslan Salakhutdinov AU - Daniel Fried PY - 2023 UR - https://arxiv.org/abs/2301.13823 ID - 2301.13823 ER -