TY - RPRT TI - SceneBind: Binding What and Where Across Vision, Audio and Language AU - Mingfei Chen AU - Zijun Cui AU - Ruoke Zhang AU - Hyeonggon Ryu AU - Eli Shlizerman PY - 2026 UR - https://arxiv.org/abs/2607.15265 ID - 2607.15265 ER -