@misc{indiciae5055180542ac, title = {Learning Visual Affordance from Audio}, author = {Lidong Lu and Guo Chen and Zhu Wei and Yicheng Liu and Tong Lu}, year = {2025}, url = {https://arxiv.org/abs/2512.02005}, note = {Source identifier: 2512.02005} }