@misc{indiciae7c28c186bc1e, title = {AROMA: Mixed-Initiative AI Assistance for Non-Visual Cooking by Grounding Multi-modal Information Between Reality and Videos}, author = {Zheng Ning and Leyang Li and Daniel Killough and JooYoung Seo and Patrick Carrington and Yapeng Tian and Yuhang Zhao and Franklin Mingzhe Li and Toby Jia-Jun Li}, year = {2025}, url = {https://arxiv.org/abs/2507.10963}, note = {Source identifier: 2507.10963} }