@misc{indiciae4d5dd0ca4599, title = {VideoFDB: Evaluating Full-Duplex Vision-Speech Capabilities in Conversational Agents}, author = {Amrita Mazumdar and Seonwook Park and Rajarshi Roy and Nikhil Srihari and Shengze Wang and Yuhao Zhou and Julia Wang and Koki Nagano and Shalini De Mello}, year = {2026}, url = {https://arxiv.org/abs/2605.30256}, note = {Source identifier: 2605.30256} }