@misc{indiciaed98eb00e0f57, title = {AudioFuse: Unified Spectral-Temporal Learning via a Hybrid ViT-1D CNN Architecture for Robust Phonocardiogram Classification}, author = {Md. Saiful Bari Siddiqui and Utsab Saha}, year = {2025}, doi = {10.1109/icassp55912.2026.11464477}, url = {https://arxiv.org/abs/2509.23454}, note = {Source identifier: 2509.23454} }