@misc{indiciaee0046117f0c4, title = {ASCENT-ViT: Attention-based Scale-aware Concept Learning Framework for Enhanced Alignment in Vision Transformers}, author = {Sanchit Sinha and Guangzhi Xiong and Aidong Zhang}, year = {2025}, url = {https://arxiv.org/abs/2501.09221}, note = {Source identifier: 2501.09221} }