@misc{indiciae76027f6489e5, title = {A 28nm 0.22μJ/token memory-compute-intensity-aware CNN-Transformer accelerator with hybrid-attention-based layer-fusion and cascaded pruning for semantic-segmentation}, author = {Pingcheng Dong and Yonghao Tan and Xuejiao Liu and Peng Luo and Yu Liu and Luhong Liang and Yitong Zhou and Di Pang and Man-To Yung and Dong Zhang and Xijie Huang and Shih-Yang Liu and Yongkun Wu and Fengshi Tian and Chi-Ying Tsui and Fengbin Tu and Kwang-Ting Cheng}, year = {2026}, doi = {10.1109/isscc49661.2025.10904499}, url = {https://arxiv.org/abs/2512.17555}, note = {Source identifier: 2512.17555} }