@misc{indiciae480365fd6841, title = {KVNAND: Efficient On-Device Large Language Model Inference Using DRAM-Free In-Flash Computing}, author = {Lishuo Deng and Shaojie Xu and Jinwu Chen and Changwei Yan and Jiajie Wang and Zhe Jiang and Weiwei Shan}, year = {2025}, url = {https://arxiv.org/abs/2512.03608}, note = {Source identifier: 2512.03608} }