TY - RPRT TI - KVNAND: Efficient On-Device Large Language Model Inference Using DRAM-Free In-Flash Computing AU - Lishuo Deng AU - Shaojie Xu AU - Jinwu Chen AU - Changwei Yan AU - Jiajie Wang AU - Zhe Jiang AU - Weiwei Shan PY - 2025 UR - https://arxiv.org/abs/2512.03608 ID - 2512.03608 ER -