TY - RPRT TI - Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention AU - Xingtai Lv AU - Ning Ding AU - Kaiyan Zhang AU - Ermo Hua AU - Ganqu Cui AU - Bowen Zhou PY - 2024 UR - https://arxiv.org/abs/2411.02063 ID - 2411.02063 ER -