Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention.
Xingtai Lv, Ning Ding, Kaiyan Zhang, Ermo Hua, Ganqu Cui, Bowen Zhou
Browse the full EMNLP paper archive.
Xingtai Lv, Ning Ding, Kaiyan Zhang, Ermo Hua, Ganqu Cui, Bowen Zhou
Browse the full EMNLP paper archive.