When Compression Meets Model Compression: Memory-Efficient Double Compression for Large Language Models.
Weilan Wang, Yu Mao, Dongdong Tang, Hongchao Du, Nan Guan, Chun Jason Xue
Browse the full EMNLP paper archive.
Weilan Wang, Yu Mao, Dongdong Tang, Hongchao Du, Nan Guan, Chun Jason Xue
Browse the full EMNLP paper archive.