D2 Prune: Sparsifying Large Language Models via Dual Taylor Expansion and Attention Distribution Awareness.
Lang Xiong, Ning Liu, Ao Ren, Yuheng Bai, Haining Fang, Binyan Zhang, Zhe Jiang, Yujuan Tan, Duo Liu
Browse the full AAAI paper archive.
Lang Xiong, Ning Liu, Ao Ren, Yuheng Bai, Haining Fang, Binyan Zhang, Zhe Jiang, Yujuan Tan, Duo Liu
Browse the full AAAI paper archive.