Skip to content

D2 Prune: Sparsifying Large Language Models via Dual Taylor Expansion and Attention Distribution Awareness.

Lang Xiong, Ning Liu, Ao Ren, Yuheng Bai, Haining Fang, Binyan Zhang, Zhe Jiang, Yujuan Tan, Duo Liu

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.