Skip to content

Gradient-based Intra-attention Pruning on Pre-trained Language Models.

Ziqing Yang, Yiming Cui, Xin Yao, Shijin Wang

VenueA*ACL
Year2023
ProceedingsACL (1)

Browse the full ACL paper archive.