Improved Knowledge Distillation for Pre-trained Language Models via Knowledge Selection.
Chenglong Wang, Yi Lu, Yongyu Mu, Yimin Hu, Tong Xiao, Jingbo Zhu
Browse the full EMNLP paper archive.
Chenglong Wang, Yi Lu, Yongyu Mu, Yimin Hu, Tong Xiao, Jingbo Zhu
Browse the full EMNLP paper archive.