Length-Adaptive Distillation: Customizing Small Language Model for Dynamic Token Pruning.
Chang Liu, Chongyang Tao, Jianxin Liang, Jiazhan Feng, Tao Shen, Quzhe Huang, Dongyan Zhao
Browse the full EMNLP paper archive.
Chang Liu, Chongyang Tao, Jianxin Liang, Jiazhan Feng, Tao Shen, Quzhe Huang, Dongyan Zhao
Browse the full EMNLP paper archive.