Train Big, Then Compress: Rethinking Model Size for Efficient Training and Inference of Transformers.
Zhuohan Li, Eric Wallace, Sheng Shen, Kevin Lin, Kurt Keutzer, Dan Klein, Joey Gonzalez
Browse the full ICML paper archive.
Zhuohan Li, Eric Wallace, Sheng Shen, Kevin Lin, Kurt Keutzer, Dan Klein, Joey Gonzalez
Browse the full ICML paper archive.