Skip to content

Self-Distilled Quantization: Achieving High Compression Rates in Transformer-Based Language Models.

James O'Neill, Sourav Dutta

VenueA*ACL
Year2023
ProceedingsACL (2)

Browse the full ACL paper archive.