Exploring Layer-wise Information Effectiveness for Post-Training Quantization in Small Language Models.
He Xiao, Qingyao Yang, Dirui Xie, Wendong Xu, Zunhai Su, Runming Yang, Haobo Liu, Wenyong Zhou, Zhengwu Liu, Ngai Wong
Browse the full ACL paper archive.