Same Pre-training Loss, Better Downstream: Implicit Bias Matters for Language Models.
Hong Liu, Sang Michael Xie, Zhiyuan Li, Tengyu Ma
Browse the full ICML paper archive.
Hong Liu, Sang Michael Xie, Zhiyuan Li, Tengyu Ma
Browse the full ICML paper archive.