Skip to content

ParamΔ for Direct Mixing: Post-Train Large Language Model At Zero Cost.

Sheng Cao, Mingrui Wu, Karthik Prasad, Yuandong Tian, Zechun Liu

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.