Skip to content

Accelerating the Training of Large Language Models using Efficient Activation Rematerialization and Optimal Hybrid Parallelism.

Tailing Yuan, Yuliang Liu, Xucheng Ye, Shenglong Zhang, Jianchao Tan, Bin Chen, Chengru Song, Di Zhang

VenueAUSENIX
Year2024
ProceedingsUSENIX ATC

Browse the full USENIX paper archive.