Skip to content

From Curated Data to Scalable Models: Continual Pre-training of Dense and MoE Large Language Models for Tibetan.

Lei Yang, Leiyu Pan, Bojian Xiong, Renren Jin, Shaowei Zhang, Yue Chen, Ling Shi, Jiang Zhou, Junru Wu, Zhen Wang, Jianxiang Peng, Juesi Xiao, Tianyu Dong, Zhuowen Han, Zhuo Chen, Yuqi Ren, Deyi Xiong

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.