Skip to content

Shuohuan Wang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

20

Venues

5

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

20 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLSparse Growing Transformer: Training-Time Sparse Depth Allocation via Progressive Attention Looping.Yao Chen, Yilong Chen, Yinqi Yang, Junyuan Shang, Zhenyu Zhang, Zefeng Zhang, Shuaiyi Nie, Shuohuan Wang, Yu Sun, Hua Wu, Haifeng Wang, Tingwen Liu
2026ACLUncertainty-Aware Routing for Principled Alignment with MoE Dynamics.Yilong Chen, Junyuan Shang, Yuchen Feng, Zhenyu Zhang, Naibin Gu, Ziqi Wang, Tingwen Liu, Shuohuan Wang, Yu Sun, Hua Wu, Haifeng Wang
2025ACLInner Thinking Transformer: Leveraging Dynamic Depth Scaling to Foster Adaptive Internal Thinking.Yilong Chen, Junyuan Shang, Zhenyu Zhang, Yanxi Xie, Jiawei Sheng, Tingwen Liu, Shuohuan Wang, Yu Sun, Hua Wu, Haifeng Wang
2025ACLBeamLoRA: Beam-Constraint Low-Rank Adaptation.Naibin Gu, Zhenyu Zhang, Xiyu Liu, Peng Fu, Zheng Lin, Shuohuan Wang, Yu Sun, Hua Wu, Weiping Wang, Haifeng Wang
2025ACLHFT: Half Fine-Tuning for Large Language Models.Tingfeng Hui, Zhenyu Zhang, Shuohuan Wang, Weiran Xu, Yu Sun, Hua Wu
2025ACLUpcycling Instruction Tuning from Dense to Mixture-of-Experts via Parameter Merging.Tingfeng Hui, Zhenyu Zhang, Shuohuan Wang, Yu Sun, Hua Wu, Sen Su
2025ACLCuriosity-Driven Reinforcement Learning from Human Feedback.Haoran Sun, Yekun Chai, Shuohuan Wang, Yu Sun, Hua Wu, Haifeng Wang
2025ICLRMA-RLHF: Reinforcement Learning from Human Feedback with Macro Actions.Yekun Chai, Haoran Sun, Huang Fang, Shuohuan Wang, Yu Sun, Hua Wu
2025ICMLMixture of Hidden-Dimensions: Not All Hidden-States' Dimensions are Needed in Transformer.Yilong Chen, Junyuan Shang, Zhenyu Zhang, Jiawei Sheng, Tingwen Liu, Shuohuan Wang, Yu Sun, Hua Wu, Haifeng Wang
2024ACLLEMON: Reviving Stronger and Smaller LMs from Larger LMs with Linear Parameter Fusion.Yilong Chen, Junyuan Shang, Zhenyu Zhang, Shiyao Cui, Tingwen Liu, Shuohuan Wang, Yu Sun, Hua Wu
2024ACLNACL: A General and Effective KV Cache Eviction Framework for LLM at Inference Time.Yilong Chen, Guoxia Wang, Junyuan Shang, Shiyao Cui, Zhenyu Zhang, Tingwen Liu, Shuohuan Wang, Yu Sun, Dianhai Yu, Hua Wu
2024EMNLPOn Training Data Influence of GPT Models.Yekun Chai, Qingyi Liu, Shuohuan Wang, Yu Sun, Qiwei Peng, Hua Wu
2024EMNLPAutoregressive Pre-Training on Pixels and Texts.Yekun Chai, Qingyi Liu, Jingwu Xiao, Shuohuan Wang, Yu Sun, Hua Wu
2024ICLRTool-Augmented Reward Modeling.Lei Li, Yekun Chai, Shuohuan Wang, Yu Sun, Hao Tian, Ningyu Zhang, Hua Wu
2023ACLERNIE-Code: Beyond English-Centric Cross-lingual Pretraining for Programming Languages.Yekun Chai, Shuohuan Wang, Chao Pang, Yu Sun, Hao Tian, Hua Wu
2022EMNLPClip-Tuning: Towards Derivative-free Prompt Learning with a Mixture of Rewards.Yekun Chai, Shuohuan Wang, Yu Sun, Hao Tian, Hua Wu, Haifeng Wang
2021ACLERNIE-Doc: A Retrospective Long-Document Modeling Transformer.Siyu Ding, Junyuan Shang, Shuohuan Wang, Yu Sun, Hao Tian, Hua Wu, Haifeng Wang
2021ACLCorrecting Chinese Spelling Errors with Phonetic Pre-training.Ruiqing Zhang, Chao Pang, Chuanqiang Zhang, Shuohuan Wang, Zhongjun He, Yu Sun, Hua Wu, Haifeng Wang
2021EMNLPERNIE-M: Enhanced Multilingual Representation by Aligning Cross-lingual Semantics with Monolingual Corpora.Xuan Ouyang, Shuohuan Wang, Chao Pang, Yu Sun, Hao Tian, Hua Wu, Haifeng Wang
2020AAAIERNIE 2.0: A Continual Pre-Training Framework for Language Understanding.Yu Sun, Shuohuan Wang, Yu-Kun Li, Shikun Feng, Hao Tian, Hua Wu, Haifeng Wang