Skip to content

Weizhu Chen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

106

Venues

15

Active years

2007–2026

Best venue rank

A*

Where they publish

Papers

106 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLGold-Medal-Level Olympiad Geometry Solving with Efficient Heuristic Auxiliary Constructions.Boyan Duan, Xiao Liang, Shuai Lu, Yaoxiang Wang, Yelong Shen, Kai-Wei Chang, Ying Nian Wu, Mao Yang, Weizhu Chen, Yeyun Gong
2026ACLTraining LLMs for Divide-and-Conquer Reasoning Elevates Test-Time Scalability.Xiao Liang, Zhong-Zhi Li, Zhenghao Lin, Eric Hanchen Jiang, Hengyuan Zhang, Yelong Shen, Kai-Wei Chang, Ying Nian Wu, Yeyun Gong, Weizhu Chen
2025AAAIMTL-LoRA: Low-Rank Adaptation for Multi-Task Learning.Yaming Yang, Dilxat Muhtar, Yelong Shen, Yuefeng Zhan, Jianfeng Liu, Yujing Wang, Hao Sun, Weiwei Deng, Feng Sun, Qi Zhang, Weizhu Chen, Yunhai Tong
2025AAAIKey-Point-Driven Data Synthesis with Its Enhancement on Mathematical Reasoning.Yiming Huang, Xiao Liu, Yeyun Gong, Zhibin Gou, Yelong Shen, Nan Duan, Weizhu Chen
2025ICLRSamba: Simple Hybrid State Space Models for Efficient Unlimited Context Language Modeling.Liliang Ren, Yang Liu, Yadong Lu, Yelong Shen, Chen Liang, Weizhu Chen
2025ICMLLongRoPE2: Near-Lossless LLM Context Window Scaling.Ning Shang, Li Lyna Zhang, Siyuan Wang, Gaokai Zhang, Gilsinia Lopez, Fan Yang, Weizhu Chen, Mao Yang
2024ACLCompetition-Level Problems are Effective LLM Evaluators.Yiming Huang, Zhenghao Lin, Xiao Liu, Yeyun Gong, Shuai Lu, Fangyu Lei, Yaobo Liang, Yelong Shen, Chen Lin, Nan Duan, Weizhu Chen
2024EMNLPCan LLMs Learn From Mistakes? An Empirical Study on Reasoning Tasks.Shengnan An, Zexiong Ma, Siqi Cai, Zeqi Lin, Nanning Zheng, Jian-Guang Lou, Weizhu Chen
2024EMNLPAutomatic Instruction Evolving for Large Language Models.Weihao Zeng, Can Xu, Yingxiu Zhao, Jian-Guang Lou, Weizhu Chen
2024ICLRSeeking Neural Nuggets: Knowledge Transfer in Large Language Models from a Parametric Perspective.Ming Zhong, Chenxin An, Weizhu Chen, Jiawei Han, Pengcheng He
2024ICLRCRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing.Zhibin Gou, Zhihong Shao, Yeyun Gong, Yelong Shen, Yujiu Yang, Nan Duan, Weizhu Chen
2024ICLRToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving.Zhibin Gou, Zhihong Shao, Yeyun Gong, Yelong Shen, Yujiu Yang, Minlie Huang, Nan Duan, Weizhu Chen
2024ICLRLoftQ: LoRA-Fine-Tuning-aware Quantization for Large Language Models.Yixiao Li, Yifan Yu, Chen Liang, Nikos Karampatziakis, Pengcheng He, Weizhu Chen, Tuo Zhao
2024ICLRSupervised Knowledge Makes Large Language Models Better In-context Learners.Linyi Yang, Shuibai Zhang, Zhuohao Yu, Guangsheng Bao, Yidong Wang, Jindong Wang, Ruochen Xu, Wei Ye, Xing Xie, Weizhu Chen, Yue Zhang
2024NAACLLanguage Models can be Deductive Solvers.Jiazhan Feng, Ruochen Xu, Junheng Hao, Hiteshi Sharma, Yelong Shen, Dongyan Zhao, Weizhu Chen
2024NAACLAnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators.Xingwei He, Zhenghao Lin, Yeyun Gong, A-Long Jin, Hang Zhang, Chen Lin, Jian Jiao, Siu Ming Yiu, Nan Duan, Weizhu Chen
2024NAACLAGIEval: A Human-Centric Benchmark for Evaluating Foundation Models.Wanjun Zhong, Ruixiang Cui, Yiduo Guo, Yaobo Liang, Shuai Lu, Yanlin Wang, Amin Saied, Weizhu Chen, Nan Duan
2023ACLDSEE: Dually Sparsity-embedded Efficient Tuning of Pre-trained Language Models.Xuxi Chen, Tianlong Chen, Weizhu Chen, Ahmed Hassan Awadallah, Zhangyang Wang, Yu Cheng
2023ACLMaking Language Models Better Reasoners with Step-Aware Verifier.Yifei Li, Zeqi Lin, Shizhuo Zhang, Qiang Fu, Bei Chen, Jian-Guang Lou, Weizhu Chen
2023ACLCode Execution with Pre-trained Language Models.Chenxiao Liu, Shuai Lu, Weizhu Chen, Daxin Jiang, Alexey Svyatkovskiy, Shengyu Fu, Neel Sundaresan, Nan Duan
2023ACLJoint Generator-Ranker Learning for Natural Language Generation.Weizhou Shen, Yeyun Gong, Yelong Shen, Song Wang, Xiaojun Quan, Nan Duan, Weizhu Chen
2023EMNLPSkill-Based Few-Shot Selection for In-Context Learning.Shengnan An, Bo Zhou, Zeqi Lin, Qiang Fu, Bei Chen, Nanning Zheng, Weizhu Chen, Jian-Guang Lou
2023EMNLPEnhancing Retrieval-Augmented Large Language Models with Iterative Retrieval-Generation Synergy.Zhihong Shao, Yeyun Gong, Yelong Shen, Minlie Huang, Nan Duan, Weizhu Chen
2023EMNLPRepoCoder: Repository-Level Code Completion Through Iterative Retrieval and Generation.Fengji Zhang, Bei Chen, Yue Zhang, Jacky Keung, Jin Liu, Daoguang Zan, Yi Mao, Jian-Guang Lou, Weizhu Chen
2023ICLRCodeT: Code Generation with Generated Tests.Bei Chen, Fengji Zhang, Anh Nguyen, Daoguang Zan, Zeqi Lin, Jian-Guang Lou, Weizhu Chen
2023ICLRDeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing.Pengcheng He, Jianfeng Gao, Weizhu Chen
2023ICLRDiffusion-GAN: Training GANs with Diffusion.Zhendong Wang, Huangjie Zheng, Pengcheng He, Weizhu Chen, Mingyuan Zhou
2023ICLRAdaptive Budget Allocation for Parameter-Efficient Fine-Tuning.Qingru Zhang, Minshuo Chen, Alexander Bukharin, Pengcheng He, Yu Cheng, Weizhu Chen, Tuo Zhao
2023ICLRTruncated Diffusion Probabilistic Models and Diffusion-based Adversarial Auto-Encoders.Huangjie Zheng, Pengcheng He, Weizhu Chen, Mingyuan Zhou
2023ICMLLess is More: Task-aware Layer-wise Distillation for Language Model Compression.Chen Liang, Simiao Zuo, Qingru Zhang, Pengcheng He, Weizhu Chen, Tuo Zhao
2023ICMLText Generation with Diffusion Language Models: A Pre-training Approach with Continuous Paragraph Denoise.Zhenghao Lin, Yeyun Gong, Yelong Shen, Tong Wu, Zhihao Fan, Chen Lin, Nan Duan, Weizhu Chen
2023ICMLLoSparse: Structured Compression of Large Language Models based on Low-Rank and Sparse Approximation.Yixiao Li, Yifan Yu, Qingru Zhang, Chen Liang, Pengcheng He, Weizhu Chen, Tuo Zhao
2023ICMLHyperTuning: Toward Adapting Large Language Models without Back-propagation.Jason Phang, Yi Mao, Pengcheng He, Weizhu Chen
2023ICMLSynthetic Prompting: Generating Chain-of-Thought Demonstrations for Large Language Models.Zhihong Shao, Yeyun Gong, Yelong Shen, Minlie Huang, Nan Duan, Weizhu Chen
2022AAAIXLM-K: Improving Cross-Lingual Language Model Pre-training with Multilingual Knowledge.Xiaoze Jiang, Yaobo Liang, Weizhu Chen, Nan Duan
2022ACLDialogVED: A Pre-trained Latent Variable Encoder-Decoder Model for Dialog Response Generation.Wei Chen, Yeyun Gong, Song Wang, Bolun Yao, Weizhen Qi, Zhongyu Wei, Xiaowu Hu, Bartuer Zhou, Yi Mao, Weizhu Chen, Biao Cheng, Nan Duan
2022ACLFinding the Dominant Winning Ticket in Pre-Trained Language Models.Zhuocheng Gong, Di He, Yelong Shen, Tie-Yan Liu, Weizhu Chen, Dongyan Zhao, Ji-Rong Wen, Rui Yan
2022ACLA Good Prompt Is Worth Millions of Parameters: Low-resource Prompt-based Learning for Vision-Language Models.Woojeong Jin, Yu Cheng, Yelong Shen, Weizhu Chen, Xiang Ren
2022ACLCAMERO: Consistency Regularized Ensemble of Perturbed Language Models with Weight Sharing.Chen Liang, Pengcheng He, Yelong Shen, Weizhu Chen, Tuo Zhao
2022ACLA Token-level Reference-free Hallucination Detection Benchmark for Free-form Text Generation.Tianyu Liu, Yizhe Zhang, Chris Brockett, Yi Mao, Zhifang Sui, Weizhu Chen, Bill Dolan
2022ACLControllable Natural Language Generation with Contrastive Prefixes.Jing Qian, Li Dong, Yelong Shen, Furu Wei, Weizhu Chen
2022ECCVScalable Learning to Optimize: A Learned Optimizer Can Train Big Models.Xuxi Chen, Tianlong Chen, Yu Cheng, Weizhu Chen, Ahmed Awadallah, Zhangyang Wang
2022EMNLPSoft-Labeled Contrastive Pre-Training for Function-Level Code Representation.Xiaonan Li, Daya Guo, Yeyun Gong, Yun Lin, Yelong Shen, Xipeng Qiu, Daxin Jiang, Weizhu Chen, Nan Duan
2022EMNLPCodeRetriever: A Large Scale Contrastive Pre-Training Method for Code Search.Xiaonan Li, Yeyun Gong, Yelong Shen, Xipeng Qiu, Hang Zhang, Bolun Yao, Weizhen Qi, Daxin Jiang, Weizhu Chen, Nan Duan
2022EMNLPReasoning Like Program Executors.Xinyu Pi, Qian Liu, Bei Chen, Morteza Ziyadi, Zeqi Lin, Qiang Fu, Yan Gao, Jian-Guang Lou, Weizhu Chen
2022ICLRLoRA: Low-Rank Adaptation of Large Language Models.Edward J. Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, Weizhu Chen
2022ICLRNo Parameters Left Behind: Sensitivity Guided Adaptive Learning Rate for Training Large Transformer Models.Chen Liang, Haoming Jiang, Simiao Zuo, Pengcheng He, Xiaodong Liu, Jianfeng Gao, Weizhu Chen, Tuo Zhao
2022ICLRTAPEX: Table Pre-training via Learning a Neural SQL Executor.Qian Liu, Bei Chen, Jiaqi Guo, Morteza Ziyadi, Zeqi Lin, Weizhu Chen, Jian-Guang Lou
2022ICLRAdversarial Retriever-Ranker for Dense Text Retrieval.Hang Zhang, Yeyun Gong, Yelong Shen, Jiancheng Lv, Nan Duan, Weizhu Chen
2022ICMLPLATON: Pruning Large Transformer Models with Upper Confidence Bound of Weight Importance.Qingru Zhang, Simiao Zuo, Chen Liang, Alexander Bukharin, Pengcheng He, Weizhu Chen, Tuo Zhao
2022IJCAICERT: Continual Pre-training on Sketches for Library-oriented Code Generation.Daoguang Zan, Bei Chen, Dejian Yang, Zeqi Lin, Minsu Kim, Bei Guan, Yongji Wang, Weizhu Chen, Jian-Guang Lou
2022NAACLOmniTab: Pretraining with Natural and Synthetic Data for Few-shot Table-based Question Answering.Zhengbao Jiang, Yi Mao, Pengcheng He, Graham Neubig, Weizhu Chen
2022NAACLALLSH: Active Learning Guided by Local Sensitivity and Hardness.Shujian Zhang, Chengyue Gong, Xingchao Liu, Pengcheng He, Weizhu Chen, Mingyuan Zhou
2022NAACLMoEBERT: from BERT to Mixture-of-Experts via Importance-Guided Adaptation.Simiao Zuo, Qingru Zhang, Chen Liang, Pengcheng He, Tuo Zhao, Weizhu Chen
2021ACLUnitedQA: A Hybrid Approach for Open Domain Question Answering.Hao Cheng, Yelong Shen, Xiaodong Liu, Pengcheng He, Weizhu Chen, Jianfeng Gao
2021ACLHiddenCut: Simple Data Augmentation for Natural Language Understanding with Better Generalizability.Jiaao Chen, Dinghan Shen, Weizhu Chen, Diyi Yang
2021ACLSuper Tickets in Pre-Trained Language Models: From Model Compression to Improving Generalization.Chen Liang, Simiao Zuo, Minshuo Chen, Haoming Jiang, Xiaodong Liu, Pengcheng He, Tuo Zhao, Weizhu Chen
2021ACLGLGE: A New General Language Generation Evaluation Benchmark.Dayiheng Liu, Yu Yan, Yeyun Gong, Weizhen Qi, Hang Zhang, Jian Jiao, Weizhu Chen, Jie Fu, Linjun Shou, Ming Gong, Pengcheng Wang, Jiusheng Chen, Daxin Jiang, Jiancheng Lv, Ruofei Zhang, Winnie Wu, Ming Zhou, Nan Duan
2021ACLGeneration-Augmented Retrieval for Open-Domain Question Answering.Yuning Mao, Pengcheng He, Xiaodong Liu, Yelong Shen, Jianfeng Gao, Jiawei Han, Weizhu Chen
2021ACLReader-Guided Passage Reranking for Open-Domain Question Answering.Yuning Mao, Pengcheng He, Xiaodong Liu, Yelong Shen, Jianfeng Gao, Jiawei Han, Weizhu Chen
2021ACLMemory-Efficient Differentiable Transformer Architecture Search.Yuekai Zhao, Li Dong, Yelong Shen, Zhihua Zhang, Furu Wei, Weizhu Chen
2021EMNLPFew-Shot Named Entity Recognition: An Empirical Baseline Study.Jiaxin Huang, Chunyuan Li, Krishan Subudhi, Damien Jose, Shobana Balakrishnan, Weizhu Chen, Baolin Peng, Jianfeng Gao, Jiawei Han
2021EMNLPFinetuning Pretrained Transformers into RNNs.Jungo Kasai, Hao Peng, Yizhe Zhang, Dani Yogatama, Gabriel Ilharco, Nikolaos Pappas, Yi Mao, Weizhu Chen, Noah A. Smith
2021EMNLPToken-wise Curriculum Learning for Neural Machine Translation.Chen Liang, Haoming Jiang, Xiaodong Liu, Pengcheng He, Weizhu Chen, Jianfeng Gao, Tuo Zhao
2021EMNLPARCH: Efficient Adversarial Regularized Training with Caching.Simiao Zuo, Chen Liang, Haoming Jiang, Pengcheng He, Xiaodong Liu, Jianfeng Gao, Weizhu Chen, Tuo Zhao
2021EMNLPAdversarial Regularization as Stackelberg Game: An Unrolled Optimization Approach.Simiao Zuo, Chen Liang, Haoming Jiang, Xiaodong Liu, Pengcheng He, Jianfeng Gao, Weizhu Chen, Tuo Zhao
2021ICLRDeberta: decoding-Enhanced Bert with Disentangled Attention.Pengcheng He, Xiaodong Liu, Jianfeng Gao, Weizhu Chen
2021ICLRMixKD: Towards Efficient Distillation of Large-scale Language Models.Kevin J. Liang, Weituo Hao, Dinghan Shen, Yufan Zhou, Weizhu Chen, Changyou Chen, Lawrence Carin
2021ICLRCoDA: Contrast-enhanced and Diversity-promoting Data Augmentation for Natural Language Understanding.Yanru Qu, Dinghan Shen, Yelong Shen, Sandra Sajeev, Weizhu Chen, Jiawei Han
2021ICMLBANG: Bridging Autoregressive and Non-autoregressive Generation with Large Scale Pretraining.Weizhen Qi, Yeyun Gong, Jian Jiao, Yu Yan, Weizhu Chen, Dayiheng Liu, Kewen Tang, Houqiang Li, Jiusheng Chen, Ruofei Zhang, Ming Zhou, Nan Duan
2021ICMLPoolingformer: Long Document Modeling with Pooling Attention.Hang Zhang, Yeyun Gong, Yelong Shen, Weisheng Li, Jiancheng Lv, Nan Duan, Weizhu Chen
2021KDDContextual Bandit Applications in a Customer Support Bot.Sandra Sajeev, Jade Huang, Nikos Karampatziakis, Matthew Hall, Sebastian Kochman, Weizhu Chen
2020ACLSMART: Robust and Efficient Fine-Tuning for Pre-trained Natural Language Models through Principled Regularized Optimization.Haoming Jiang, Pengcheng He, Weizhu Chen, Xiaodong Liu, Jianfeng Gao, Tuo Zhao
2020ACLThe Microsoft Toolkit of Multi-Task Deep Neural Networks for Natural Language Understanding.Xiaodong Liu, Yu Wang, Jianshu Ji, Hao Cheng, Xueyun Zhu, Emmanuel Awa, Pengcheng He, Weizhu Chen, Hoifung Poon, Guihong Cao, Jianfeng Gao
2020EMNLPUnderstanding the Difficulty of Training Transformers.Liyuan Liu, Xiaodong Liu, Jianfeng Gao, Weizhu Chen, Jiawei Han
2020EMNLPExploiting Structured Knowledge in Text via Graph-Guided Representation Learning.Tao Shen, Yi Mao, Pengcheng He, Guodong Long, Adam Trischler, Weizhu Chen
2020ICLROn the Variance of the Adaptive Learning Rate and Beyond.Liyuan Liu, Haoming Jiang, Pengcheng He, Weizhu Chen, Xiaodong Liu, Jianfeng Gao, Jiawei Han
2019ACLMulti-Task Deep Neural Networks for Natural Language Understanding.Xiaodong Liu, Pengcheng He, Weizhu Chen, Jianfeng Gao
2019EMNLPParameter-free Sentence Embedding via Orthogonal Basis.Ziyi Yang, Chenguang Zhu, Weizhu Chen
2019NAACLLearning to Attend On Essential Terms: An Enhanced Retriever-Reader Model for Open-domain Question Answering.Jianmo Ni, Chenguang Zhu, Weizhu Chen, Julian J. McAuley
2018ICLRFusionNet: Fusing via Fully-aware Attention with Application to Machine Comprehension.Hsin-Yuan Huang, Chenguang Zhu, Yelong Shen, Weizhu Chen
2017KDDReasoNet: Learning to Stop Reading in Machine Comprehension.Yelong Shen, Po-Sen Huang, Jianfeng Gao, Weizhu Chen
2017SDMLimited-memory Common-directions Method for Distributed Optimization and its Application on Empirical Risk Minimization.Ching-Pei Lee, Po-Wei Wang, Weizhu Chen, Chih-Jen Lin
2014CIKMTransfer Understanding from Head Queries to Tail Queries.Yangqiu Song, Haixun Wang, Weizhu Chen, Shusen Wang
2012WSDMBeyond ten blue links: enabling user click modeling in federated web search.Danqi Chen, Weizhu Chen, Haixun Wang, Zheng Chen, Qiang Yang
2012WSDMA noise-aware click model for web search.Weizhu Chen, Dong Wang, Yuchen Zhang, Zheng Chen, Adish Singla, Qiang Yang
2012WSDMPersonalized click model through collaborative filtering.Si Shen, Botao Amber Hu, Weizhu Chen, Qiang Yang
2011AAAIA Whole Page Click Model to Better Interpret Search Engine Click Data.Weizhu Chen, Zhanglong Ji, Si Shen, Qiang Yang
2011ICDMCharacterizing Inverse Time Dependency in Multi-class Learning.Danqi Chen, Weizhu Chen, Qiang Yang
2011IJCAIShort Text Conceptualization Using a Probabilistic Knowledgebase.Yangqiu Song, Haixun Wang, Zhongyuan Wang, Hongsong Li, Weizhu Chen
2011KDDUser-click modeling for understanding and predicting search-behavior.Yuchen Zhang, Weizhu Chen, Dong Wang, Qiang Yang
2011WWWCharacterizing search intent diversity into click models.Botao Amber Hu, Yuchen Zhang, Weizhu Chen, Gang Wang, Qiang Yang
2011WSDMAction prediction and identification from mining temporal user behaviors.Dakan Wang, Gang Wang, Xiaofeng Ke, Weizhu Chen
2010CIKMExplore click models for search ranking.Dong Wang, Weizhu Chen, Gang Wang, Yuchen Zhang, Botao Amber Hu
2010CIKMLearning click models via probit bayesian inference.Yuchen Zhang, Dong Wang, Gang Wang, Weizhu Chen, Zhihua Zhang, Botao Amber Hu, Li Zhang
2010WWWCo-optimization of multiple relevance metrics in web search.Dong Wang, Chenguang Zhu, Weizhu Chen, Gang Wang, Zheng Chen
2010SIGIRIncorporating post-click behaviors into a click model.Feimin Zhong, Dong Wang, Gang Wang, Weizhu Chen, Yuchen Zhang, Zheng Chen, Haixun Wang
2010WSDMA novel click model and its applications to online advertising.Zeyuan Allen Zhu, Weizhu Chen, Tom Minka, Chenguang Zhu, Zheng Chen
2009CIKMTo divide and conquer search ranking by learning query difficulty.Zeyuan Allen Zhu, Weizhu Chen, Tao Wan, Chenguang Zhu, Gang Wang, Zheng Chen
2009CIKMA general magnitude-preserving boosting algorithm for search ranking.Chenguang Zhu, Weizhu Chen, Zeyuan Allen Zhu, Gang Wang, Dong Wang, Zheng Chen
2009ICDMP-packSVM: Parallel Primal grAdient desCent Kernel SVM.Zeyuan Allen Zhu, Weizhu Chen, Gang Wang, Chenguang Zhu, Zheng Chen
2009ICDMInverse Time Dependency in Convex Regularized Learning.Zeyuan Allen Zhu, Weizhu Chen, Chenguang Zhu, Gang Wang, Haixun Wang, Zheng Chen
2008AAAIMining Translations of Web Queries from Web Click-through Data.Rong Hu, Weizhu Chen, Jian Hu, Yansheng Lu, Zheng Chen, Qiang Yang
2008SIGIRWeb query translation via web log mining.Rong Hu, Weizhu Chen, Peng Bai, Yansheng Lu, Zheng Chen, Qiang Yang
2007AAAIMining Web Query Hierarchies from Clickthrough Data.Dou Shen, Min Qin, Weizhu Chen, Qiang Yang, Zheng Chen
2007ICDMDocument Transformation for Multi-label Feature Selection in Text Categorization.Weizhu Chen, Jun Yan, Benyu Zhang, Zheng Chen, Qiang Yang