Skip to content

Baolin Peng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

59

Venues

17

Active years

2013–2026

Best venue rank

A*

Where they publish

Papers

59 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLLEDGER: Scaling Agentic Document Editing with Dependency-aware Graph Retrieval.Hang Wang, Utkarsh Garg, Reza Davari, Huitian Jiao, Hao Cheng, Baolin Peng, Si-Qing Chen, Tao Ge
2026ACLSynthAgent: Adapting Web Agents with Synthetic Supervision.Zhaoyang Wang, Yiming Liang, Xuchao Zhang, Qianhui Wu, Siwei Han, Anson Bastos, Rujia Wang, Chetan Bansal, Baolin Peng, Jianfeng Gao, Saravan Rajmohan, Huaxiu Yao
2025AAAILiteSearch: Efficient Tree Search with Dynamic Exploration Budget for Math Reasoning.Ante Wang, Linfeng Song, Ye Tian, Baolin Peng, Dian Yu, Haitao Mi, Jinsong Su, Dong Yu
2025ACLSelf-Tuning: Instructing LLMs to Effectively Acquire New Knowledge through Self-Teaching.Xiaoying Zhang, Baolin Peng, Ye Tian, Jingyan Zhou, Yipeng Zhang, Haitao Mi, Helen M. Meng
2025COLINGEntropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models.Souvik Das, Lifeng Jin, Linfeng Song, Haitao Mi, Baolin Peng, Dong Yu
2025CVPRMagma: A Foundation Model for Multimodal AI Agents.Jianwei Yang, Reuben Tan, Qianhui Wu, Ruijie Zheng, Baolin Peng, Yongyuan Liang, Yu Gu, Mu Cai, Seonghyeon Ye, Joel Jang, Yuquan Deng, Jianfeng Gao
2025EMNLPSimulatorArena: Are User Simulators Reliable Proxies for Multi-Turn Evaluation of AI Assistants?Yao Dou, Michel Galley, Baolin Peng, Chris Kedzie, Weixin Cai, Alan Ritter, Chris Quirk, Wei Xu, Jianfeng Gao
2025ICLRExACT: Teaching AI Agents to Explore with Reflective-MCTS and Exploratory Learning.Xiao Yu, Baolin Peng, Vineeth Vajipey, Hao Cheng, Michel Galley, Jianfeng Gao, Zhou Yu
2025ICLRLatent Action Pretraining from Videos.Seonghyeon Ye, Joel Jang, Byeongguk Jeon, Se June Joo, Jianwei Yang, Baolin Peng, Ajay Mandlekar, Reuben Tan, Yu-Wei Chao, Bill Yuchen Lin, Lars Liden, Kimin Lee, Jianfeng Gao, Luke Zettlemoyer, Dieter Fox, Minjoon Seo
2025ICLRIterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning.Yuheng Zhang, Dian Yu, Baolin Peng, Linfeng Song, Ye Tian, Mingyue Huo, Nan Jiang, Haitao Mi, Dong Yu
2025ICMLCollabLLM: From Passive Responders to Active Collaborators.Shirley Wu, Michel Galley, Baolin Peng, Hao Cheng, Gavin Li, Yao Dou, Weixin Cai, James Zou, Jure Leskovec, Jianfeng Gao
2024ACLImproving LLM Generations via Fine-Grained Self-Endorsement.Ante Wang, Linfeng Song, Baolin Peng, Lifeng Jin, Ye Tian, Haitao Mi, Jinsong Su, Dong Yu
2024ACLSelf-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation.Xiaoying Zhang, Baolin Peng, Ye Tian, Jingyan Zhou, Lifeng Jin, Linfeng Song, Haitao Mi, Helen Meng
2024EMNLPEvaluating the Instruction-Following Robustness of Large Language Models to Prompt Injection.Zekun Li, Baolin Peng, Pengcheng He, Xifeng Yan
2024EMNLPSelf-Consistency Boosts Calibration for Math Reasoning.Ante Wang, Linfeng Song, Ye Tian, Baolin Peng, Lifeng Jin, Haitao Mi, Jinsong Su, Dong Yu
2024ICLRThe Trickle-down Impact of Reward Inconsistency on RLHF.Lingfeng Shen, Sihao Chen, Linfeng Song, Lifeng Jin, Baolin Peng, Haitao Mi, Daniel Khashabi, Dong Yu
2024NAACLSub-Sentence Encoder: Contrastive Learning of Propositional Semantic Representations.Sihao Chen, Hongming Zhang, Tong Chen, Ben Zhou, Wenhao Yu, Dian Yu, Baolin Peng, Hongwei Wang, Dan Roth, Dong Yu
2024NAACLSelf-Checker: Plug-and-Play Modules for Fact-Checking with Large Language Models.Miaoran Li, Baolin Peng, Michel Galley, Jianfeng Gao, Zhu Zhang
2024NAACLTeaching Language Models to Self-Improve through Interactive Demonstrations.Xiao Yu, Baolin Peng, Michel Galley, Jianfeng Gao, Zhou Yu
2023ACLZ-Code++: A Pre-trained Language Model Optimized for Abstractive Summarization.Pengcheng He, Baolin Peng, Song Wang, Yang Liu, Ruochen Xu, Hany Hassan, Yu Shi, Chenguang Zhu, Wayne Xiong, Michael Zeng, Jianfeng Gao, Xuedong Huang
2023ACLDIONYSUS: A Pre-trained Model for Low-Resource Dialogue Summarization.Yu Li, Baolin Peng, Pengcheng He, Michel Galley, Zhou Yu, Jianfeng Gao
2023EMNLPConvLab-3: A Flexible Dialogue System Toolkit Based on a Unified Data Format.Qi Zhu, Christian Geishauser, Hsien-Chin Lin, Carel van Niekerk, Baolin Peng, Zheng Zhang, Shutong Feng, Michael Heck, Nurul Lubis, Dazhen Wan, Xiaochen Zhu, Jianfeng Gao, Milica Gasic, Minlie Huang
2023EMNLPInteractive Text Generation.Felix Faltings, Michel Galley, Kiant Brantley, Baolin Peng, Weixin Cai, Yizhe Zhang, Jianfeng Gao, Bill Dolan
2023EMNLPSGP-TOD: Building Task Bots Effortlessly via Schema-Guided LLM Prompting.Xiaoying Zhang, Baolin Peng, Kun Li, Jingyan Zhou, Helen Meng
2023SIGdialEnhancing Task Bot Engagement with Synthesized Open-Domain Dialog.Miaoran Li, Baolin Peng, Michel Galley, Jianfeng Gao, Zhu (Drew) Zhang
2022AAAIValueNet: A New Dataset for Human Value Driven Dialogue System.Liang Qiu, Yizhou Zhao, Jinchao Li, Pan Lu, Baolin Peng, Jianfeng Gao, Song-Chun Zhu
2022EMNLPGrounded Keys-to-Text Generation: Towards Factual Open-Ended Generation.Faeze Brahman, Baolin Peng, Michel Galley, Sudha Rao, Bill Dolan, Snigdha Chaturvedi, Jianfeng Gao
2022NAACLKnowledge-Grounded Dialogue Generation with a Unified Knowledge Representation.Yu Li, Baolin Peng, Yelong Shen, Yi Mao, Lars Liden, Zhou Yu, Jianfeng Gao
2022SIGdialToward Self-Learning End-to-End Task-oriented Dialog Systems.Xiaoying Zhang, Baolin Peng, Jianfeng Gao, Helen Meng
2021ACLEngage the Public: Poll Question Generation for Social Media Posts.Zexin Lu, Keyang Ding, Yuji Zhang, Jing Li, Baolin Peng, Lemao Liu
2021ACLRADDLE: An Evaluation Benchmark and Analysis Platform for Robust Task-oriented Dialog Systems.Baolin Peng, Chunyuan Li, Zhu Zhang, Chenguang Zhu, Jinchao Li, Jianfeng Gao
2021ACLSocAoG: Incremental Graph Parsing for Social Relation Inference in Dialogues.Liang Qiu, Yuan Liang, Yizhou Zhao, Pan Lu, Baolin Peng, Zhou Yu, Ying Nian Wu, Song-Chun Zhu
2021EMNLPFew-Shot Named Entity Recognition: An Empirical Baseline Study.Jiaxin Huang, Chunyuan Li, Krishan Subudhi, Damien Jose, Shobana Balakrishnan, Weizhu Chen, Baolin Peng, Jianfeng Gao, Jiawei Han
2021EMNLP#HowYouTagTweets: Learning User Hashtagging Preferences via Personalized Topic Attention.Yuji Zhang, Yubo Zhang, Chunpu Xu, Jing Li, Ziyan Jiang, Baolin Peng
2021InterspeechData Augmentation for Spoken Language Understanding via Pretrained Language Models.Baolin Peng, Chenguang Zhu, Michael Zeng, Jianfeng Gao
2020ACLConversation Learner - A Machine Teaching Tool for Building Dialog Managers for Task-Oriented Dialog Systems.Swadheen Shukla, Lars Liden, Shahin Shayandeh, Eslam Kamal, Jinchao Li, Matt Mazzola, Thomas Park, Baolin Peng, Jianfeng Gao
2020ACLLearning Efficient Dialogue Policy from Demonstrations through Shaping.Huimin Wang, Baolin Peng, Kam-Fai Wong
2020ACLConvLab-2: An Open-Source Toolkit for Building, Evaluating, and Diagnosing Dialogue Systems.Qi Zhu, Zheng Zhang, Yan Fang, Xiang Li, Ryuichi Takanobu, Jinchao Li, Baolin Peng, Jianfeng Gao, Xiaoyan Zhu, Minlie Huang
2020EMNLPGuided Dialogue Policy Learning without Adversarial Learning in the Loop.Ziming Li, Sungjin Lee, Baolin Peng, Jinchao Li, Julia Kiseleva, Maarten de Rijke, Shahin Shayandeh, Jianfeng Gao
2020EMNLPOptimus: Organizing Sentences via Pre-trained Modeling of a Latent Space.Chunyuan Li, Xiang Gao, Yuan Li, Baolin Peng, Xiujun Li, Yizhe Zhang, Jianfeng Gao
2020EMNLPFew-shot Natural Language Generation for Task-Oriented Dialog.Baolin Peng, Chenguang Zhu, Chunyuan Li, Xiujun Li, Jinchao Li, Michael Zeng, Jianfeng Gao
2020SIGdialIs Your Goal-Oriented Dialog Model Performing Really Well? Empirical Analysis of System-wise Evaluation.Ryuichi Takanobu, Qi Zhu, Jinchao Li, Baolin Peng, Jianfeng Gao, Minlie Huang
2019ACLConvLab: Multi-Domain End-to-End Dialog System Platform.Sungjin Lee, Qi Zhu, Ryuichi Takanobu, Zheng Zhang, Yaoqin Zhang, Xiang Li, Jinchao Li, Baolin Peng, Xiujun Li, Minlie Huang, Jianfeng Gao
2019IJCAIBuilding Personalized Simulator for Interactive Search.Qianlong Liu, Baoliang Cui, Zhongyu Wei, Baolin Peng, Haikuan Huang, Hongbo Deng, Jianye Hao, Xuanjing Huang, Kam-Fai Wong
2018ACLDeep Dyna-Q: Integrating Planning for Task-Completion Dialogue Policy Learning.Baolin Peng, Xiujun Li, Jianfeng Gao, Jingjing Liu, Kam-Fai Wong
2018ACLTask-oriented Dialogue System for Automatic Diagnosis.Zhongyu Wei, Qianlong Liu, Baolin Peng, Huaixiao Tou, Ting Chen, Xuanjing Huang, Kam-Fai Wong, Xiangying Dai
2018ICASSPAdversarial Advantage Actor-Critic Model for Task-Completion Dialogue Policy Learning.Baolin Peng, Xiujun Li, Jianfeng Gao, Jingjing Liu, Yun-Nung Chen, Kam-Fai Wong
2017AAAIWord Embedding Based Correlation Model for Question/Answer Matching.Yikang Shen, Wenge Rong, Nan Jiang, Baolin Peng, Jie Tang, Zhang Xiong
2017EACLMay I take your order? A Neural Model for Extracting Structured Information from Conversations.Baolin Peng, Michael L. Seltzer, Y. C. Ju, Geoffrey Zweig, Kam-Fai Wong
2017EMNLPComposite Task-Completion Dialogue Policy Learning via Hierarchical Deep Reinforcement Learning.Baolin Peng, Xiujun Li, Lihong Li, Jianfeng Gao, Asli Celikyilmaz, Sungjin Lee, Kam-Fai Wong
2016COLINGACE: Automatic Colloquialism, Typographical and Orthographic Errors Detection for Chinese Language.Shichao Dong, Gabriel Pui Cheong Fung, Binyang Li, Baolin Peng, Ming Liao, Jia Zhu, Kam-Fai Wong
2015CICLINGTrending Sentiment-Topic Detection on Twitter.Baolin Peng, Jing Li, Junwen Chen, Xu Han, Ruifeng Xu, Kam-Fai Wong
2015EMNLPUsing Content-level Structures for Summarizing Microblog Repost Trees.Jing Li, Wei Gao, Zhongyu Wei, Baolin Peng, Kam-Fai Wong
2015ICASSPA factorization network based method for multi-lingual domain classification.Yangyang Shi, Yi-Cheng Pan, Mei-Yuh Hwang, Kaisheng Yao, Hu Chen, Yuanhang Zou, Baolin Peng
2015ICASSPContextual spoken language understanding using recurrent neural networks.Yangyang Shi, Kaisheng Yao, Hu Chen, Yi-Cheng Pan, Mei-Yuh Hwang, Baolin Peng
2015IJCNNAn empirical analysis of different sparse penalties for autoencoder in unsupervised feature learning.Nan Jiang, Wenge Rong, Baolin Peng, Yifan Nie, Zhang Xiong
2014ICASSPRecurrent conditional random field for language understanding.Kaisheng Yao, Baolin Peng, Geoffrey Zweig, Dong Yu, Xiaolong Li, Feng Gao
2014WWWLearning joint representation for community question answering with tri-modal DBM.Baolin Peng, Wenge Rong, Yuanxin Ouyang, Chao Li, Zhang Xiong
2013DASCSemi-supervised Dual Recurrent Neural Network for Sentiment Analysis.Wenge Rong, Baolin Peng, Yuanxin Ouyang, Chao Li, Zhang Xiong