Skip to content

Richard Yuanzhe Pang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

19

Venues

6

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

19 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLAdvancedIF: Rubric-Based Benchmarking and Reinforcement Learning for Advancing LLM Instruction Following.Yun He, Wenzhe Li, Hejia Zhang, Songlin Li, Karishma Mandyam, Sopan Khosla, Yuanhao Xiong, Nanshu Wang, Xiaoliang Peng, Beibin Li, Shengjie Bi, Shishir G. Patil, Qi Qi, Shengyu Feng, Julian Katz-Samuels, Richard Yuanzhe Pang, Sujan Kumar Gonugondla, Hunter Lang, Yue Yu, Yundi Qian, Maryam Fazel-Zarandi, Licheng Yu, Amine Benhalloum, Hany Hassan Awadalla, Manaal Faruqui
2025ICLRTransformers Struggle to Learn to Search.Abulhair Saparov, Srushti Ajay Pawar, Shreyas Pimpalgaonkar, Nitish Joshi, Richard Yuanzhe Pang, Vishakh Padmakumar, Mehran Kazemi, Najoung Kim, He He
2025ICMLSelf-Consistency Preference Optimization.Archiki Prasad, Weizhe Yuan, Richard Yuanzhe Pang, Jing Xu, Maryam Fazel-Zarandi, Mohit Bansal, Sainbayar Sukhbaatar, Jason E. Weston, Jane Yu
2025NAACLSelf-Generated Critiques Boost Reward Modeling for Language Models.Yue Yu, Zhengxing Chen, Aston Zhang, Liang Tan, Chenguang Zhu, Richard Yuanzhe Pang, Yundi Qian, Xuewei Wang, Suchin Gururangan, Chao Zhang, Melanie Kambadur, Dhruv Mahajan, Rui Hou
2024EACLLeveraging Implicit Feedback from Deployment Data in Dialogue.Richard Yuanzhe Pang, Stephen Roller, Kyunghyun Cho, He He, Jason Weston
2024ICMLSelf-Rewarding Language Models.Weizhe Yuan, Richard Yuanzhe Pang, Kyunghyun Cho, Xian Li, Sainbayar Sukhbaatar, Jing Xu, Jason Weston
2023ACLWhat Do NLP Researchers Believe? Results of the NLP Community Metasurvey.Julian Michael, Ari Holtzman, Alicia Parrish, Aaron Mueller, Alex Wang, Angelica Chen, Divyam Madaan, Nikita Nangia, Richard Yuanzhe Pang, Jason Phang, Samuel R. Bowman
2023ACLReward Gaming in Conditional Text Generation.Richard Yuanzhe Pang, Vishakh Padmakumar, Thibault Sellam, Ankur P. Parikh, He He
2023ICMLExtrapolative Controlled Sequence Generation via Iterative Refinement.Vishakh Padmakumar, Richard Yuanzhe Pang, He He, Ankur P. Parikh
2022ACLToken Dropping for Efficient BERT Pretraining.Le Hou, Richard Yuanzhe Pang, Tianyi Zhou, Yuexin Wu, Xinying Song, Xiaodan Song, Denny Zhou
2022EMNLPSQuALITY: Building a Long-Document Summarization Dataset the Hard Way.Alex Wang, Richard Yuanzhe Pang, Angelica Chen, Jason Phang, Samuel R. Bowman
2022NAACLQuALITY: Question Answering with Long Input Texts, Yes!Richard Yuanzhe Pang, Alicia Parrish, Nitish Joshi, Nikita Nangia, Jason Phang, Angelica Chen, Vishakh Padmakumar, Johnny Ma, Jana Thompson, He He, Samuel R. Bowman
2021ACLAgreeSum: Agreement-Oriented Multi-Document Summarization.Richard Yuanzhe Pang, dm Dniel Lelkes, Vinh Q. Tran, Cong Yu
2021ACLComparing Test Sets with Item Response Theory.Clara Vania, Phu Mon Htut, William Huang, Dhara A. Mungra, Richard Yuanzhe Pang, Jason Phang, Haokun Liu, Kyunghyun Cho, Samuel R. Bowman
2021ICLRText Generation by Learning from Demonstrations.Richard Yuanzhe Pang, He He
2020ACLIntermediate-Task Transfer Learning with Pretrained Language Models: When and Why Does It Work?Yada Pruksachatkun, Jason Phang, Haokun Liu, Phu Mon Htut, Xiaoyi Zhang, Richard Yuanzhe Pang, Clara Vania, Katharina Kann, Samuel R. Bowman
2020ACLENGINE: Energy-Based Inference Networks for Non-Autoregressive Machine Translation.Lifu Tu, Richard Yuanzhe Pang, Sam Wiseman, Kevin Gimpel
2020EMNLPConsistency of a Recurrent Language Model With Respect to Incomplete Decoding.Sean Welleck, Ilia Kulikov, Jaedeok Kim, Richard Yuanzhe Pang, Kyunghyun Cho
2019EMNLPUnsupervised Evaluation Metrics and Learning Criteria for Non-Parallel Textual Transfer.Richard Yuanzhe Pang, Kevin Gimpel