Skip to content

Chenglei Si

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

16

Venues

5

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

16 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLScaling Collaborative Effort with Agents.Shannon Zejiang Shen, Valerie Chen, Ken Gu, Alexis Ross, Zixian Ma, Jillian Ross, Alex Gu, Chenglei Si, Wayne Chi, Andi Peng, Jocelyn J. Shen, Ameet Talwalkar, Tongshuang Wu, David A. Sontag
2025ACLContextual Experience Replay for Self-Improvement of Language Agents.Yitao Liu, Chenglei Si, Karthik R. Narasimhan, Shunyu Yao
2025ACLSPHERE: An Evaluation Card for Human-AI Systems.Dora Zhao, Qianou Ma, Xinran Zhao, Chenglei Si, Chenyang Yang, Ryan Louie, Ehud Reiter, Diyi Yang, Tongshuang Wu
2025ICLRCan LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers.Chenglei Si, Diyi Yang, Tatsunori Hashimoto
2025NAACLDesign2Code: Benchmarking Multimodal Code Generation for Automated Front-End Engineering.Chenglei Si, Yanzhe Zhang, Ryan Li, Zhengyuan Yang, Ruibo Liu, Diyi Yang
2024NAACLLarge Language Models Help Humans Verify Truthfulness - Except When They Are Convincingly Wrong.Chenglei Si, Navita Goyal, Tongshuang Wu, Chen Zhao, Shi Feng, Hal Daum III, Jordan L. Boyd-Graber
2023ACLMeasuring Inductive Biases of In-Context Learning with Underspecified Demonstrations.Chenglei Si, Dan Friedman, Nitish Joshi, Shi Feng, Danqi Chen, He He
2023ACLREADIN: A Chinese Multi-Task Benchmark with Realistic and Diverse Input Noises.Chenglei Si, Zhengyan Zhang, Yingfa Chen, Xiaozhi Wang, Zhiyuan Liu, Maosong Sun
2023EMNLPIgnore This Title and HackAPrompt: Exposing Systemic Vulnerabilities of LLMs Through a Global Prompt Hacking Competition.Sander Schulhoff, Jeremy Pinto, Anaum Khan, Louis-Franois Bouchard, Chenglei Si, Svetlina Anati, Valen Tagliabue, Anson Liu Kost, Christopher Carnahan, Jordan L. Boyd-Graber
2023EMNLPGetting MoRE out of Mixture of Language Model Reasoning Experts.Chenglei Si, Weijia Shi, Chen Zhao, Luke Zettlemoyer, Jordan L. Boyd-Graber
2023ICLRPrompting GPT-3 To Be Reliable.Chenglei Si, Zhe Gan, Zhengyuan Yang, Shuohang Wang, Jianfeng Wang, Jordan L. Boyd-Graber, Lijuan Wang
2022EMNLPRe-Examining Calibration: The Case of Question Answering.Chenglei Si, Chen Zhao, Sewon Min, Jordan L. Boyd-Graber
2021ACLBenchmarking Robustness of Machine Reading Comprehension Models.Chenglei Si, Ziqing Yang, Yiming Cui, Wentao Ma, Ting Liu, Shijin Wang
2021ACLBetter Robustness by More Coverage: Adversarial and Mixup Data Augmentation for Robust Finetuning.Chenglei Si, Zhengyan Zhang, Fanchao Qi, Zhiyuan Liu, Yasheng Wang, Qun Liu, Maosong Sun
2021EMNLPWhat's in a Name? Answer Equivalence For Open-Domain Question Answering.Chenglei Si, Chen Zhao, Jordan L. Boyd-Graber
2020COLINGCharBERT: Character-aware Pre-trained Language Model.Wentao Ma, Yiming Cui, Chenglei Si, Ting Liu, Shijin Wang, Guoping Hu