| 2026 | ACL | Is Grokking Worthwhile? Functional Analysis and Transferability of Generalization Circuits in Transformers. | Kaiyu He, Mian Zhang, Peilin Wu, Xinya Du, Zhiyu Chen |
| 2026 | ACL | FIFA: Unified Faithfulness Evaluation Framework for Text-to-Video and Video-to-Text Generation. | Liqiang Jing, Viet Dac Lai, Seunghyun Yoon, Trung Bui, Xinya Du |
| 2026 | ACL | Your Reasoning Model is Secretly a Reward Model - Optimization-Free Verification from Experience. | Zhenwen Liang, Ruosen Li, Yujun Zhou, Linfeng Song, Dian Yu, Xinya Du, Haitao Mi, Dong Yu |
| 2025 | ACL | FIHA: Automated Fine-grained Hallucinations Evaluations in Large Vision Language Models with Davidson Scene Graphs. | Bowen Yan, Zhengsong Zhang, Liqiang Jing, Eftekhar Hossain, Xinya Du |
| 2025 | EMNLP | SciEvent: Benchmarking Multi-domain Scientific Event Extraction. | Bofu Dong, Pritesh Shah, Sumedh Sonawane, Tiyasha Banerjee, Erin Brady, Xinya Du, Ming Jiang |
| 2025 | EMNLP | FG-PRM: Fine-grained Hallucination Detection and Mitigation in Language Model Mathematical Reasoning. | Ruosen Li, Ziming Luo, Xinya Du |
| 2025 | EMNLP | Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty. | Peilin Wu, Mian Zhang, Xinlu Zhang, Xinya Du, Zhiyu Chen |
| 2025 | EMNLP | LMR-BENCH: Evaluating LLM Agent's Ability on Reproducing Language Modeling Research. | Shuo Yan, Ruochen Li, Ziming Luo, Zimu Wang, Daoyang Li, Liqiang Jing, Kaiyu He, Peilin Wu, Juntong Ni, George Michalopoulos, Yue Zhang, Ziyang Zhang, Mian Zhang, Zhiyu Chen, Xinya Du |
| 2025 | ICLR | DSBench: How Far Are Data Science Agents from Becoming Data Science Experts? | Liqiang Jing, Zhehui Huang, Xiaoyang Wang, Wenlin Yao, Wenhao Yu, Kaixin Ma, Hongming Zhang, Xinya Du, Dong Yu |
| 2025 | ICML | VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models. | Haojian Huang, Haodong Chen, Shengqiong Wu, Meng Luo, Jinlan Fu, Xinya Du, Hanwang Zhang, Hao Fei |
| 2024 | AAAI | Making Natural Language Reasoning Explainable and Faithful. | Xinya Du |
| 2024 | ACL | Large Language Models for Automated Open-domain Scientific Hypotheses Discovery. | Zonglin Yang, Xinya Du, Junxian Li, Jie Zheng, Soujanya Poria, Erik Cambria |
| 2024 | EACL | QAEVENT: Event Extraction as Question-Answer Pairs Generation. | Milind Choudhary, Xinya Du |
| 2024 | EACL | Language Models as Inductive Reasoners. | Zonglin Yang, Li Dong, Xinya Du, Hao Cheng, Erik Cambria, Xiaodong Liu, Jianfeng Gao, Furu Wei |
| 2024 | EMNLP | FaithScore: Fine-grained Evaluations of Hallucinations in Large Vision-Language Models. | Liqiang Jing, Ruosen Li, Yunmo Chen, Xinya Du |
| 2024 | EMNLP | Document-level Causal Relation Extraction with Knowledge-guided Binary Question Answering. | Zimu Wang, Lei Xia, Wei Xjtlu, Xinya Du |
| 2024 | IROS | Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning. | Jishnu Jaykumar P, Kamalesh Palanisamy, Yu-Wei Chao, Xinya Du, Yu Xiang |
| 2023 | ACL | Zero-Shot Classification by Logical Reasoning on Natural Language Explanations. | Chi Han, Hengzhi Pei, Xinya Du, Heng Ji |
| 2023 | EACL | End-to-end Case-Based Reasoning for Commonsense Knowledge Base Completion. | Zonglin Yang, Xinya Du, Erik Cambria, Claire Cardie |
| 2023 | EMNLP | Leveraging Structured Information for Explainable Multi-hop Question Answering and Reasoning. | Ruosen Li, Xinya Du |
| 2023 | EMNLP | POE: Process of Elimination for Multiple Choice Reasoning. | Chenkai Ma, Xinya Du |
| 2023 | EMNLP | Probing Representations for Document-level Event Extraction. | Barry Wang, Xinya Du, Claire Cardie |
| 2023 | ICLR | Logical Entity Representation in Knowledge-Graphs for Differentiable Rule Learning. | Chi Han, Qizheng He, Charles Yu, Xinya Du, Hanghang Tong, Heng Ji |
| 2022 | ACL | Automatic Error Analysis for Document-level Information Extraction. | Aliva Das, Xinya Du, Barry Wang, Kejian Shi, Jiayuan Gu, Thomas Porter, Claire Cardie |
| 2022 | ACL | Dynamic Global Memory for Document-level Argument Extraction. | Xinya Du, Sha Li, Heng Ji |
| 2022 | EMNLP | Retrieval-Augmented Generative Question Answering for Event Argument Extraction. | Xinya Du, Heng Ji |
| 2021 | ACL | QA-Driven Zero-shot Slot Filling with Weak Supervision Pretraining. | Xinya Du, Luheng He, Qi Li, Dian Yu, Panupong Pasupat, Yuan Zhang |
| 2021 | EACL | GRIT: Generative Role-filler Transformers for Document-level Event Entity Extraction. | Xinya Du, Alexander M. Rush, Claire Cardie |
| 2021 | NAACL | Template Filling with Generative Transformers. | Xinya Du, Alexander M. Rush, Claire Cardie |
| 2021 | NAACL | Few-shot Intent Classification and Slot Filling with Retrieved Examples. | Dian Yu, Luheng He, Yuan Zhang, Xinya Du, Panupong Pasupat, Qi Li |
| 2020 | ACL | Document-Level Event Role Filler Extraction using Multi-Granularity Contextualized Encoding. | Xinya Du, Claire Cardie |
| 2020 | EMNLP | Event Extraction by Answering (Almost) Natural Questions. | Xinya Du, Claire Cardie |
| 2020 | EMNLP | Improving Event Duration Prediction via Time-aware Pre-training. | Zonglin Yang, Xinya Du, Alexander M. Rush, Claire Cardie |
| 2020 | IJCNLP | Leveraging Structured Metadata for Improving Question Answering on the Web. | Xinya Du, Ahmed Hassan Awadallah, Adam Fourney, Robert Sim, Paul N. Bennett, Claire Cardie |
| 2019 | NAACL | Be Consistent! Improving Procedural Text Comprehension using Label Consistency. | Xinya Du, Bhavana Dalvi Mishra, Niket Tandon, Antoine Bosselut, Wen-tau Yih, Peter Clark, Claire Cardie |
| 2018 | ACL | Harvesting Paragraph-level Question-Answer Pairs from Wikipedia. | Xinya Du, Claire Cardie |
| 2017 | ACL | Learning to Ask: Neural Question Generation for Reading Comprehension. | Xinya Du, Junru Shao, Claire Cardie |
| 2017 | EMNLP | Identifying Where to Focus in Reading Comprehension for Neural Question Generation. | Xinya Du, Claire Cardie |