| 2026 | ACL | Decoupling Task-Solving and Output Formatting in LLM Generation. | Haikang Deng, Po-Nien Kung, Nanyun Peng |
| 2026 | ACL | LiveCLKTBench: Towards Reliable Evaluation of Cross-Lingual Knowledge Transfer in Multilingual LLMs. | Pei-Fu Guo, Yun-Da Tsai, Chun-Chia Hsu, Kai-Xin Chen, Ya-An Tsai, Kai-Wei Chang, Nanyun Peng, Mi-Yen Yeh, Shou-De Lin |
| 2026 | ACL | Beyond Facts- Benchmarking Distributional Reading Comprehension in Large Language Models. | Pei-Fu Guo, Ya-An Tsai, Chun-Chia Hsu, Kai-Xin Chen, Yun-Da Tsai, Kai-Wei Chang, Nanyun Peng, Mi-Yen Yeh, Shou-De Lin |
| 2026 | ACL | BRIEF-Pro: Universal Context Compression with Short-to-Long Synthesis for Fast and Accurate Multi-Hop Reasoning. | Jia-Chen Gu, Junyi Zhang, Di Wu, Yuankai Li, Kai-Wei Chang, Nanyun Peng |
| 2026 | ACL | MM-PoisonRAG: Disrupting Multimodal RAG with Local and Global Knowledge Poisoning Attacks. | Hyeonjeong Ha, Qiusi Zhan, Jeonghwan Kim, Dimitrios Bralios, Saikrishna Sanniboina, Nanyun Peng, Kai-Wei Chang, Daniel Kang, Heng Ji |
| 2026 | EACL | Rethinking Creativity Evaluation: A Critical Analysis of Existing Creativity Evaluations. | Li-Chun Lu, Miri Liu, Pin-Chun Lu, Yufei Tian, Shao-Hua Sun, Nanyun Peng |
| 2026 | IUI | CoLyricist: Enhancing Lyric Writing with AI through Workflow-Aligned Support. | Masahiro Yoshida, Bingxuan Li, Songyan Zhao, Qinyi Zhou, Shiwei Hu, Xiang Anthony Chen, Nanyun Peng |
| 2025 | ACL | Comparing Bad Apples to Good Oranges Aligning Large Language Models via Joint Preference Optimization. | Hritik Bansal, Ashima Suvarna, Gantavya Bhatt, Nanyun Peng, Kai-Wei Chang, Aditya Grover |
| 2025 | ACL | Collapse of Dense Retrievers: Short, Early, and Literal Biases Outranking Factual Evidence. | Mohsen Fayyaz, Ali Modarressi, Hinrich Schtze, Nanyun Peng |
| 2025 | ACL | SYNTHIA: Novel Concept Design with Affordance Composition. | Hyeonjeong Ha, Xiaomeng Jin, Jeonghwan Kim, Jiateng Liu, Zhenhailong Wang, Khanh Duy Nguyen, Ansel Blume, Nanyun Peng, Kai-Wei Chang, Heng Ji |
| 2025 | ACL | Sandcastles in the Storm: Revisiting the (Im)possibility of Strong Watermarking. | Fabrice Harel-Canada, Boran Erol, Connor Choi, Jason Liu, Gary Jiarui Song, Nanyun Peng, Amit Sahai |
| 2025 | ACL | METAL: A Multi-Agent Framework for Chart Generation with Test-Time Scaling. | Bingxuan Li, Yiwei Wang, Jiuxiang Gu, Kai-Wei Chang, Nanyun Peng |
| 2025 | ACL | DRS: Deep Question Reformulation With Structured Output. | Zhecheng Li, Yiwei Wang, Bryan Hooi, Yujun Cai, Nanyun Peng, Kai-Wei Chang |
| 2025 | ACL | Vulnerability of LLMs to Vertically Aligned Text Manipulations. | Zhecheng Li, Yiwei Wang, Bryan Hooi, Yujun Cai, Zhen Xiong, Nanyun Peng, Kai-Wei Chang |
| 2025 | ACL | SkillVerse : Assessing and Enhancing LLMs with Tree Evaluation. | Yufei Tian, Jiao Sun, Nanyun Peng, Zizhao Zhang |
| 2025 | ACL | Mind the Gesture: Evaluating AI Sensitivity to Culturally Offensive Non-Verbal Gestures. | Akhila Yerukola, Saadia Gabriel, Nanyun Peng, Maarten Sap |
| 2025 | ACL | Model Extrapolation Expedites Alignment. | Chujie Zheng, Ziqi Wang, Heng Ji, Minlie Huang, Nanyun Peng |
| 2025 | COLING | Con-ReCall: Detecting Pre-training Data in LLMs via Contrastive Decoding. | Cheng Wang, Yiwei Wang, Bryan Hooi, Yujun Cai, Nanyun Peng, Kai-Wei Chang |
| 2025 | CVPR | VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning. | Xueqing Wu, Yuheng Ding, Bingxuan Li, Pan Lu, Da Yin, Kai-Wei Chang, Nanyun Peng |
| 2025 | EMNLP | SNaRe: Domain-aware Data Generation for Low-Resource Event Detection. | Tanmay Parekh, Yuxuan Dong, Lucas Bandarkar, Artin Kim, I-Hung Hsu, Kai-Wei Chang, Nanyun Peng |
| 2025 | EMNLP | DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning. | Tanmay Parekh, Kartik Mehta, Ninareh Mehrabi, Kai-Wei Chang, Nanyun Peng |
| 2025 | EMNLP | FLAMES: Improving LLM Math Reasoning via a Fine-Grained Analysis of the Data Synthesis Pipeline. | Parker Seegmiller, Kartik Mehta, Soumya Saha, Chenyang Tao, Shereen Oraby, Arpit Gupta, Tagyoung Chung, Mohit Bansal, Nanyun Peng |
| 2025 | EMNLP | How to Make Large Language Models Generate 100% Valid Molecules? | Wen Tao, Jing Tang, Alvin Chan, Bryan Hooi, Baolong Bi, Nanyun Peng, Yuansheng Liu, Yiwei Wang |
| 2025 | EMNLP | CaKE: Circuit-aware Editing Enables Generalizable Knowledge Learners. | Yunzhi Yao, Jizhan Fang, Jia-Chen Gu, Ningyu Zhang, Shumin Deng, Huajun Chen, Nanyun Peng |
| 2025 | ICCV | Verbalized Representation Learning for Interpretable Few-Shot Generalization. | Cheng-Fu Yang, Da Yin, Wenbo Hu, Heng Ji, Nanyun Peng, Bolei Zhou, Kai-Wei Chang |
| 2025 | ICLR | MRAG-Bench: Vision-Centric Evaluation for Retrieval-Augmented Multimodal Models. | Wenbo Hu, Jia-Chen Gu, Zi-Yi Dou, Mohsen Fayyaz, Pan Lu, Kai-Wei Chang, Nanyun Peng |
| 2025 | ICML | Contrastive Visual Data Augmentation. | Yu Zhou, Bingxuan Li, Mohan Tang, Xiaomeng Jin, Te-Lin Wu, Kuan-Hao Huang, Heng Ji, Kai-Wei Chang, Nanyun Peng |
| 2025 | ICML | Scaling Probabilistic Circuits via Monarch Matrices. | Honghua Zhang, Meihua Dang, Benjie Wang, Stefano Ermon, Nanyun Peng, Guy Van den Broeck |
| 2025 | NAACL | Guiding Through Complexity: What Makes Good Supervision for Hard Reasoning Tasks? | Xuan He, Da Yin, Nanyun Peng |
| 2025 | NAACL | BRIEF: Bridging Retrieval and Inference for Multi-hop Reasoning via Compression. | Yuankai Li, Jia-Chen Gu, Di Wu, Kai-Wei Chang, Nanyun Peng |
| 2025 | NAACL | Evaluating Cultural and Social Awareness of LLM Web Agents. | Haoyi Qiu, Alexander R. Fabbri, Divyansh Agarwal, Kung-Hsiang Huang, Sarah Tan, Nanyun Peng, Chien-Sheng Wu |
| 2025 | NAACL | Vulnerability of Large Language Models to Output Prefix Jailbreaks: Impact of Positions on Safety. | Yiwei Wang, Muhao Chen, Nanyun Peng, Kai-Wei Chang |
| 2025 | NAACL | REFFLY: Melody-Constrained Lyrics Editing Model. | Songyan Zhao, Bingxuan Li, Yufei Tian, Nanyun Peng |
| 2025 | WACV | Improving Faithfulness of Text-to-Image Diffusion Models through Inference Intervention. | Danfeng Guo, Sanchit Agarwal, Yu-Hsiang Lin, Jiun-Yu Kao, Tagyoung Chung, Nanyun Peng, Mohit Bansal |
| 2024 | AAAI | MIDDAG: Where Does Our News Go? Investigating Information Diffusion via Community-Level Information Pathways. | Mingyu Derek Ma, Alexander K. Taylor, Nuan Wen, Yanchen Liu, Po-Nien Kung, Wenna Qin, Shicheng Wen, Azure Zhou, Diyi Yang, Xuezhe Ma, Nanyun Peng, Wei Wang |
| 2024 | AAAI | STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models. | Mingyu Derek Ma, Xiaoxuan Wang, Po-Nien Kung, P. Jeffrey Brantingham, Nanyun Peng, Wei Wang |
| 2024 | ACL | Improving Event Definition Following For Zero-Shot Event Detection. | Zefan Cai, Po-Nien Kung, Ashima Suvarna, Mingyu Derek Ma, Hritik Bansal, Baobao Chang, P. Jeffrey Brantingham, Wei Wang, Nanyun Peng |
| 2024 | ACL | CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation. | I-Hung Hsu, Zifeng Wang, Long T. Le, Lesly Miculicich, Nanyun Peng, Chen-Yu Lee, Tomas Pfister |
| 2024 | ACL | Argument-Aware Approach To Event Linking. | I-Hung Hsu, Zihan Xue, Nilay Pochhi, Sahil Bansal, Prem Natarajan, Jayanth Srinivasa, Nanyun Peng |
| 2024 | ACL | TextEE: Benchmark, Reevaluation, Reflections, and Future Challenges in Event Extraction. | Kuan-Hao Huang, I-Hung Hsu, Tanmay Parekh, Zhiyu Xie, Zixuan Zhang, Prem Natarajan, Kai-Wei Chang, Nanyun Peng, Heng Ji |
| 2024 | ACL | VALOR-EVAL: Holistic Coverage and Faithfulness Evaluation of Large Vision-Language Models. | Haoyi Qiu, Wenbo Hu, Zi-Yi Dou, Nanyun Peng |
| 2024 | ACL | Tracking the Newsworthiness of Public Documents. | Alexander Spangher, Serdar Tumgoren, Ben Welsh, Nanyun Peng, Emilio Ferrara, Jonathan May |
| 2024 | COLING | Medical Vision-Language Pre-Training for Brain Abnormalities. | Masoud Monajatipoor, Zi-Yi Dou, Aichi Chien, Nanyun Peng, Kai-Wei Chang |
| 2024 | EMNLP | VDebugger: Harnessing Execution Feedback for Debugging Visual Programs. | Xueqing Wu, Zongyu Lin, Songyan Zhao, Te-Lin Wu, Pan Lu, Nanyun Peng, Kai-Wei Chang |
| 2024 | EMNLP | Explaining and Improving Contrastive Decoding by Extrapolating the Probabilities of a Huge and Hypothetical LM. | Haw-Shiuan Chang, Nanyun Peng, Mohit Bansal, Anil Ramakrishna, Tagyoung Chung |
| 2024 | EMNLP | Re-ReST: Reflection-Reinforced Self-Training for Language Agents. | Zi-Yi Dou, Cheng-Fu Yang, Xueqing Wu, Kai-Wei Chang, Nanyun Peng |
| 2024 | EMNLP | LLM Self-Correction with DeCRIM: Decompose, Critique, and Refine for Enhanced Following of Instructions with Multiple Constraints. | Thomas Palmeira Ferraz, Kartik Mehta, Yu-Hsiang Lin, Haw-Shiuan Chang, Shereen Oraby, Sijia Liu, Vivek Subramanian, Tagyoung Chung, Mohit Bansal, Nanyun Peng |
| 2024 | EMNLP | Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue. | Jia-Chen Gu, Hao-Xiang Xu, Jun-Yu Ma, Pan Lu, Zhen-Hua Ling, Kai-Wei Chang, Nanyun Peng |
| 2024 | EMNLP | Measuring Psychological Depth in Language Models. | Fabrice Harel-Canada, Hanyu Zhou, Sreya Muppalla, Zeynep Yildiz, Miryung Kim, Amit Sahai, Nanyun Peng |
| 2024 | EMNLP | Uncertainty Calibration for Tool-Using Language Agents. | Hao Liu, Zi-Yi Dou, Yixin Wang, Nanyun Peng, Yisong Yue |
| 2024 | EMNLP | Control Large Language Models via Divide and Conquer. | Bingxuan Li, Yiwei Wang, Tao Meng, Kai-Wei Chang, Nanyun Peng |
| 2024 | EMNLP | LLM-A*: Large Language Model Enhanced Incremental Heuristic Search on Path Planning. | Silin Meng, Yiwei Wang, Cheng-Fu Yang, Nanyun Peng, Kai-Wei Chang |
| 2024 | EMNLP | SPEED++: A Multilingual Event Extraction Framework for Epidemic Prediction and Preparedness. | Tanmay Parekh, Jeffrey Kwan, Jiarui Yu, Sparsh Johri, Hyosang Ahn, Sreya Muppalla, Kai-Wei Chang, Wei Wang, Nanyun Peng |
| 2024 | EMNLP | Do LLMs Plan Like Human Writers? Comparing Journalist Coverage of Press Releases with LLMs. | Alexander Spangher, Nanyun Peng, Sebastian Gehrmann, Mark Dredze |
| 2024 | EMNLP | Explaining Mixtures of Sources in News Articles. | Alexander Spangher, James Youn, Matt DeButts, Nanyun Peng, Emilio Ferrara, Jonathan May |
| 2024 | EMNLP | QUDSELECT: Selective Decoding for Questions Under Discussion Parsing. | Ashima Suvarna, Xiao Liu, Tanmay Parekh, Kai-Wei Chang, Nanyun Peng |
| 2024 | EMNLP | Are Large Language Models Capable of Generating Human-Level Narratives? | Yufei Tian, Tenghao Huang, Miri Liu, Derek Jiang, Alexander Spangher, Muhao Chen, Jonathan May, Nanyun Peng |
| 2024 | EMNLP | Detecting Machine-Generated Long-Form Content with Latent-Space Variables. | Yufei Tian, Zeyu Pan, Nanyun Peng |
| 2024 | EMNLP | Synchronous Faithfulness Monitoring for Trustworthy Retrieval-Augmented Generation. | Di Wu, Jia-Chen Gu, Fan Yin, Nanyun Peng, Kai-Wei Chang |
| 2024 | ICLR | RLCD: Reinforcement Learning from Contrastive Distillation for LM Alignment. | Kevin Yang, Dan Klein, Asli Celikyilmaz, Nanyun Peng, Yuandong Tian |
| 2024 | ICML | DiNADO: Norm-Disentangled Neurally-Decomposed Oracles for Controlling Language Models. | Sidi Lu, Wenbo Zhao, Chenyang Tao, Arpit Gupta, Shanchan Wu, Tagyoung Chung, Nanyun Peng |
| 2024 | ICML | Open-Domain Text Evaluation via Contrastive Distribution Methods. | Sidi Lu, Hongyi Liu, Asli Celikyilmaz, Tianlu Wang, Nanyun Peng |
| 2024 | ICML | ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models. | Rohan Wadhawan, Hritik Bansal, Kai-Wei Chang, Nanyun Peng |
| 2024 | ICML | On Prompt-Driven Safeguarding for Large Language Models. | Chujie Zheng, Fan Yin, Hao Zhou, Fandong Meng, Jie Zhou, Kai-Wei Chang, Minlie Huang, Nanyun Peng |
| 2024 | NAACL | Human-in-the-Loop Synthetic Text Data Inspection with Provenance Tracking. | Hong Jin Kang, Fabrice Harel-Canada, Muhammad Ali Gulzar, Nanyun Peng, Miryung Kim |
| 2024 | NAACL | Mitigating Bias for Question Answering Models by Tracking Bias Influence. | Mingyu Derek Ma, Jiun-Yu Kao, Arpit Gupta, Yu-Hsiang Lin, Wenbo Zhao, Tagyoung Chung, Wei Wang, Kai-Wei Chang, Nanyun Peng |
| 2024 | NAACL | Contextual Label Projection for Cross-Lingual Structured Prediction. | Tanmay Parekh, I-Hung Hsu, Kuan-Hao Huang, Kai-Wei Chang, Nanyun Peng |
| 2024 | NAACL | Event Detection from Social Media for Epidemic Prediction. | Tanmay Parekh, Anh Mac, Jiarui Yu, Yuxuan Dong, Syed Shahriar, Bonnie Liu, Eric Yang, Kuan-Hao Huang, Wei Wang, Nanyun Peng, Kai-Wei Chang |
| 2024 | NAACL | AMRFact: Enhancing Summarization Factuality Evaluation with AMR-Driven Negative Samples Generation. | Haoyi Qiu, Kung-Hsiang Huang, Jingnong Qu, Nanyun Peng |
| 2024 | NAACL | MacGyver: Are Large Language Models Creative Problem Solvers? | Yufei Tian, Abhilasha Ravichander, Lianhui Qin, Ronan Le Bras, Raja Marjieh, Nanyun Peng, Yejin Choi, Thomas L. Griffiths, Faeze Brahman |
| 2023 | ACL | ACCENT: An Automatic Event Commonsense Evaluation Metric for Open-Domain Dialogue Systems. | Sarik Ghazarian, Yijia Shao, Rujun Han, Aram Galstyan, Nanyun Peng |
| 2023 | ACL | TAGPRIME: A Unified Framework for Relational Structure Extraction. | I-Hung Hsu, Kuan-Hao Huang, Shuning Zhang, Wenxin Cheng, Prem Natarajan, Kai-Wei Chang, Nanyun Peng |
| 2023 | ACL | Code-Switched Text Synthesis in Unseen Language Pairs. | I-Hung Hsu, Avik Ray, Shubham Garg, Nanyun Peng, Jing Huang |
| 2023 | ACL | AMPERE: AMR-Aware Prefix for Generation-Based Event Argument Extraction Model. | I-Hung Hsu, Zhiyu Xie, Kuan-Hao Huang, Prem Natarajan, Nanyun Peng |
| 2023 | ACL | Are Fairy Tales Fair? Analyzing Gender Bias in Temporal Narrative Event Chains of Children's Fairy Tales. | Paulina Toro Isaza, Guangxuan Xu, Toye Oloko, Yufang Hou, Nanyun Peng, Dakuo Wang |
| 2023 | ACL | Do Models Really Learn to Follow Instructions? An Empirical Study of Instruction Tuning. | Po-Nien Kung, Nanyun Peng |
| 2023 | ACL | DICE: Data-Efficient Clinical Event Extraction with Generative Models. | Mingyu Derek Ma, Alexander Taylor, Wei Wang, Nanyun Peng |
| 2023 | ACL | GENEVA: Benchmarking Generalizability for Event Argument Extraction with Hundreds of Event Types and Argument Roles. | Tanmay Parekh, I-Hung Hsu, Kuan-Hao Huang, Kai-Wei Chang, Nanyun Peng |
| 2023 | ACL | Unsupervised Melody-to-Lyrics Generation. | Yufei Tian, Anjali Narayan-Chen, Shereen Oraby, Alessandra Cervone, Gunnar A. Sigurdsson, Chenyang Tao, Wenbo Zhao, Tagyoung Chung, Jing Huang, Nanyun Peng |
| 2023 | ACL | SIMMC-VR: A Task-oriented Multimodal Dialog Dataset with Situated and Immersive VR Streams. | Te-Lin Wu, Satwik Kottur, Andrea Madotto, Mahmoud Azab, Pedro Rodrguez, Babak Damavandi, Nanyun Peng, Seungwhan Moon |
| 2023 | ACL | Learning Action Conditions from Instructional Manuals for Instruction Understanding. | Te-Lin Wu, Caiqi Zhang, Qingyuan Hu, Alexander Spangher, Nanyun Peng |
| 2023 | ACL | DOC: Improving Long Story Coherence With Detailed Outline Control. | Kevin Yang, Dan Klein, Nanyun Peng, Yuandong Tian |
| 2023 | CVPR | Generalized Decoding for Pixel, Image, and Language. | Xueyan Zou, Zi-Yi Dou, Jianwei Yang, Zhe Gan, Linjie Li, Chunyuan Li, Xiyang Dai, Harkirat Behl, Jianfeng Wang, Lu Yuan, Nanyun Peng, Lijuan Wang, Yong Jae Lee, Jianfeng Gao |
| 2023 | EMNLP | Creative Natural Language Generation. | Tuhin Chakrabarty, Vishakh Padmakumar, He He, Nanyun Peng |
| 2023 | EMNLP | Masked Path Modeling for Vision-and-Language Navigation. | Zi-Yi Dou, Feng Gao, Nanyun Peng |
| 2023 | EMNLP | Active Instruction Tuning: Improving Cross-Task Generalization by Training on Prompt Sensitive Tasks. | Po-Nien Kung, Fan Yin, Di Wu, Kai-Wei Chang, Nanyun Peng |
| 2023 | EMNLP | Gender Biases in Automatic Evaluation Metrics for Image Captioning. | Haoyi Qiu, Zi-Yi Dou, Tianlu Wang, Asli Celikyilmaz, Nanyun Peng |
| 2023 | EMNLP | Identifying Informational Sources in News Articles. | Alexander Spangher, Nanyun Peng, Emilio Ferrara, Jonathan May |
| 2023 | EMNLP | Evaluating Large Language Models on Controlled Generation Tasks. | Jiao Sun, Yufei Tian, Wangchunshu Zhou, Nan Xu, Qian Hu, Rahul Gupta, John Frederick Wieting, Nanyun Peng, Xuezhe Ma |
| 2023 | EMNLP | Harnessing Black-Box Control to Boost Commonsense in LM's Generation. | Yufei Tian, Felix Zhang, Nanyun Peng |
| 2023 | EMNLP | "Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters. | Yixin Wan, George Pu, Jiao Sun, Aparna Garimella, Kai-Wei Chang, Nanyun Peng |
| 2023 | EMNLP | Are Personalized Stochastic Parrots More Dangerous? Evaluating Persona Biases in Dialogue Systems. | Yixin Wan, Jieyu Zhao, Aman Chadha, Nanyun Peng, Kai-Wei Chang |
| 2023 | EMNLP | ACQUIRED: A Dataset for Answering Counterfactual Questions In Real-Life Videos. | Te-Lin Wu, Zi-Yi Dou, Qingyuan Hu, Yu Hou, Nischal Reddy Chandra, Marjorie Freedman, Ralph M. Weischedel, Nanyun Peng |
| 2023 | EMNLP | Localizing Active Objects from Egocentric Vision with Symbolic World Knowledge. | Te-Lin Wu, Yu Zhou, Nanyun Peng |
| 2023 | ICML | Tractable Control for Autoregressive Language Generation. | Honghua Zhang, Meihua Dang, Nanyun Peng, Guy Van den Broeck |
| 2023 | Interspeech | Parameter-Efficient Low-Resource Dialogue State Tracking by Prompt Tuning. | Mingyu Derek Ma, Jiun-Yu Kao, Shuyang Gao, Arpit Gupta, Di Jin, Tagyoung Chung, Nanyun Peng |
| 2023 | KDD | The Second Workshop on Knowledge-Augmented Methods for Natural Language Processing. | Wenhao Yu, Lingbo Tong, Weijia Shi, Nanyun Peng, Meng Jiang |
| 2023 | WWW | Detecting Social Media Manipulation in Low-Resource Languages. | Samar Haider, Luca Luceri, Ashok Deb, Adam Badawy, Nanyun Peng, Emilio Ferrara |
| 2023 | SIGdial | MERCY: Multiple Response Ranking Concurrently in Realistic Open-Domain Conversational Systems. | Sarik Ghazarian, Behnam Hedayatnia, Di Jin, Sijia Liu, Nanyun Peng, Yang Liu, Dilek Hakkani-Tur |
| 2023 | SIGdial | Investigating the Representation of Open Domain Dialogue Context for Transformer Models. | Vishakh Padmakumar, Behnam Hedayatnia, Di Jin, Patrick Lange, Seokhwan Kim, Nanyun Peng, Yang Liu, Dilek Hakkani-Tur |
| 2022 | AAAI | Zero-Shot Commonsense Question Answering with Cloze Translation and Consistency Optimization. | Zi-Yi Dou, Nanyun Peng |
| 2022 | ACL | On the Safety of Conversational Models: Taxonomy, Dataset, and Benchmark. | Hao Sun, Guangxuan Xu, Jiawen Deng, Jiale Cheng, Chujie Zheng, Hao Zhou, Nanyun Peng, Xiaoyan Zhu, Minlie Huang |
| 2022 | ACL | DEAM: Dialogue Coherence Evaluation using AMR-based Semantic Manipulations. | Sarik Ghazarian, Nuan Wen, Aram Galstyan, Nanyun Peng |
| 2022 | ACL | Sibylvariant Transformations for Robust Text Classification. | Fabrice Harel-Canada, Muhammad Ali Gulzar, Nanyun Peng, Miryung Kim |
| 2022 | ACL | Multilingual Generative Language Models for Zero-Shot Cross-Lingual Event Argument Extraction. | Kuan-Hao Huang, I-Hung Hsu, Prem Natarajan, Kai-Wei Chang, Nanyun Peng |
| 2022 | ACL | Understanding Multimodal Procedural Knowledge by Sequencing Multimodal Instructional Manuals. | Te-Lin Wu, Alexander Spangher, Pegah Alipoormolabashi, Marjorie Freedman, Ralph M. Weischedel, Nanyun Peng |
| 2022 | ACL | Fantastic Questions and Where to Find Them: FairytaleQA - An Authentic Dataset for Narrative Comprehension. | Ying Xu, Dakuo Wang, Mo Yu, Daniel Ritchie, Bingsheng Yao, Tongshuang Wu, Zheng Zhang, Toby Jia-Jun Li, Nora Bradford, Branda Sun, Tran Bao Hoang, Yisi Sang, Yufang Hou, Xiaojuan Ma, Diyi Yang, Nanyun Peng, Zhou Yu, Mark Warschauer |
| 2022 | COLING | Paraphrase Generation as Unsupervised Machine Translation. | Xiaofei Sun, Yufei Tian, Yuxian Meng, Nanyun Peng, Fei Wu, Jiwei Li, Chun Fan |
| 2022 | CVPR | An Empirical Study of Training End-to-End Vision-and-Language Transformers. | Zi-Yi Dou, Yichong Xu, Zhe Gan, Jianfeng Wang, Shuohang Wang, Lijuan Wang, Chenguang Zhu, Pengchuan Zhang, Lu Yuan, Nanyun Peng, Zicheng Liu, Michael Zeng |
| 2022 | EMNLP | Towards Robust NLG Bias Evaluation with Syntactically-diverse Prompts. | Arshiya Aggarwal, Jiao Sun, Nanyun Peng |
| 2022 | EMNLP | Character-centric Story Visualization via Visual Planning and Token Alignment. | Hong Chen, Rujun Han, Te-Lin Wu, Hideki Nakayama, Nanyun Peng |
| 2022 | EMNLP | Sequentially Controlled Text Generation. | Alexander Spangher, Yao Ming, Xinyu Hua, Nanyun Peng |
| 2022 | EMNLP | ExPUNations: Augmenting Puns with Keywords and Explanations. | Jiao Sun, Anjali Narayan-Chen, Shereen Oraby, Alessandra Cervone, Tagyoung Chung, Jing Huang, Yang Liu, Nanyun Peng |
| 2022 | EMNLP | Context-Situated Pun Generation. | Jiao Sun, Anjali Narayan-Chen, Shereen Oraby, Shuyang Gao, Tagyoung Chung, Jing Huang, Yang Liu, Nanyun Peng |
| 2022 | EMNLP | A Unified Framework for Pun Generation with Humor Principles. | Yufei Tian, Divyanshu Sheth, Nanyun Peng |
| 2022 | EMNLP | EnDex: Evaluation of Dialogue Engagingness at Scale. | Guangxuan Xu, Ruibo Liu, Fabrice Harel-Canada, Nischal Reddy Chandra, Nanyun Peng |
| 2022 | EMNLP | Re3: Generating Longer Stories With Recursive Reprompting and Revision. | Kevin Yang, Yuandong Tian, Nanyun Peng, Dan Klein |
| 2022 | IJCNLP | On Measures of Biases and Harms in NLP. | Sunipa Dev, Emily Sheng, Jieyu Zhao, Aubrie Amstutz, Jiao Sun, Yu Hou, Mattie Sanseverino, Jiin Kim, Akihiro Nishi, Nanyun Peng, Kai-Wei Chang |
| 2022 | NAACL | FOAM: A Follower-aware Speaker Model For Vision-and-Language Navigation. | Zi-Yi Dou, Nanyun Peng |
| 2022 | NAACL | Go Back in Time: Generating Flashbacks in Stories with Event Temporal Prompts. | Rujun Han, Hong Chen, Yufei Tian, Nanyun Peng |
| 2022 | NAACL | DEGREE: A Data-Efficient Generation-Based Event Extraction Model. | I-Hung Hsu, Kuan-Hao Huang, Elizabeth Boschee, Scott Miller, Prem Natarajan, Kai-Wei Chang, Nanyun Peng |
| 2022 | NAACL | Socially Aware Bias Measurements for Hindi Language Representations. | Vijit Malik, Sunipa Dev, Akihiro Nishi, Nanyun Peng, Kai-Wei Chang |
| 2022 | NAACL | AmbiPun: Generating Humorous Puns with Ambiguous Context. | Anirudh Mittal, Yufei Tian, Nanyun Peng |
| 2022 | NAACL | NewsEdits: A News Article Revision Dataset and a Novel Document-Level Reasoning Challenge. | Alexander Spangher, Xiang Ren, Jonathan May, Nanyun Peng |
| 2022 | NAACL | Zero-shot Sonnet Generation with Discourse-level Planning and Aesthetics Features. | Yufei Tian, Nanyun Peng |
| 2021 | AAAI | GATE: Graph Attention Transformer Encoder for Cross-lingual Relation and Event Extraction. | Wasi Uddin Ahmad, Nanyun Peng, Kai-Wei Chang |
| 2021 | AAAI | A Paragraph-level Multi-task Learning Model for Scientific Fact-Verification. | Xiangci Li, Gully A. Burns, Nanyun Peng |
| 2021 | AAAI | MELINDA: A Multimodal Dataset for Biomedical Experiment Method Classification. | Te-Lin Wu, Shikhar Singh, Sayan Paul, Gully A. Burns, Nanyun Peng |
| 2021 | ACL | Societal Biases in Language Generation: Progress and Challenges. | Emily Sheng, Kai-Wei Chang, Prem Natarajan, Nanyun Peng |
| 2021 | ACL | COM2SENSE: A Commonsense Reasoning Benchmark with Complementary Sentences. | Shikhar Singh, Nuan Wen, Yu Hou, Pegah Alipoormolabashi, Te-Lin Wu, Xuezhe Ma, Nanyun Peng |
| 2021 | ACL | Metaphor Generation with Conceptual Mappings. | Kevin Stowe, Tuhin Chakrabarty, Nanyun Peng, Smaranda Muresan, Iryna Gurevych |
| 2021 | ACL | Men Are Elected, Women Are Married: Events Gender Bias on Wikipedia. | Jiao Sun, Nanyun Peng |
| 2021 | EACL | Scientific Discourse Tagging for Evidence Extraction. | Xiangci Li, Gully A. Burns, Nanyun Peng |
| 2021 | EMNLP | Improving Pre-trained Vision-and-Language Embeddings for Phrase Grounding. | Zi-Yi Dou, Nanyun Peng |
| 2021 | EMNLP | ECONET: Effective Continual Pretraining of Language Models for Event Temporal Reasoning. | Rujun Han, Xiang Ren, Nanyun Peng |
| 2021 | EMNLP | ESTER: A Machine Reading Comprehension Dataset for Reasoning about Event Semantic Relations. | Rujun Han, I-Hung Hsu, Jiao Sun, Julia Baylon, Qiang Ning, Dan Roth, Nanyun Peng |
| 2021 | EMNLP | Improving Zero-Shot Cross-Lingual Transfer Learning via Robust Training. | Kuan-Hao Huang, Wasi Uddin Ahmad, Nanyun Peng, Kai-Wei Chang |
| 2021 | EMNLP | Document-level Entity-based Extraction as Template Generation. | Kung-Hsiang Huang, Sam Tang, Nanyun Peng |
| 2021 | EMNLP | HyperExpan: Taxonomy Expansion with Hyperbolic Representation Learning. | Mingyu Derek Ma, Muhao Chen, Te-Lin Wu, Nanyun Peng |
| 2021 | EMNLP | AESOP: Paraphrase Generation with Adaptive Syntactic Control. | Jiao Sun, Xuezhe Ma, Nanyun Peng |
| 2021 | EMNLP | HypoGen: Hyperbole Generation with Commonsense and Counterfactual Knowledge. | Yufei Tian, Arvind Krishna Sridhar, Nanyun Peng |
| 2021 | EMNLP | Broaden the Vision: Geo-Diverse Visual Commonsense Reasoning. | Da Yin, Liunian Harold Li, Ziniu Hu, Nanyun Peng, Kai-Wei Chang |
| 2021 | NAACL | MERMAID: Metaphor Generation with Symbolism and Discriminative Decoding. | Tuhin Chakrabarty, Xurui Zhang, Smaranda Muresan, Nanyun Peng |
| 2021 | NAACL | DiSCoL: Toward Engaging Dialogue Systems through Conversational Line Guided Response Generation. | Sarik Ghazarian, Zixi Liu, Tuhin Chakrabarty, Xuezhe Ma, Aram Galstyan, Nanyun Peng |
| 2021 | NAACL | Plot-guided Adversarial Example Construction for Evaluating Open-domain Story Generation. | Sarik Ghazarian, Zixi Liu, Akash SM, Ralph M. Weischedel, Aram Galstyan, Nanyun Peng |
| 2021 | NAACL | EventPlus: A Temporal Event Understanding Pipeline. | Mingyu Derek Ma, Jiao Sun, Mu Yang, Kung-Hsiang Huang, Nuan Wen, Shikhar Singh, Rujun Han, Nanyun Peng |
| 2021 | NAACL | "Nice Try, Kiddo": Investigating Ad Hominems in Dialogue Responses. | Emily Sheng, Kai-Wei Chang, Prem Natarajan, Nanyun Peng |
| 2020 | AAAI | Predictive Engagement: An Efficient Metric for Automatic Evaluation of Open-Domain Dialogue Systems. | Sarik Ghazarian, Ralph M. Weischedel, Aram Galstyan, Nanyun Peng |
| 2020 | ACL | R^3: Reverse, Retrieve, and Rank for Sarcasm Generation with Commonsense Knowledge. | Tuhin Chakrabarty, Debanjan Ghosh, Smaranda Muresan, Nanyun Peng |
| 2020 | EMNLP | STORIUM: A Dataset and Evaluation Platform for Machine-in-the-Loop Story Generation. | Nader Akoury, Shufan Wang, Josh Whiting, Stephen Hood, Nanyun Peng, Mohit Iyyer |
| 2020 | EMNLP | Generating similes effortlessly like a Pro: A Style Transfer Approach for Simile Generation. | Tuhin Chakrabarty, Smaranda Muresan, Nanyun Peng |
| 2020 | EMNLP | Content Planning for Neural Story Generation with Aristotelian Rescoring. | Seraphina Goldfarb-Tarrant, Tuhin Chakrabarty, Ralph M. Weischedel, Nanyun Peng |
| 2020 | EMNLP | Domain Knowledge Empowered Structured Neural Net for End-to-End Event Temporal Relation Extraction. | Rujun Han, Yichao Zhou, Nanyun Peng |
| 2020 | EMNLP | Biomedical Event Extraction on Graph Edge-conditioned Attention Networks with Hierarchical Knowledge Graphs. | Kung-Hsiang Huang, Mu Yang, Nanyun Peng |
| 2020 | EMNLP | TORQUE: A Reading Comprehension Dataset of Temporal Ordering Questions. | Qiang Ning, Hao Wu, Rujun Han, Nanyun Peng, Matt Gardner, Dan Roth |
| 2020 | EMNLP | Towards Controllable Biases in Language Generation. | Emily Sheng, Kai-Wei Chang, Prem Natarajan, Nanyun Peng |
| 2020 | EMNLP | Connecting the Dots: A Knowledgeable Path Generator for Commonsense Question Answering. | Peifeng Wang, Nanyun Peng, Filip Ilievski, Pedro A. Szekely, Xiang Ren |
| 2019 | AAAI | Plan-and-Write: Towards Better Automatic Storytelling. | Lili Yao, Nanyun Peng, Ralph M. Weischedel, Kevin Knight, Dongyan Zhao, Rui Yan |
| 2019 | ASRU | Espresso: A Fast End-to-End Neural Speech Recognition Toolkit. | Yiming Wang, Sanjeev Khudanpur, Tongfei Chen, Hainan Xu, Shuoyang Ding, Hang Lv, Yiwen Shao, Nanyun Peng, Lei Xie, Shinji Watanabe |
| 2019 | CoNLL | Cross-Lingual Dependency Parsing with Unlabeled Auxiliary Languages. | Wasi Uddin Ahmad, Zhisong Zhang, Xuezhe Ma, Kai-Wei Chang, Nanyun Peng |
| 2019 | CoNLL | Deep Structured Neural Network for Event Temporal Relation Extraction. | Rujun Han, I-Hung Hsu, Mu Yang, Aram Galstyan, Ralph M. Weischedel, Nanyun Peng |
| 2019 | CoNLL | Learning a Unified Named Entity Tagger from Multiple Partially Annotated Corpora for Efficient Adaptation. | Xiao Huang, Li Dong, Elizabeth Boschee, Nanyun Peng |
| 2019 | EMNLP | Joint Event and Temporal Relation Extraction with Shared Representations and Structured Prediction. | Rujun Han, Qiang Ning, Nanyun Peng |
| 2019 | EMNLP | What Matters for Neural Cross-Lingual Named Entity Recognition: An Empirical Analysis. | Xiaolei Huang, Jonathan May, Nanyun Peng |
| 2019 | EMNLP | Target Language-Aware Constrained Inference for Cross-lingual Dependency Parsing. | Tao Meng, Nanyun Peng, Kai-Wei Chang |
| 2019 | EMNLP | Do Nuclear Submarines Have Nuclear Captains? A Challenge Dataset for Commonsense Reasoning over Adjectives and Objects. | James Mullenbach, Jonathan Gordon, Nanyun Peng, Jonathan May |
| 2019 | EMNLP | The Woman Worked as a Babysitter: On Biases in Language Generation. | Emily Sheng, Kai-Wei Chang, Premkumar Natarajan, Nanyun Peng |
| 2019 | NAACL | On Difficulties of Cross-Lingual Transfer with Order Differences: A Case Study on Dependency Parsing. | Wasi Uddin Ahmad, Zhisong Zhang, Xuezhe Ma, Eduard H. Hovy, Kai-Wei Chang, Nanyun Peng |
| 2019 | NAACL | Plan, Write, and Revise: an Interactive System for Open-Domain Story Generation. | Seraphina Goldfarb-Tarrant, Haining Feng, Nanyun Peng |
| 2019 | NAACL | Pun Generation with Surprise. | He He, Nanyun Peng, Percy Liang |
| 2018 | AAAI | Style Transfer in Text: Exploration and Evaluation. | Zhenxin Fu, Xiaoye Tan, Nanyun Peng, Dongyan Zhao, Rui Yan |
| 2018 | ACL | Stack-Pointer Networks for Dependency Parsing. | Xuezhe Ma, Zecong Hu, Jingzhou Liu, Nanyun Peng, Graham Neubig, Eduard H. Hovy |
| 2018 | IJCAI | Learning to Converse with Noisy Data: Generation with Calibration. | Mingyue Shang, Zhenxin Fu, Nanyun Peng, Yansong Feng, Dongyan Zhao, Rui Yan |
| 2018 | NAACL | Scalable Construction and Reasoning of Massive Knowledge Bases. | Xiang Ren, Nanyun Peng, William Yang Wang |
| 2017 | IJCNLP | A Multi-task Learning Approach to Adapting Bilingual Word Embeddings for Cross-lingual Named Entity Recognition. | Dingquan Wang, Nanyun Peng, Kevin Duh |
| 2016 | ACL | Improving Named Entity Recognition for Chinese Social Media with Word Segmentation Representation Learning. | Nanyun Peng, Mark Dredze |
| 2015 | ACL | An Empirical Study of Chinese Name Matching and Applications. | Nanyun Peng, Mo Yu, Mark Dredze |
| 2015 | EMNLP | Dual Decomposition Inference for Graphical Models over Strings. | Nanyun Peng, Ryan Cotterell, Jason Eisner |
| 2015 | EMNLP | Named Entity Recognition for Chinese Social Media with Jointly Trained Embeddings. | Nanyun Peng, Mark Dredze |
| 2015 | NAACL | A Concrete Chinese NLP Pipeline. | Nanyun Peng, Francis Ferraro, Mo Yu, Nicholas Andrews, Jay DeYoung, Max Thomas, Matthew R. Gormley, Travis Wolfe, Craig Harman, Benjamin Van Durme, Mark Dredze |
| 2014 | ACL | Stochastic Contextual Edit Distance and Probabilistic FSTs. | Ryan Cotterell, Nanyun Peng, Jason Eisner |
| 2014 | ACL | Learning Polylingual Topic Models from Code-Switched Social Media Documents. | Nanyun Peng, Yiming Wang, Mark Dredze |
| 2012 | ACL | Exploiting Latent Information to Predict Diffusions of Novel Topics on Social Networks. | Tsung-Ting Kuo, San-Chuan Hung, Wei-Shih Lin, Nanyun Peng, Shou-De Lin, Wei-Fen Lin |
| 2012 | ACL | Online Plagiarized Detection Through Exploiting Lexical, Syntax, and Semantic Information. | Wan-Yu Lin, Nanyun Peng, Chun-Chao Yen, Shou-de Lin |