Chien-Sheng Wu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
66
Venues
11
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
66 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Don't Stop Early: Scalable Enterprise Deep Research with Controlled Information Flow and Evidence-Aware Termination. | Prafulla Kumar Choubey, Kung-Hsiang Huang, Pranav Narayanan Venkit, Jiaxin Zhang, Vaibhav Vats, Yu Li, Xiangyu Peng, Chien-Sheng Wu |
| 2026 | ACL | GTA: Generating Long-horizon Tasks for Web Agents at Scale. | Tenghao Huang, Kung-Hsiang Huang, Prafulla Kumar Choubey, Yilun Zhou, Muhao Chen, Jonathan May, Chien-Sheng Wu |
| 2026 | ACL | From Passive Metric to Active Signal: The Evolving Role of Uncertainty Quantification in Large Language Models. | Jiaxin Zhang, Wendi Cui, Zhuohang Li, Lifu Huang, Bradley A. Malin, Caiming Xiong, Chien-Sheng Wu |
| 2025 | ACL | Turning Conversations into Workflows: A Framework to Extract and Evaluate Dialog Workflows for Service AI Agents. | Prafulla Kumar Choubey, Xiangyu Peng, Shilpa Bhagavath, Caiming Xiong, Shiva Kumar Pentyala, Chien-Sheng Wu |
| 2025 | ACL | LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback. | Thai Quoc Hoang, Kung-Hsiang Huang, Shirley Kokane, Jianguo Zhang, Zuxin Liu, Ming Zhu, Jake Grigsby, Tian Lan, Michael S. Ryoo, Chien-Sheng Wu, Shelby Heinecke, Huan Wang, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles |
| 2025 | ACL | Why Vision Language Models Struggle with Visual Arithmetic? Towards Enhanced Chart and Geometry Understanding. | Kung-Hsiang Huang, Can Qin, Haoyi Qiu, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2025 | ACL | Unanswerability Evaluation for Retrieval Augmented Generation. | Xiangyu Peng, Prafulla Kumar Choubey, Caiming Xiong, Chien-Sheng Wu |
| 2025 | CHI | Can AI writing be salvaged? Mitigating Idiosyncrasies and Improving Human-AI Alignment in the Writing Process through Edits. | Tuhin Chakrabarty, Philippe Laban, Chien-Sheng Wu |
| 2025 | CHI | Proactive Conversational Agents with Inner Thoughts. | Xingyu Bruce Liu, Shitao Fang, Weiyan Shi, Chien-Sheng Wu, Takeo Igarashi, Xiang 'Anthony' Chen |
| 2025 | EMNLP | Benchmarking Deep Search over Heterogeneous Enterprise Data. | Prafulla Kumar Choubey, Xiangyu Peng, Shilpa Bhagavath, Kung-Hsiang Huang, Caiming Xiong, Chien-Sheng Wu |
| 2025 | ICLR | ReGenesis: LLMs can Grow into Reasoning Generalists via Self-Improvement. | Xiangyu Peng, Congying Xia, Xinyi Yang, Caiming Xiong, Chien-Sheng Wu, Chen Xing |
| 2025 | ICLR | BingoGuard: LLM Content Moderation Tools with Risk Levels. | Fan Yin, Philippe Laban, Xiangyu Peng, Yilun Zhou, Yixin Mao, Vaibhav Vats, Linnea Ross, Divyansh Agarwal, Caiming Xiong, Chien-Sheng Wu |
| 2025 | ICLR | SiReRAG: Indexing Similar and Related Information for Multihop Reasoning. | Nan Zhang, Prafulla Kumar Choubey, Alexander R. Fabbri, Gabriel Bernadett-Shapiro, Rui Zhang, Prasenjit Mitra, Caiming Xiong, Chien-Sheng Wu |
| 2025 | NAACL | CRMArena: Understanding the Capacity of LLM Agents to Perform Professional CRM Tasks in Realistic Environments. | Kung-Hsiang Huang, Akshara Prabhakar, Sidharth Dhawan, Yixin Mao, Huan Wang, Silvio Savarese, Caiming Xiong, Philippe Laban, Chien-Sheng Wu |
| 2025 | NAACL | ReIFE: Re-evaluating Instruction-Following Evaluation. | Yixin Liu, Kejian Shi, Alexander R. Fabbri, Yilun Zhao, Peifeng Wang, Chien-Sheng Wu, Shafiq Joty, Arman Cohan |
| 2025 | NAACL | Evaluating Cultural and Social Awareness of LLM Web Agents. | Haoyi Qiu, Alexander R. Fabbri, Divyansh Agarwal, Kung-Hsiang Huang, Sarah Tan, Nanyun Peng, Chien-Sheng Wu |
| 2025 | NAACL | Do RAG Systems Cover What Matters? Evaluating and Optimizing Responses with Sub-Question Coverage. | Kaige Xie, Philippe Laban, Prafulla Kumar Choubey, Caiming Xiong, Chien-Sheng Wu |
| 2024 | CHI | Art or Artifice? Large Language Models and the False Promise of Creativity. | Tuhin Chakrabarty, Philippe Laban, Divyansh Agarwal, Smaranda Muresan, Chien-Sheng Wu |
| 2024 | EMNLP | Prompt Leakage effect and mitigation strategies for multi-turn LLM Applications. | Divyansh Agarwal, Alexander R. Fabbri, Ben Risher, Philippe Laban, Shafiq Joty, Chien-Sheng Wu |
| 2024 | EMNLP | Summary of a Haystack: A Challenge to Long-Context LLMs and RAG Systems. | Philippe Laban, Alexander R. Fabbri, Caiming Xiong, Chien-Sheng Wu |
| 2024 | NAACL | Embrace Divergence for Richer Insights: A Multi-document Summarization Benchmark and a Case Study on Summarizing Diverse Information from News Articles. | Kung-Hsiang Huang, Philippe Laban, Alexander R. Fabbri, Prafulla Kumar Choubey, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2024 | NAACL | Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization. | Yixin Liu, Alexander R. Fabbri, Jiawen Chen, Yilun Zhao, Simeng Han, Shafiq Joty, Pengfei Liu, Dragomir Radev, Chien-Sheng Wu, Arman Cohan |
| 2024 | UIST | Beyond the Chat: Executable and Verifiable Text-Editing with LLMs. | Philippe Laban, Jesse Vig, Marti A. Hearst, Caiming Xiong, Chien-Sheng Wu |
| 2023 | ACL | CaPE: Contrastive Parameter Ensembling for Reducing Hallucination in Abstractive Summarization. | Prafulla Kumar Choubey, Alexander R. Fabbri, Jesse Vig, Chien-Sheng Wu, Wenhao Liu, Nazneen Rajani |
| 2023 | ACL | SWiPE: A Dataset for Document-Level Simplification of Wikipedia Pages. | Philippe Laban, Jesse Vig, Wojciech Kryscinski, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2023 | ACL | Revisiting the Gold Standard: Grounding Summarization Evaluation with Robust Human Evaluation. | Yixin Liu, Alexander R. Fabbri, Pengfei Liu, Yilun Zhao, Linyong Nan, Ruilin Han, Simeng Han, Shafiq Joty, Chien-Sheng Wu, Caiming Xiong, Dragomir Radev |
| 2023 | ACL | Socratic Pretraining: Question-Driven Pretraining for Controllable Summarization. | Artidoro Pagnoni, Alexander R. Fabbri, Wojciech Kryscinski, Chien-Sheng Wu |
| 2023 | ACL | Did You Read the Instructions? Rethinking the Effectiveness of Task Definitions in Instruction Learning. | Fan Yin, Jesse Vig, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2023 | CHI | Designing and Evaluating Interfaces that Highlight News Coverage Diversity Using Discord Questions. | Philippe Laban, Chien-Sheng Wu, Lidiya Murakhovs'ka, Xiang 'Anthony' Chen, Caiming Xiong |
| 2023 | EMNLP | Lexical Repetitions Lead to Rote Learning: Unveiling the Impact of Lexical Overlap in Train and Test Reference Summaries. | Prafulla Kumar Choubey, Alexander R. Fabbri, Caiming Xiong, Chien-Sheng Wu |
| 2023 | EMNLP | SummEdits: Measuring LLM Ability at Factual Reasoning Through The Lens of Summarization. | Philippe Laban, Wojciech Kryscinski, Divyansh Agarwal, Alexander R. Fabbri, Caiming Xiong, Shafiq Joty, Chien-Sheng Wu |
| 2023 | EMNLP | Towards Interpretable and Efficient Automatic Reference-Based Summarization Evaluation. | Yixin Liu, Alexander R. Fabbri, Yilun Zhao, Pengfei Liu, Shafiq Joty, Chien-Sheng Wu, Caiming Xiong, Dragomir Radev |
| 2023 | EMNLP | Salespeople vs SalesBot: Exploring the Role of Educational Value in Conversational Recommender Systems. | Lidiya Murakhovs'ka, Philippe Laban, Tian Xie, Caiming Xiong, Chien-Sheng Wu |
| 2023 | EMNLP | INTELMO: Enhancing Models' Adoption of Interactive Interfaces. | Chunxu Yang, Chien-Sheng Wu, Lidiya Murakhovs'ka, Philippe Laban, Xiang Chen |
| 2023 | ICLR | Model ensemble instead of prompt fusion: a sample-specific knowledge transfer method for few-shot prompt tuning. | Xiangyu Peng, Chen Xing, Prafulla Kumar Choubey, Chien-Sheng Wu, Caiming Xiong |
| 2022 | ACL | DialFact: A Benchmark for Fact-Checking in Dialogue. | Prakhar Gupta, Chien-Sheng Wu, Wenhao Liu, Caiming Xiong |
| 2022 | ACL | QAConv: Question Answering on Informative Conversations. | Chien-Sheng Wu, Andrea Madotto, Wenhao Liu, Pascale Fung, Caiming Xiong |
| 2022 | EMNLP | Conformal Predictor for Improving Zero-Shot Text Classification Efficiency. | Prafulla Kumar Choubey, Yu Bai, Chien-Sheng Wu, Wenhao Liu, Nazneen Rajani |
| 2022 | EMNLP | Improving Factual Consistency in Summarization with Compression-Based Post-Editing. | Alexander R. Fabbri, Prafulla Kumar Choubey, Jesse Vig, Chien-Sheng Wu, Caiming Xiong |
| 2022 | EMNLP | Near-Negative Distinction: Giving a Second Life to Human Evaluation Datasets. | Philippe Laban, Chien-Sheng Wu, Wenhao Liu, Caiming Xiong |
| 2022 | EMNLP | Discord Questions: A Computational Approach To Diversity Analysis in News Coverage. | Philippe Laban, Chien-Sheng Wu, Lidiya Murakhovs'ka, Xiang 'Anthony' Chen, Caiming Xiong |
| 2022 | EMNLP | UnifiedSKG: Unifying and Multi-Tasking Structured Knowledge Grounding with Text-to-Text Language Models. | Tianbao Xie, Chen Henry Wu, Peng Shi, Ruiqi Zhong, Torsten Scholak, Michihiro Yasunaga, Chien-Sheng Wu, Ming Zhong, Pengcheng Yin, Sida I. Wang, Victor Zhong, Bailin Wang, Chengzu Li, Connor Boyle, Ansong Ni, Ziyu Yao, Dragomir Radev, Caiming Xiong, Lingpeng Kong, Rui Zhang, Noah A. Smith, Luke Zettlemoyer, Tao Yu |
| 2022 | NAACL | QAFactEval: Improved QA-Based Factual Consistency Evaluation for Summarization. | Alexander R. Fabbri, Chien-Sheng Wu, Wenhao Liu, Caiming Xiong |
| 2022 | NAACL | Quiz Design Task: Helping Teachers Create Quizzes with Automated Question Generation. | Philippe Laban, Chien-Sheng Wu, Lidiya Murakhovs'ka, Wenhao Liu, Caiming Xiong |
| 2022 | NAACL | MixQG: Neural Question Generation with Mixed Answer Types. | Lidiya Murakhovs'ka, Chien-Sheng Wu, Philippe Laban, Tong Niu, Wenhao Liu, Caiming Xiong |
| 2022 | NAACL | Exploring Neural Models for Query-Focused Summarization. | Jesse Vig, Alexander R. Fabbri, Wojciech Kryscinski, Chien-Sheng Wu, Wenhao Liu |
| 2021 | ACL | Controllable Abstractive Dialogue Summarization with Sketch Supervision. | Chien-Sheng Wu, Linqing Liu, Wenhao Liu, Pontus Stenetorp, Caiming Xiong |
| 2021 | ICLR | GraPPa: Grammar-Augmented Pre-Training for Table Semantic Parsing. | Tao Yu, Chien-Sheng Wu, Xi Victoria Lin, Bailin Wang, Yi Chern Tan, Xinyi Yang, Dragomir R. Radev, Richard Socher, Caiming Xiong |
| 2020 | ACL | Explicit Memory Tracker with Coarse-to-Fine Reasoning for Conversational Machine Reading. | Yifan Gao, Chien-Sheng Wu, Shafiq R. Joty, Caiming Xiong, Richard Socher, Irwin King, Michael R. Lyu, Steven C. H. Hoi |
| 2020 | EMNLP | Discern: Discourse-Aware Entailment Reasoning Network for Conversational Machine Reading. | Yifan Gao, Chien-Sheng Wu, Jingjing Li, Shafiq R. Joty, Steven C. H. Hoi, Caiming Xiong, Irwin King, Michael R. Lyu |
| 2020 | EMNLP | TOD-BERT: Pre-trained Natural Language Understanding for Task-Oriented Dialogue. | Chien-Sheng Wu, Steven C. H. Hoi, Richard Socher, Caiming Xiong |
| 2020 | EMNLP | Improving Limited Labeled Dialogue State Tracking with Self-Supervision. | Chien-Sheng Wu, Steven C. H. Hoi, Caiming Xiong |
| 2020 | EMNLP | Probing Task-Oriented Dialogue Representation from Language Models. | Chien-Sheng Wu, Caiming Xiong |
| 2020 | EMNLP | Discriminative Nearest Neighbor Few-Shot Intent Detection by Transferring Natural Language Inference. | Jian-Guo Zhang, Kazuma Hashimoto, Wenhao Liu, Chien-Sheng Wu, Yao Wan, Philip S. Yu, Richard Socher, Caiming Xiong |
| 2020 | LREC | Getting To Know You: User Attribute Extraction from Dialogues. | Chien-Sheng Wu, Andrea Madotto, Zhaojiang Lin, Peng Xu, Pascale Fung |
| 2019 | ACL | Personalizing Dialogue Agents via Meta-Learning. | Andrea Madotto, Zhaojiang Lin, Chien-Sheng Wu, Pascale Fung |
| 2019 | ACL | Transferable Multi-Domain State Generator for Task-Oriented Dialogue Systems. | Chien-Sheng Wu, Andrea Madotto, Ehsan Hosseini-Asl, Caiming Xiong, Richard Socher, Pascale Fung |
| 2019 | CoNLL | Code-Switched Language Models Using Neural Based Synthetic Data from Parallel Sentences. | Genta Indra Winata, Andrea Madotto, Chien-Sheng Wu, Pascale Fung |
| 2019 | EMNLP | Clickbait? Sensational Headline Generation with Auto-tuned Reinforcement Learning. | Peng Xu, Chien-Sheng Wu, Andrea Madotto, Pascale Fung |
| 2019 | ICLR | Global-to-local Memory Pointer Networks for Task-Oriented Dialogue. | Chien-Sheng Wu, Richard Socher, Caiming Xiong |
| 2018 | ACL | Mem2Seq: Effectively Incorporating Knowledge Bases into End-to-End Task-Oriented Dialog Systems. | Andrea Madotto, Chien-Sheng Wu, Pascale Fung |
| 2018 | EMNLP | Improving Large-Scale Fact-Checking using Decomposable Attention Models and Lexical Tagging. | Nayeon Lee, Chien-Sheng Wu, Pascale Fung |
| 2018 | ICASSP | End-to-End Dynamic Query Memory Network for Entity-Value Independent Task-Oriented Dialog. | Chien-Sheng Wu, Andrea Madotto, Genta Indra Winata, Pascale Fung |
| 2016 | CICLING | Towards Empathetic Human-Robot Interactions. | Pascale Fung, Dario Bertero, Yan Wan, Anik Dey, Ricky Ho Yin Chan, Farhad Bin Siddique, Yang Yang, Chien-Sheng Wu, Ruixi Lin |
| 2016 | COLING | Zara: A Virtual Interactive Dialogue System Incorporating Emotion, Sentiment and Personality Recognition. | Pascale Fung, Anik Dey, Farhad Bin Siddique, Ruixi Lin, Yang Yang, Dario Bertero, Yan Wan, Ricky Ho Yin Chan, Chien-Sheng Wu |
| 2016 | EMNLP | Real-Time Speech Emotion and Sentiment Recognition for Interactive Dialogue Systems. | Dario Bertero, Farhad Bin Siddique, Chien-Sheng Wu, Yan Wan, Ricky Ho Yin Chan, Pascale Fung |