Skip to content

Chien-Sheng Wu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

66

Venues

11

Active years

2016–2026

Best venue rank

A*

Where they publish

Papers

66 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLDon't Stop Early: Scalable Enterprise Deep Research with Controlled Information Flow and Evidence-Aware Termination.Prafulla Kumar Choubey, Kung-Hsiang Huang, Pranav Narayanan Venkit, Jiaxin Zhang, Vaibhav Vats, Yu Li, Xiangyu Peng, Chien-Sheng Wu
2026ACLGTA: Generating Long-horizon Tasks for Web Agents at Scale.Tenghao Huang, Kung-Hsiang Huang, Prafulla Kumar Choubey, Yilun Zhou, Muhao Chen, Jonathan May, Chien-Sheng Wu
2026ACLFrom Passive Metric to Active Signal: The Evolving Role of Uncertainty Quantification in Large Language Models.Jiaxin Zhang, Wendi Cui, Zhuohang Li, Lifu Huang, Bradley A. Malin, Caiming Xiong, Chien-Sheng Wu
2025ACLTurning Conversations into Workflows: A Framework to Extract and Evaluate Dialog Workflows for Service AI Agents.Prafulla Kumar Choubey, Xiangyu Peng, Shilpa Bhagavath, Caiming Xiong, Shiva Kumar Pentyala, Chien-Sheng Wu
2025ACLLAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback.Thai Quoc Hoang, Kung-Hsiang Huang, Shirley Kokane, Jianguo Zhang, Zuxin Liu, Ming Zhu, Jake Grigsby, Tian Lan, Michael S. Ryoo, Chien-Sheng Wu, Shelby Heinecke, Huan Wang, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles
2025ACLWhy Vision Language Models Struggle with Visual Arithmetic? Towards Enhanced Chart and Geometry Understanding.Kung-Hsiang Huang, Can Qin, Haoyi Qiu, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu
2025ACLUnanswerability Evaluation for Retrieval Augmented Generation.Xiangyu Peng, Prafulla Kumar Choubey, Caiming Xiong, Chien-Sheng Wu
2025CHICan AI writing be salvaged? Mitigating Idiosyncrasies and Improving Human-AI Alignment in the Writing Process through Edits.Tuhin Chakrabarty, Philippe Laban, Chien-Sheng Wu
2025CHIProactive Conversational Agents with Inner Thoughts.Xingyu Bruce Liu, Shitao Fang, Weiyan Shi, Chien-Sheng Wu, Takeo Igarashi, Xiang 'Anthony' Chen
2025EMNLPBenchmarking Deep Search over Heterogeneous Enterprise Data.Prafulla Kumar Choubey, Xiangyu Peng, Shilpa Bhagavath, Kung-Hsiang Huang, Caiming Xiong, Chien-Sheng Wu
2025ICLRReGenesis: LLMs can Grow into Reasoning Generalists via Self-Improvement.Xiangyu Peng, Congying Xia, Xinyi Yang, Caiming Xiong, Chien-Sheng Wu, Chen Xing
2025ICLRBingoGuard: LLM Content Moderation Tools with Risk Levels.Fan Yin, Philippe Laban, Xiangyu Peng, Yilun Zhou, Yixin Mao, Vaibhav Vats, Linnea Ross, Divyansh Agarwal, Caiming Xiong, Chien-Sheng Wu
2025ICLRSiReRAG: Indexing Similar and Related Information for Multihop Reasoning.Nan Zhang, Prafulla Kumar Choubey, Alexander R. Fabbri, Gabriel Bernadett-Shapiro, Rui Zhang, Prasenjit Mitra, Caiming Xiong, Chien-Sheng Wu
2025NAACLCRMArena: Understanding the Capacity of LLM Agents to Perform Professional CRM Tasks in Realistic Environments.Kung-Hsiang Huang, Akshara Prabhakar, Sidharth Dhawan, Yixin Mao, Huan Wang, Silvio Savarese, Caiming Xiong, Philippe Laban, Chien-Sheng Wu
2025NAACLReIFE: Re-evaluating Instruction-Following Evaluation.Yixin Liu, Kejian Shi, Alexander R. Fabbri, Yilun Zhao, Peifeng Wang, Chien-Sheng Wu, Shafiq Joty, Arman Cohan
2025NAACLEvaluating Cultural and Social Awareness of LLM Web Agents.Haoyi Qiu, Alexander R. Fabbri, Divyansh Agarwal, Kung-Hsiang Huang, Sarah Tan, Nanyun Peng, Chien-Sheng Wu
2025NAACLDo RAG Systems Cover What Matters? Evaluating and Optimizing Responses with Sub-Question Coverage.Kaige Xie, Philippe Laban, Prafulla Kumar Choubey, Caiming Xiong, Chien-Sheng Wu
2024CHIArt or Artifice? Large Language Models and the False Promise of Creativity.Tuhin Chakrabarty, Philippe Laban, Divyansh Agarwal, Smaranda Muresan, Chien-Sheng Wu
2024EMNLPPrompt Leakage effect and mitigation strategies for multi-turn LLM Applications.Divyansh Agarwal, Alexander R. Fabbri, Ben Risher, Philippe Laban, Shafiq Joty, Chien-Sheng Wu
2024EMNLPSummary of a Haystack: A Challenge to Long-Context LLMs and RAG Systems.Philippe Laban, Alexander R. Fabbri, Caiming Xiong, Chien-Sheng Wu
2024NAACLEmbrace Divergence for Richer Insights: A Multi-document Summarization Benchmark and a Case Study on Summarizing Diverse Information from News Articles.Kung-Hsiang Huang, Philippe Laban, Alexander R. Fabbri, Prafulla Kumar Choubey, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu
2024NAACLBenchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization.Yixin Liu, Alexander R. Fabbri, Jiawen Chen, Yilun Zhao, Simeng Han, Shafiq Joty, Pengfei Liu, Dragomir Radev, Chien-Sheng Wu, Arman Cohan
2024UISTBeyond the Chat: Executable and Verifiable Text-Editing with LLMs.Philippe Laban, Jesse Vig, Marti A. Hearst, Caiming Xiong, Chien-Sheng Wu
2023ACLCaPE: Contrastive Parameter Ensembling for Reducing Hallucination in Abstractive Summarization.Prafulla Kumar Choubey, Alexander R. Fabbri, Jesse Vig, Chien-Sheng Wu, Wenhao Liu, Nazneen Rajani
2023ACLSWiPE: A Dataset for Document-Level Simplification of Wikipedia Pages.Philippe Laban, Jesse Vig, Wojciech Kryscinski, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu
2023ACLRevisiting the Gold Standard: Grounding Summarization Evaluation with Robust Human Evaluation.Yixin Liu, Alexander R. Fabbri, Pengfei Liu, Yilun Zhao, Linyong Nan, Ruilin Han, Simeng Han, Shafiq Joty, Chien-Sheng Wu, Caiming Xiong, Dragomir Radev
2023ACLSocratic Pretraining: Question-Driven Pretraining for Controllable Summarization.Artidoro Pagnoni, Alexander R. Fabbri, Wojciech Kryscinski, Chien-Sheng Wu
2023ACLDid You Read the Instructions? Rethinking the Effectiveness of Task Definitions in Instruction Learning.Fan Yin, Jesse Vig, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu
2023CHIDesigning and Evaluating Interfaces that Highlight News Coverage Diversity Using Discord Questions.Philippe Laban, Chien-Sheng Wu, Lidiya Murakhovs'ka, Xiang 'Anthony' Chen, Caiming Xiong
2023EMNLPLexical Repetitions Lead to Rote Learning: Unveiling the Impact of Lexical Overlap in Train and Test Reference Summaries.Prafulla Kumar Choubey, Alexander R. Fabbri, Caiming Xiong, Chien-Sheng Wu
2023EMNLPSummEdits: Measuring LLM Ability at Factual Reasoning Through The Lens of Summarization.Philippe Laban, Wojciech Kryscinski, Divyansh Agarwal, Alexander R. Fabbri, Caiming Xiong, Shafiq Joty, Chien-Sheng Wu
2023EMNLPTowards Interpretable and Efficient Automatic Reference-Based Summarization Evaluation.Yixin Liu, Alexander R. Fabbri, Yilun Zhao, Pengfei Liu, Shafiq Joty, Chien-Sheng Wu, Caiming Xiong, Dragomir Radev
2023EMNLPSalespeople vs SalesBot: Exploring the Role of Educational Value in Conversational Recommender Systems.Lidiya Murakhovs'ka, Philippe Laban, Tian Xie, Caiming Xiong, Chien-Sheng Wu
2023EMNLPINTELMO: Enhancing Models' Adoption of Interactive Interfaces.Chunxu Yang, Chien-Sheng Wu, Lidiya Murakhovs'ka, Philippe Laban, Xiang Chen
2023ICLRModel ensemble instead of prompt fusion: a sample-specific knowledge transfer method for few-shot prompt tuning.Xiangyu Peng, Chen Xing, Prafulla Kumar Choubey, Chien-Sheng Wu, Caiming Xiong
2022ACLDialFact: A Benchmark for Fact-Checking in Dialogue.Prakhar Gupta, Chien-Sheng Wu, Wenhao Liu, Caiming Xiong
2022ACLQAConv: Question Answering on Informative Conversations.Chien-Sheng Wu, Andrea Madotto, Wenhao Liu, Pascale Fung, Caiming Xiong
2022EMNLPConformal Predictor for Improving Zero-Shot Text Classification Efficiency.Prafulla Kumar Choubey, Yu Bai, Chien-Sheng Wu, Wenhao Liu, Nazneen Rajani
2022EMNLPImproving Factual Consistency in Summarization with Compression-Based Post-Editing.Alexander R. Fabbri, Prafulla Kumar Choubey, Jesse Vig, Chien-Sheng Wu, Caiming Xiong
2022EMNLPNear-Negative Distinction: Giving a Second Life to Human Evaluation Datasets.Philippe Laban, Chien-Sheng Wu, Wenhao Liu, Caiming Xiong
2022EMNLPDiscord Questions: A Computational Approach To Diversity Analysis in News Coverage.Philippe Laban, Chien-Sheng Wu, Lidiya Murakhovs'ka, Xiang 'Anthony' Chen, Caiming Xiong
2022EMNLPUnifiedSKG: Unifying and Multi-Tasking Structured Knowledge Grounding with Text-to-Text Language Models.Tianbao Xie, Chen Henry Wu, Peng Shi, Ruiqi Zhong, Torsten Scholak, Michihiro Yasunaga, Chien-Sheng Wu, Ming Zhong, Pengcheng Yin, Sida I. Wang, Victor Zhong, Bailin Wang, Chengzu Li, Connor Boyle, Ansong Ni, Ziyu Yao, Dragomir Radev, Caiming Xiong, Lingpeng Kong, Rui Zhang, Noah A. Smith, Luke Zettlemoyer, Tao Yu
2022NAACLQAFactEval: Improved QA-Based Factual Consistency Evaluation for Summarization.Alexander R. Fabbri, Chien-Sheng Wu, Wenhao Liu, Caiming Xiong
2022NAACLQuiz Design Task: Helping Teachers Create Quizzes with Automated Question Generation.Philippe Laban, Chien-Sheng Wu, Lidiya Murakhovs'ka, Wenhao Liu, Caiming Xiong
2022NAACLMixQG: Neural Question Generation with Mixed Answer Types.Lidiya Murakhovs'ka, Chien-Sheng Wu, Philippe Laban, Tong Niu, Wenhao Liu, Caiming Xiong
2022NAACLExploring Neural Models for Query-Focused Summarization.Jesse Vig, Alexander R. Fabbri, Wojciech Kryscinski, Chien-Sheng Wu, Wenhao Liu
2021ACLControllable Abstractive Dialogue Summarization with Sketch Supervision.Chien-Sheng Wu, Linqing Liu, Wenhao Liu, Pontus Stenetorp, Caiming Xiong
2021ICLRGraPPa: Grammar-Augmented Pre-Training for Table Semantic Parsing.Tao Yu, Chien-Sheng Wu, Xi Victoria Lin, Bailin Wang, Yi Chern Tan, Xinyi Yang, Dragomir R. Radev, Richard Socher, Caiming Xiong
2020ACLExplicit Memory Tracker with Coarse-to-Fine Reasoning for Conversational Machine Reading.Yifan Gao, Chien-Sheng Wu, Shafiq R. Joty, Caiming Xiong, Richard Socher, Irwin King, Michael R. Lyu, Steven C. H. Hoi
2020EMNLPDiscern: Discourse-Aware Entailment Reasoning Network for Conversational Machine Reading.Yifan Gao, Chien-Sheng Wu, Jingjing Li, Shafiq R. Joty, Steven C. H. Hoi, Caiming Xiong, Irwin King, Michael R. Lyu
2020EMNLPTOD-BERT: Pre-trained Natural Language Understanding for Task-Oriented Dialogue.Chien-Sheng Wu, Steven C. H. Hoi, Richard Socher, Caiming Xiong
2020EMNLPImproving Limited Labeled Dialogue State Tracking with Self-Supervision.Chien-Sheng Wu, Steven C. H. Hoi, Caiming Xiong
2020EMNLPProbing Task-Oriented Dialogue Representation from Language Models.Chien-Sheng Wu, Caiming Xiong
2020EMNLPDiscriminative Nearest Neighbor Few-Shot Intent Detection by Transferring Natural Language Inference.Jian-Guo Zhang, Kazuma Hashimoto, Wenhao Liu, Chien-Sheng Wu, Yao Wan, Philip S. Yu, Richard Socher, Caiming Xiong
2020LRECGetting To Know You: User Attribute Extraction from Dialogues.Chien-Sheng Wu, Andrea Madotto, Zhaojiang Lin, Peng Xu, Pascale Fung
2019ACLPersonalizing Dialogue Agents via Meta-Learning.Andrea Madotto, Zhaojiang Lin, Chien-Sheng Wu, Pascale Fung
2019ACLTransferable Multi-Domain State Generator for Task-Oriented Dialogue Systems.Chien-Sheng Wu, Andrea Madotto, Ehsan Hosseini-Asl, Caiming Xiong, Richard Socher, Pascale Fung
2019CoNLLCode-Switched Language Models Using Neural Based Synthetic Data from Parallel Sentences.Genta Indra Winata, Andrea Madotto, Chien-Sheng Wu, Pascale Fung
2019EMNLPClickbait? Sensational Headline Generation with Auto-tuned Reinforcement Learning.Peng Xu, Chien-Sheng Wu, Andrea Madotto, Pascale Fung
2019ICLRGlobal-to-local Memory Pointer Networks for Task-Oriented Dialogue.Chien-Sheng Wu, Richard Socher, Caiming Xiong
2018ACLMem2Seq: Effectively Incorporating Knowledge Bases into End-to-End Task-Oriented Dialog Systems.Andrea Madotto, Chien-Sheng Wu, Pascale Fung
2018EMNLPImproving Large-Scale Fact-Checking using Decomposable Attention Models and Lexical Tagging.Nayeon Lee, Chien-Sheng Wu, Pascale Fung
2018ICASSPEnd-to-End Dynamic Query Memory Network for Entity-Value Independent Task-Oriented Dialog.Chien-Sheng Wu, Andrea Madotto, Genta Indra Winata, Pascale Fung
2016CICLINGTowards Empathetic Human-Robot Interactions.Pascale Fung, Dario Bertero, Yan Wan, Anik Dey, Ricky Ho Yin Chan, Farhad Bin Siddique, Yang Yang, Chien-Sheng Wu, Ruixi Lin
2016COLINGZara: A Virtual Interactive Dialogue System Incorporating Emotion, Sentiment and Personality Recognition.Pascale Fung, Anik Dey, Farhad Bin Siddique, Ruixi Lin, Yang Yang, Dario Bertero, Yan Wan, Ricky Ho Yin Chan, Chien-Sheng Wu
2016EMNLPReal-Time Speech Emotion and Sentiment Recognition for Interactive Dialogue Systems.Dario Bertero, Farhad Bin Siddique, Chien-Sheng Wu, Yan Wan, Ricky Ho Yin Chan, Pascale Fung