Skip to content

Tongshuang Wu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

53

Venues

10

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

53 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLRECAP: An End-to-End Platform for Capturing, Replaying, and Analyzing AI-Assisted Programming Interactions.Keyu He, Qianou Ma, Valerie Chen, Wayne Chi, Tongshuang Wu
2026ACLScaling Collaborative Effort with Agents.Shannon Zejiang Shen, Valerie Chen, Ken Gu, Alexis Ross, Zixian Ma, Jillian Ross, Alex Gu, Chenglei Si, Wayne Chi, Andi Peng, Jocelyn J. Shen, Ameet Talwalkar, Tongshuang Wu, David A. Sontag
2026ACLWhat Prompts Don't Say: Understanding and Managing Underspecification in LLM Prompts.Chenyang Yang, Yike Shi, Qianou Ma, Michael Xieyang Liu, Christian Kstner, Tongshuang Wu
2026AIEDPractice Less, Explain More: LLM-Supported Self-Explanation Improves Explanation Quality on Transfer Problems in Calculus.Eason Chen, Xinyi Tang, Yvonne Zhao, Meiyi Chen, Meryam Elmir, Elizabeth A. McLaughlin, Mingyu Yuan, Yumo Wang, Shyam Agarwal, Jared Cochrane, Jionghao Lin, Tongshuang Wu, Ken Koedinger
2026AIED"GenAI Defaults to Bias!" Gamify AI Literacy Through Reflections on Prompts.Qianou Ma, Megan Chai, Yike Tan, Jihun Choi, Jini Kim, Erik Harpstead, Geoff Kauffman, Tongshuang Wu
2026CHIEvidotes: Integrating Scientific Evidence and Anecdotes to Support Uncertainties Triggered by Peer Health Posts.Shreya Bali, Riku Arakawa, Peace Odiase, Tongshuang Wu, Mayank Goel
2026CHIBehavioral Indicators of Overreliance During Interaction with Conversational Language Models.Chang Liu, Qinyi Zhou, Xinjie Shen, Xingyu Bruce Liu, Tongshuang Wu, Xiang 'Anthony' Chen
2026CHINot Everyone Wins with LLMs: Behavioral Patterns and Pedagogical Implications for AI Literacy in Programmatic Data Science.Qianou Ma, Kenneth R. Koedinger, Tongshuang Wu
2026CHIFrom Human-Human Collaboration to Human-Agent Collaboration: A Vision, Design Philosophy, and an Empirical Framework for Achieving Successful Partnerships Between Humans and LLM Agents.Bingsheng Yao, Chaoran Chen, April Yi Wang, Tongshuang Wu, Toby Jia-Jun Li, Dakuo Wang
2025AAAIEvaluating Mathematical Reasoning Beyond Accuracy.Shijie Xia, Xuefeng Li, Yixin Liu, Tongshuang Wu, Pengfei Liu
2025ACLSPHERE: An Evaluation Card for Human-AI Systems.Dora Zhao, Qianou Ma, Xinran Zhao, Chenglei Si, Chenyang Yang, Ryan Louie, Ehud Reiter, Diyi Yang, Tongshuang Wu
2025CHIHuman Subjects Research in the Age of Generative AI: Opportunities and Challenges of Applying LLM-Simulated Data to HCI Studies.Angel Hsing-Chi Hwang, Michael S. Bernstein, S. Shyam Sundar, Renwen Zhang, Manoel Horta Ribeiro, Yingdan Lu, Serina Chang, Tongshuang Wu, Aimei Yang, Dmitri Williams, Joon Sung Park, Katherine Ognyanova, Ziang Xiao, Aaron Shaw, David A. Shamma
2025CHIBidirectional Human-AI Alignment: Emerging Challenges and Opportunities.Hua Shen, Tiffany Knearem, Reshmi Ghosh, Michael Xieyang Liu, Andrs Monroy-Hernndez, Tongshuang Wu, Diyi Yang, Yun Huang, Tanushree Mitra, Yang Li, Marti A. Hearst
2025CHILLMs as Workers in Human-Computational Algorithms? Replicating Crowdsourcing Pipelines with LLMs.Tongshuang Wu, Haiyi Zhu, Maya Albayrak, Alexis Axon, Amanda Bertsch, Wenxing Deng, Ziqi Ding, Boyuan Guo, Sireesh Gururaja, Tzu-Sheng Kuo, Jenny T. Liang, Ryan Liu, Ihita Mandal, Jeremiah Milbauer, Xiaolin Ni, Namrata Padmanabhan, Subhashini Ramkumar, Alexis Sudjianto, Jordan Taylor, Ying-Jui Tseng, Patricia Vaidos, Zhijin Wu, Wei Wu, Chenyang Yang
2025EMNLPMoR: Better Handling Diverse Queries with a Mixture of Sparse, Dense, and Human Retrievers.Jushaan Singh Kalra, Xinran Zhao, To Eun Kim, Fengyu Cai, Fernando Diaz, Tongshuang Wu
2025EMNLPcAST: Enhancing Code Retrieval-Augmented Generation with Structural Chunking via Abstract Syntax Tree.Yilin Zhang, Xinran Zhao, Zora Zhiruo Wang, Chenyang Yang, Jiayi Wei, Tongshuang Wu
2025IJCAIHow to Teach Programming in the AI Era? Using LLMs as a Teachable Agent for Debugging (Extended Abstract).Qianou Ma, Hua Shen, Ken Koedinger, Tongshuang Wu
2025IUIOrbit: A Framework for Designing and Evaluating Multi-objective Rankers.Chenyang Yang, Tesi Xiao, Michael Shavlovsky, Christian Kstner, Tongshuang Wu
2025NAACLSOTOPIA-S4: a user-friendly system for flexible, customizable, and large-scale social simulation.Xuhui Zhou, Zhe Su, Sophie Feng, Jiaxu Zhou, Jen-tse Huang, Hsien-Te Kao, Spencer Lynch, Svitlana Volkova, Tongshuang Wu, Anita Woolley, Hao Zhu, Maarten Sap
2024ACLBetter Synthetic Data by Retrieving and Transforming Existing Datasets.Saumya Gandhi, Ritu Gala, Vijay Viswanathan, Tongshuang Wu, Graham Neubig
2024ACLFact-and-Reflection (FaR) Improves Confidence Calibration of Large Language Models.Xinran Zhao, Hongming Zhang, Xiaoman Pan, Wenlin Yao, Dong Yu, Tongshuang Wu, Jianshu Chen
2024CHITrust and Reliance in Evolving Human-AI Workflows (TREW).Zahra Ashktorab, Gagan Bansal, Zana Buinca, Kenneth Holstein, Jessica Hullman, Alison Marie Smith-Renner, Tongshuang Wu, Wenjuan Zhang
2024CHIWikibench: Community-Driven Data Curation for AI Evaluation on Wikipedia.Tzu-Sheng Kuo, Aaron Lee Halfaker, Zirui Cheng, Jiwoo Kim, Meng-Hsin Wu, Tongshuang Wu, Kenneth Holstein, Haiyi Zhu
2024CHISelenite: Scaffolding Online Sensemaking with Comprehensive Overviews Elicited from Large Language Models.Michael Xieyang Liu, Tongshuang Wu, Tianying Chen, Franklin Mingzhe Li, Aniket Kittur, Brad A. Myers
2024EMNLPSynthetic Multimodal Question Generation.Ian Wu, Sravan Jayanthi, Vijay Viswanathan, Simon Rosenberg, Sina Pakazad, Tongshuang Wu, Graham Neubig
2024NAACLLarge Language Models Help Humans Verify Truthfulness - Except When They Are Convincingly Wrong.Chenglei Si, Navita Goyal, Tongshuang Wu, Chen Zhao, Shi Feng, Hal Daum III, Jordan L. Boyd-Graber
2023AAAICapabilities for Better ML Engineering.Chenyang Yang, Rachel A. Brower-Sinning, Grace A. Lewis, Christian Kstner, Tongshuang Wu
2023ACLDataFinder: Scientific Dataset Recommendation from Natural Language Descriptions.Vijay Viswanathan, Luyu Gao, Tongshuang Wu, Pengfei Liu, Graham Neubig
2023CSCWLLMs and the Infrastructure of CSCW.Chinmay Kulkarni, Tongshuang Wu, Kenneth Holstein, Q. Vera Liao, Min Kyung Lee, Mina Lee, Hariharan Subramonyam
2023CSCWConvXAI : Delivering Heterogeneous AI Explanations via Conversations to Support Human-AI Scientific Writing.Hua Shen, Chieh-Yang Huang, Tongshuang Wu, Ting-Hao 'Kenneth' Huang
2023EMNLPBeyond Testers' Biases: Guiding Model Testing with Knowledge Bases using LLMs.Chenyang Yang, Rishabh Rustogi, Rachel A. Brower-Sinning, Grace A. Lewis, Christian Kstner, Tongshuang Wu
2023EMNLPNewsSense: Reference-free Verification via Cross-document Comparison.Jeremiah Milbauer, Ziqi Ding, Zhijin Wu, Tongshuang Wu
2023EMNLPPrompt2Model: Generating Deployable Models from Natural Language Instructions.Vijay Viswanathan, Chenyang Zhao, Amanda Bertsch, Tongshuang Wu, Graham Neubig
2023EMNLPDesigning, Evaluating, and Learning from Humans Interacting with NLP Models.Tongshuang Wu, Diyi Yang, Sebastin Santy
2023EMNLPBiasX: "Thinking Slow" in Toxic Content Moderation with Explanations of Implied Social Biases.Yiming Zhang, Sravani Nanduri, Liwei Jiang, Tongshuang Wu, Maarten Sap
2023UISTSynergi: A Mixed-Initiative System for Scholarly Synthesis and Sensemaking.Hyeonsu B. Kang, Tongshuang Wu, Joseph Chee Chang, Aniket Kittur
2022ACLTailor: Generating and Perturbing Text with Semantic Controls.Alexis Ross, Tongshuang Wu, Hao Peng, Matthew E. Peters, Matt Gardner
2022ACLAre Shortest Rationales the Best Explanations for Human Understanding?Hua Shen, Tongshuang Wu, Wenbo Guo, Ting-Hao 'Kenneth' Huang
2022ACLFantastic Questions and Where to Find Them: FairytaleQA - An Authentic Dataset for Narrative Comprehension.Ying Xu, Dakuo Wang, Mo Yu, Daniel Ritchie, Bingsheng Yao, Tongshuang Wu, Zheng Zhang, Toby Jia-Jun Li, Nora Bradford, Branda Sun, Tran Bao Hoang, Yisi Sang, Yufang Hou, Xiaojuan Ma, Diyi Yang, Nanyun Peng, Zhou Yu, Mark Warschauer
2022ACLIt is AI's Turn to Ask Humans a Question: Question-Answer Pair Generation for Children's Story Books.Bingsheng Yao, Dakuo Wang, Tongshuang Wu, Zheng Zhang, Toby Jia-Jun Li, Mo Yu, Ying Xu
2022CHIWorkshop on Trust and Reliance in AI-Human Teams (TRAIT).Gagan Bansal, Alison Marie Smith-Renner, Zana Buinca, Tongshuang Wu, Kenneth Holstein, Jessica Hullman, Simone Stumpf
2022CHIPretty Princess vs. Successful Leader: Gender Roles in Greeting Card Messages.Jiao Sun, Tongshuang Wu, Yue Jiang, Ronil Awalegaonkar, Xi Victoria Lin, Diyi Yang
2022CHIPromptChainer: Chaining Large Language Model Prompts through Visual Programming.Tongshuang Wu, Ellen Jiang, Aaron Donsbach, Jeff Gray, Alejandra Molina, Michael Terry, Carrie J. Cai
2022CHIAI Chains: Transparent and Controllable Human-AI Interaction by Chaining Large Language Model Prompts.Tongshuang Wu, Michael Terry, Carrie Jun Cai
2022CHIStoryBuddy: A Human-AI Collaborative Chatbot for Parent-Child Interactive Storytelling with Flexible Parental Involvement.Zheng Zhang, Ying Xu, Yanhao Wang, Bingsheng Yao, Daniel Ritchie, Tongshuang Wu, Mo Yu, Dakuo Wang, Toby Jia-Jun Li
2021ACLPolyjuice: Generating Counterfactuals for Explaining, Evaluating, and Improving Models.Tongshuang Wu, Marco Tlio Ribeiro, Jeffrey Heer, Daniel S. Weld
2021CHIDoes the Whole Exceed its Parts? The Effect of AI Explanations on Complementary Team Performance.Gagan Bansal, Tongshuang Wu, Joyce Zhou, Raymond Fok, Besmira Nushi, Ece Kamar, Marco Tlio Ribeiro, Daniel S. Weld
2021CHIPrinciples and Interactive Tools for Evaluating and Improving the Behavior of Natural Language Processing models.Tongshuang Wu
2021IJCAIBeyond Accuracy: Behavioral Testing of NLP Models with Checklist (Extended Abstract).Marco Tlio Ribeiro, Tongshuang Wu, Carlos Guestrin, Sameer Singh
2020ACLBeyond Accuracy: Behavioral Testing of NLP Models with CheckList.Marco Tlio Ribeiro, Tongshuang Wu, Carlos Guestrin, Sameer Singh
2020CHINo Explainability without Accountability: An Empirical Study of Explanations and Feedback in Interactive ML.Alison Smith-Renner, Ron Fan, Melissa Birchfield, Tongshuang Wu, Jordan L. Boyd-Graber, Daniel S. Weld, Leah Findlater
2020CHITempura: Query Analysis with Structural Templates.Tongshuang Wu, Kanit Wongsuphasawat, Donghao Ren, Kayur Patel, Chris DuBois
2019ACLErrudite: Scalable, Reproducible, and Testable Error Analysis.Tongshuang Wu, Marco Tlio Ribeiro, Jeffrey Heer, Daniel S. Weld