Tongshuang Wu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
53
Venues
10
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
53 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | RECAP: An End-to-End Platform for Capturing, Replaying, and Analyzing AI-Assisted Programming Interactions. | Keyu He, Qianou Ma, Valerie Chen, Wayne Chi, Tongshuang Wu |
| 2026 | ACL | Scaling Collaborative Effort with Agents. | Shannon Zejiang Shen, Valerie Chen, Ken Gu, Alexis Ross, Zixian Ma, Jillian Ross, Alex Gu, Chenglei Si, Wayne Chi, Andi Peng, Jocelyn J. Shen, Ameet Talwalkar, Tongshuang Wu, David A. Sontag |
| 2026 | ACL | What Prompts Don't Say: Understanding and Managing Underspecification in LLM Prompts. | Chenyang Yang, Yike Shi, Qianou Ma, Michael Xieyang Liu, Christian Kstner, Tongshuang Wu |
| 2026 | AIED | Practice Less, Explain More: LLM-Supported Self-Explanation Improves Explanation Quality on Transfer Problems in Calculus. | Eason Chen, Xinyi Tang, Yvonne Zhao, Meiyi Chen, Meryam Elmir, Elizabeth A. McLaughlin, Mingyu Yuan, Yumo Wang, Shyam Agarwal, Jared Cochrane, Jionghao Lin, Tongshuang Wu, Ken Koedinger |
| 2026 | AIED | "GenAI Defaults to Bias!" Gamify AI Literacy Through Reflections on Prompts. | Qianou Ma, Megan Chai, Yike Tan, Jihun Choi, Jini Kim, Erik Harpstead, Geoff Kauffman, Tongshuang Wu |
| 2026 | CHI | Evidotes: Integrating Scientific Evidence and Anecdotes to Support Uncertainties Triggered by Peer Health Posts. | Shreya Bali, Riku Arakawa, Peace Odiase, Tongshuang Wu, Mayank Goel |
| 2026 | CHI | Behavioral Indicators of Overreliance During Interaction with Conversational Language Models. | Chang Liu, Qinyi Zhou, Xinjie Shen, Xingyu Bruce Liu, Tongshuang Wu, Xiang 'Anthony' Chen |
| 2026 | CHI | Not Everyone Wins with LLMs: Behavioral Patterns and Pedagogical Implications for AI Literacy in Programmatic Data Science. | Qianou Ma, Kenneth R. Koedinger, Tongshuang Wu |
| 2026 | CHI | From Human-Human Collaboration to Human-Agent Collaboration: A Vision, Design Philosophy, and an Empirical Framework for Achieving Successful Partnerships Between Humans and LLM Agents. | Bingsheng Yao, Chaoran Chen, April Yi Wang, Tongshuang Wu, Toby Jia-Jun Li, Dakuo Wang |
| 2025 | AAAI | Evaluating Mathematical Reasoning Beyond Accuracy. | Shijie Xia, Xuefeng Li, Yixin Liu, Tongshuang Wu, Pengfei Liu |
| 2025 | ACL | SPHERE: An Evaluation Card for Human-AI Systems. | Dora Zhao, Qianou Ma, Xinran Zhao, Chenglei Si, Chenyang Yang, Ryan Louie, Ehud Reiter, Diyi Yang, Tongshuang Wu |
| 2025 | CHI | Human Subjects Research in the Age of Generative AI: Opportunities and Challenges of Applying LLM-Simulated Data to HCI Studies. | Angel Hsing-Chi Hwang, Michael S. Bernstein, S. Shyam Sundar, Renwen Zhang, Manoel Horta Ribeiro, Yingdan Lu, Serina Chang, Tongshuang Wu, Aimei Yang, Dmitri Williams, Joon Sung Park, Katherine Ognyanova, Ziang Xiao, Aaron Shaw, David A. Shamma |
| 2025 | CHI | Bidirectional Human-AI Alignment: Emerging Challenges and Opportunities. | Hua Shen, Tiffany Knearem, Reshmi Ghosh, Michael Xieyang Liu, Andrs Monroy-Hernndez, Tongshuang Wu, Diyi Yang, Yun Huang, Tanushree Mitra, Yang Li, Marti A. Hearst |
| 2025 | CHI | LLMs as Workers in Human-Computational Algorithms? Replicating Crowdsourcing Pipelines with LLMs. | Tongshuang Wu, Haiyi Zhu, Maya Albayrak, Alexis Axon, Amanda Bertsch, Wenxing Deng, Ziqi Ding, Boyuan Guo, Sireesh Gururaja, Tzu-Sheng Kuo, Jenny T. Liang, Ryan Liu, Ihita Mandal, Jeremiah Milbauer, Xiaolin Ni, Namrata Padmanabhan, Subhashini Ramkumar, Alexis Sudjianto, Jordan Taylor, Ying-Jui Tseng, Patricia Vaidos, Zhijin Wu, Wei Wu, Chenyang Yang |
| 2025 | EMNLP | MoR: Better Handling Diverse Queries with a Mixture of Sparse, Dense, and Human Retrievers. | Jushaan Singh Kalra, Xinran Zhao, To Eun Kim, Fengyu Cai, Fernando Diaz, Tongshuang Wu |
| 2025 | EMNLP | cAST: Enhancing Code Retrieval-Augmented Generation with Structural Chunking via Abstract Syntax Tree. | Yilin Zhang, Xinran Zhao, Zora Zhiruo Wang, Chenyang Yang, Jiayi Wei, Tongshuang Wu |
| 2025 | IJCAI | How to Teach Programming in the AI Era? Using LLMs as a Teachable Agent for Debugging (Extended Abstract). | Qianou Ma, Hua Shen, Ken Koedinger, Tongshuang Wu |
| 2025 | IUI | Orbit: A Framework for Designing and Evaluating Multi-objective Rankers. | Chenyang Yang, Tesi Xiao, Michael Shavlovsky, Christian Kstner, Tongshuang Wu |
| 2025 | NAACL | SOTOPIA-S4: a user-friendly system for flexible, customizable, and large-scale social simulation. | Xuhui Zhou, Zhe Su, Sophie Feng, Jiaxu Zhou, Jen-tse Huang, Hsien-Te Kao, Spencer Lynch, Svitlana Volkova, Tongshuang Wu, Anita Woolley, Hao Zhu, Maarten Sap |
| 2024 | ACL | Better Synthetic Data by Retrieving and Transforming Existing Datasets. | Saumya Gandhi, Ritu Gala, Vijay Viswanathan, Tongshuang Wu, Graham Neubig |
| 2024 | ACL | Fact-and-Reflection (FaR) Improves Confidence Calibration of Large Language Models. | Xinran Zhao, Hongming Zhang, Xiaoman Pan, Wenlin Yao, Dong Yu, Tongshuang Wu, Jianshu Chen |
| 2024 | CHI | Trust and Reliance in Evolving Human-AI Workflows (TREW). | Zahra Ashktorab, Gagan Bansal, Zana Buinca, Kenneth Holstein, Jessica Hullman, Alison Marie Smith-Renner, Tongshuang Wu, Wenjuan Zhang |
| 2024 | CHI | Wikibench: Community-Driven Data Curation for AI Evaluation on Wikipedia. | Tzu-Sheng Kuo, Aaron Lee Halfaker, Zirui Cheng, Jiwoo Kim, Meng-Hsin Wu, Tongshuang Wu, Kenneth Holstein, Haiyi Zhu |
| 2024 | CHI | Selenite: Scaffolding Online Sensemaking with Comprehensive Overviews Elicited from Large Language Models. | Michael Xieyang Liu, Tongshuang Wu, Tianying Chen, Franklin Mingzhe Li, Aniket Kittur, Brad A. Myers |
| 2024 | EMNLP | Synthetic Multimodal Question Generation. | Ian Wu, Sravan Jayanthi, Vijay Viswanathan, Simon Rosenberg, Sina Pakazad, Tongshuang Wu, Graham Neubig |
| 2024 | NAACL | Large Language Models Help Humans Verify Truthfulness - Except When They Are Convincingly Wrong. | Chenglei Si, Navita Goyal, Tongshuang Wu, Chen Zhao, Shi Feng, Hal Daum III, Jordan L. Boyd-Graber |
| 2023 | AAAI | Capabilities for Better ML Engineering. | Chenyang Yang, Rachel A. Brower-Sinning, Grace A. Lewis, Christian Kstner, Tongshuang Wu |
| 2023 | ACL | DataFinder: Scientific Dataset Recommendation from Natural Language Descriptions. | Vijay Viswanathan, Luyu Gao, Tongshuang Wu, Pengfei Liu, Graham Neubig |
| 2023 | CSCW | LLMs and the Infrastructure of CSCW. | Chinmay Kulkarni, Tongshuang Wu, Kenneth Holstein, Q. Vera Liao, Min Kyung Lee, Mina Lee, Hariharan Subramonyam |
| 2023 | CSCW | ConvXAI : Delivering Heterogeneous AI Explanations via Conversations to Support Human-AI Scientific Writing. | Hua Shen, Chieh-Yang Huang, Tongshuang Wu, Ting-Hao 'Kenneth' Huang |
| 2023 | EMNLP | Beyond Testers' Biases: Guiding Model Testing with Knowledge Bases using LLMs. | Chenyang Yang, Rishabh Rustogi, Rachel A. Brower-Sinning, Grace A. Lewis, Christian Kstner, Tongshuang Wu |
| 2023 | EMNLP | NewsSense: Reference-free Verification via Cross-document Comparison. | Jeremiah Milbauer, Ziqi Ding, Zhijin Wu, Tongshuang Wu |
| 2023 | EMNLP | Prompt2Model: Generating Deployable Models from Natural Language Instructions. | Vijay Viswanathan, Chenyang Zhao, Amanda Bertsch, Tongshuang Wu, Graham Neubig |
| 2023 | EMNLP | Designing, Evaluating, and Learning from Humans Interacting with NLP Models. | Tongshuang Wu, Diyi Yang, Sebastin Santy |
| 2023 | EMNLP | BiasX: "Thinking Slow" in Toxic Content Moderation with Explanations of Implied Social Biases. | Yiming Zhang, Sravani Nanduri, Liwei Jiang, Tongshuang Wu, Maarten Sap |
| 2023 | UIST | Synergi: A Mixed-Initiative System for Scholarly Synthesis and Sensemaking. | Hyeonsu B. Kang, Tongshuang Wu, Joseph Chee Chang, Aniket Kittur |
| 2022 | ACL | Tailor: Generating and Perturbing Text with Semantic Controls. | Alexis Ross, Tongshuang Wu, Hao Peng, Matthew E. Peters, Matt Gardner |
| 2022 | ACL | Are Shortest Rationales the Best Explanations for Human Understanding? | Hua Shen, Tongshuang Wu, Wenbo Guo, Ting-Hao 'Kenneth' Huang |
| 2022 | ACL | Fantastic Questions and Where to Find Them: FairytaleQA - An Authentic Dataset for Narrative Comprehension. | Ying Xu, Dakuo Wang, Mo Yu, Daniel Ritchie, Bingsheng Yao, Tongshuang Wu, Zheng Zhang, Toby Jia-Jun Li, Nora Bradford, Branda Sun, Tran Bao Hoang, Yisi Sang, Yufang Hou, Xiaojuan Ma, Diyi Yang, Nanyun Peng, Zhou Yu, Mark Warschauer |
| 2022 | ACL | It is AI's Turn to Ask Humans a Question: Question-Answer Pair Generation for Children's Story Books. | Bingsheng Yao, Dakuo Wang, Tongshuang Wu, Zheng Zhang, Toby Jia-Jun Li, Mo Yu, Ying Xu |
| 2022 | CHI | Workshop on Trust and Reliance in AI-Human Teams (TRAIT). | Gagan Bansal, Alison Marie Smith-Renner, Zana Buinca, Tongshuang Wu, Kenneth Holstein, Jessica Hullman, Simone Stumpf |
| 2022 | CHI | Pretty Princess vs. Successful Leader: Gender Roles in Greeting Card Messages. | Jiao Sun, Tongshuang Wu, Yue Jiang, Ronil Awalegaonkar, Xi Victoria Lin, Diyi Yang |
| 2022 | CHI | PromptChainer: Chaining Large Language Model Prompts through Visual Programming. | Tongshuang Wu, Ellen Jiang, Aaron Donsbach, Jeff Gray, Alejandra Molina, Michael Terry, Carrie J. Cai |
| 2022 | CHI | AI Chains: Transparent and Controllable Human-AI Interaction by Chaining Large Language Model Prompts. | Tongshuang Wu, Michael Terry, Carrie Jun Cai |
| 2022 | CHI | StoryBuddy: A Human-AI Collaborative Chatbot for Parent-Child Interactive Storytelling with Flexible Parental Involvement. | Zheng Zhang, Ying Xu, Yanhao Wang, Bingsheng Yao, Daniel Ritchie, Tongshuang Wu, Mo Yu, Dakuo Wang, Toby Jia-Jun Li |
| 2021 | ACL | Polyjuice: Generating Counterfactuals for Explaining, Evaluating, and Improving Models. | Tongshuang Wu, Marco Tlio Ribeiro, Jeffrey Heer, Daniel S. Weld |
| 2021 | CHI | Does the Whole Exceed its Parts? The Effect of AI Explanations on Complementary Team Performance. | Gagan Bansal, Tongshuang Wu, Joyce Zhou, Raymond Fok, Besmira Nushi, Ece Kamar, Marco Tlio Ribeiro, Daniel S. Weld |
| 2021 | CHI | Principles and Interactive Tools for Evaluating and Improving the Behavior of Natural Language Processing models. | Tongshuang Wu |
| 2021 | IJCAI | Beyond Accuracy: Behavioral Testing of NLP Models with Checklist (Extended Abstract). | Marco Tlio Ribeiro, Tongshuang Wu, Carlos Guestrin, Sameer Singh |
| 2020 | ACL | Beyond Accuracy: Behavioral Testing of NLP Models with CheckList. | Marco Tlio Ribeiro, Tongshuang Wu, Carlos Guestrin, Sameer Singh |
| 2020 | CHI | No Explainability without Accountability: An Empirical Study of Explanations and Feedback in Interactive ML. | Alison Smith-Renner, Ron Fan, Melissa Birchfield, Tongshuang Wu, Jordan L. Boyd-Graber, Daniel S. Weld, Leah Findlater |
| 2020 | CHI | Tempura: Query Analysis with Structural Templates. | Tongshuang Wu, Kanit Wongsuphasawat, Donghao Ren, Kayur Patel, Chris DuBois |
| 2019 | ACL | Errudite: Scalable, Reproducible, and Testable Error Analysis. | Tongshuang Wu, Marco Tlio Ribeiro, Jeffrey Heer, Daniel S. Weld |