| 2026 | ACL | Why Do LLM-based Web Agents Fail? A Hierarchical Planning Perspective. | Mohamed Aghzal, Gregory J. Stein, Ziyu Yao |
| 2026 | CHI | Designing AI Peers for Collaborative Mathematical Problem Solving with Middle School Students: A Participatory Design Study. | Wenhan Lyu, Yimeng Wang, Murong Yue, Yifan Sun, Jennifer Suh, Meredith Kier, Ziyu Yao, Yixuan Zhang |
| 2025 | ACL | Instruction-Tuning LLMs for Event Extraction with Annotation Guidelines. | Saurabh Srivastava, Sweta Pati, Ziyu Yao |
| 2025 | ACL | Efficient but Vulnerable: Benchmarking and Defending LLM Batch Prompting Attack. | Murong Yue, Ziyu Yao |
| 2025 | CVPR | CountLLM: Towards Generalizable Repetitive Action Counting via Large Language Model. | Ziyu Yao, Xuxin Cheng, Zhiqi Huang, Lei Li |
| 2025 | CVPR | Evaluating Vision-Language Models as Evaluators in Path Planning. | Mohamed Aghzal, Xiang Yue, Erion Plaku, Ziyu Yao |
| 2025 | EMNLP | Feature Extraction and Steering for Enhanced Chain-of-Thought Reasoning in Language Models. | Zihao Li, Xu Wang, Yuzhe Yang, Ziyu Yao, Haoyi Xiong, Mengnan Du |
| 2025 | EMNLP | All for One: LLMs Solve Mental Math at the Last Token With Information Transferred From Other Tokens. | Siddarth Mamidanna, Daking Rai, Ziyu Yao, Yilun Zhou |
| 2025 | EMNLP | What's Not Said Still Hurts: A Description-Based Evaluation Framework for Measuring Social Bias in LLMs. | Jinhao Pan, Chahat Raj, Ziyu Yao, Ziwei Zhu |
| 2025 | EMNLP | A Survey on Sparse Autoencoders: Interpreting the Internal Mechanisms of Large Language Models. | Dong Shu, Xuansheng Wu, Haiyan Zhao, Daking Rai, Ziyu Yao, Ninghao Liu, Mengnan Du |
| 2025 | ICDM | Evaluating the Effectiveness of Persona Simulation in Opinion Prediction with GPT-4.1. | Sarah Li, Ziyu Yao |
| 2025 | ICLR | DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search. | Murong Yue, Wenlin Yao, Haitao Mi, Dian Yu, Ziyu Yao, Dong Yu |
| 2025 | IROS | AutoSpatial: Visual-Language Reasoning for Social Robot Navigation through Efficient Spatial Reasoning Learning. | Yangzhe Kong, Daeun Song, Jing Liang, Dinesh Manocha, Ziyu Yao, Xuesu Xiao |
| 2024 | ACL | Soul-Mix: Enhancing Multimodal Machine Translation with Manifold Mixup. | Xuxin Cheng, Ziyu Yao, Yifei Xin, Hao An, Hongxiang Li, Yaowei Li, Yuexian Zou |
| 2024 | ACL | An Investigation of Neuron Activation as a Unified Lens to Explain Chain-of-Thought Eliciting Arithmetic Reasoning of LLMs. | Daking Rai, Ziyu Yao |
| 2024 | ACL | Instances Need More Care: Rewriting Prompts for Instances with LLMs in the Loop Yields Better Zero-Shot Performance. | Saurabh Srivastava, Chengyue Huang, Weiguo Fan, Ziyu Yao |
| 2024 | BMVC | Recovering Global Data Distribution Locally in Federated Learning. | Ziyu Yao |
| 2024 | EMNLP | Navigating the Shortcut Maze: A Comprehensive Analysis of Shortcut Learning in Text Classification by Language Models. | Yuqing Zhou, Ruixiang Tang, Ziyu Yao, Ziwei Zhu |
| 2024 | ICLR | Large Language Model Cascades with Mixture of Thought Representations for Cost-Efficient Reasoning. | Murong Yue, Jie Zhao, Min Zhang, Liang Du, Ziyu Yao |
| 2024 | ICONIP | PoseRAC: Enhancing Repetitive Action Counting with Salient Poses. | Ziyu Yao, Yuexian Zou |
| 2023 | AAAI | Explaining Large Language Model-Based Neural Semantic Parsers (Student Abstract). | Daking Rai, Yilun Zhou, Bailin Wang, Ziyu Yao |
| 2023 | ACL | Improving Generalization in Language Model-based Text-to-SQL Semantic Parsing: Two Simple Semantic Boundary-based Techniques. | Daking Rai, Bailin Wang, Yilun Zhou, Ziyu Yao |
| 2023 | ACL | Learning to Simulate Natural Language Feedback for Interactive Semantic Parsing. | Hao Yan, Saurabh Srivastava, Yintao Tai, Sida I. Wang, Wen-tau Yih, Ziyu Yao |
| 2023 | EMNLP | MailEx: Email Event and Argument Extraction. | Saurabh Srivastava, Gaurav Singh, Shou Matsumoto, Ali K. Raz, Paulo C. G. Costa, Joshua Poore, Ziyu Yao |
| 2023 | EMNLP | Gentopia.AI: A Collaborative Platform for Tool-Augmented LLMs. | Binfeng Xu, Xukun Liu, Hua Shen, Zeyu Han, Yuhan Li, Murong Yue, Zhiyuan Peng, Yuchen Liu, Ziyu Yao, Dongkuan Xu |
| 2023 | Interspeech | C²A-SLU: Cross and Contrastive Attention for Improving ASR Robustness in Spoken Language Understanding. | Xuxin Cheng, Ziyu Yao, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou |
| 2023 | Interspeech | FC-MTLF: A Fine- and Coarse-grained Multi-Task Learning Framework for Cross-Lingual Spoken Language Understanding. | Xuxin Cheng, Wanshi Xu, Ziyu Yao, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou |
| 2023 | Interspeech | GhostT5: Generate More Features with Cheap Operations to Improve Textless Spoken Question Answering. | Xuxin Cheng, Zhihong Zhu, Ziyu Yao, Hongxiang Li, Yaowei Li, Yuexian Zou |
| 2022 | ACL | Synthetic Question Value Estimation for Domain Adaptation of Question Answering. | Xiang Yue, Ziyu Yao, Huan Sun |
| 2022 | EMNLP | UnifiedSKG: Unifying and Multi-Tasking Structured Knowledge Grounding with Text-to-Text Language Models. | Tianbao Xie, Chen Henry Wu, Peng Shi, Ruiqi Zhong, Torsten Scholak, Michihiro Yasunaga, Chien-Sheng Wu, Ming Zhong, Pengcheng Yin, Sida I. Wang, Victor Zhong, Bailin Wang, Chengzu Li, Connor Boyle, Ansong Ni, Ziyu Yao, Dragomir Radev, Caiming Xiong, Lingpeng Kong, Rui Zhang, Noah A. Smith, Luke Zettlemoyer, Tao Yu |
| 2021 | ICLR | Learning Structural Edits via Incremental Tree Transformations. | Ziyu Yao, Frank F. Xu, Pengcheng Yin, Huan Sun, Graham Neubig |
| 2021 | IJCNN | Adversarial Example Defense Based on the Supervision. | Ziyu Yao, Jiaquan Gao |
| 2020 | EMNLP | An Imitation Game for Learning Semantic Parsers from User Interaction. | Ziyu Yao, Yiqi Tang, Wen-tau Yih, Huan Sun, Yu Su |
| 2019 | AAAI | Interactive Semantic Parsing for If-Then Recipes via Hierarchical Reinforcement Learning. | Ziyu Yao, Xiujun Li, Jianfeng Gao, Brian M. Sadler, Huan Sun |
| 2019 | ACL | Reinforced Dynamic Reasoning for Conversational Question Generation. | Boyuan Pan, Hao Li, Ziyu Yao, Deng Cai, Huan Sun |
| 2019 | EMNLP | Model-based Interactive Semantic Parsing: A Unified Framework and A Text-to-SQL Case Study. | Ziyu Yao, Yu Su, Huan Sun, Wen-tau Yih |
| 2019 | WWW | CoaCor: Code Annotation for Code Retrieval with Reinforcement Learning. | Ziyu Yao, Jayavardhan Reddy Peddamail, Huan Sun |
| 2018 | WWW | StaQC: A Systematically Mined Question-Code Dataset from Stack Overflow. | Ziyu Yao, Daniel S. Weld, Wei-Peng Chen, Huan Sun |
| 2016 | AAAI | Semi-Supervised Multinomial Naive Bayes for Text Classification by Leveraging Word-Level Statistical Constraint. | Li Zhao, Minlie Huang, Ziyu Yao, Rongwei Su, Yingying Jiang, Xiaoyan Zhu |