| 2026 | ACL | DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping. | Wei Fan, Wenlin Yao, Zheng Li, Feng Yao, Xin Liu, Liang Qiu, Qingyu Yin, Yangqiu Song, Bing Yin |
| 2025 | ACL | OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization. | Hongliang He, Wenlin Yao, Kaixin Ma, Wenhao Yu, Hongming Zhang, Tianqing Fang, Zhenzhong Lan, Dong Yu |
| 2025 | ACL | DeFine: Decision-Making with Analogical Reasoning over Factor Profiles. | Yebowen Hu, Xiaoyang Wang, Wenlin Yao, Yiming Lu, Daoan Zhang, Hassan Foroosh, Dong Yu, Fei Liu |
| 2025 | EMNLP | WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning. | Zhepei Wei, Wenlin Yao, Yao Liu, Weizhi Zhang, Qin Lu, Liang Qiu, Changlong Yu, Puyang Xu, Chao Zhang, Bing Yin, Hyokun Yun, Lihong Li |
| 2025 | ICLR | DSBench: How Far Are Data Science Agents from Becoming Data Science Experts? | Liqiang Jing, Zhehui Huang, Xiaoyang Wang, Wenlin Yao, Wenhao Yu, Kaixin Ma, Hongming Zhang, Xinya Du, Dong Yu |
| 2025 | ICLR | DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search. | Murong Yue, Wenlin Yao, Haitao Mi, Dian Yu, Ziyu Yao, Dong Yu |
| 2024 | ACL | WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models. | Hongliang He, Wenlin Yao, Kaixin Ma, Wenhao Yu, Yong Dai, Hongming Zhang, Zhenzhong Lan, Dong Yu |
| 2024 | ACL | InFoBench: Evaluating Instruction Following Ability in Large Language Models. | Yiwei Qin, Kaiqiang Song, Yebowen Hu, Wenlin Yao, Sangwoo Cho, Xiaoyang Wang, Xuansheng Wu, Fei Liu, Pengfei Liu, Dong Yu |
| 2024 | ACL | Fact-and-Reflection (FaR) Improves Confidence Calibration of Large Language Models. | Xinran Zhao, Hongming Zhang, Xiaoman Pan, Wenlin Yao, Dong Yu, Tongshuang Wu, Jianshu Chen |
| 2024 | COLING | MinT: Boosting Generalization in Mathematical Reasoning via Multi-view Fine-tuning. | Zhenwen Liang, Dian Yu, Xiaoman Pan, Wenlin Yao, Qingkai Zeng, Xiangliang Zhang, Dong Yu |
| 2024 | EMNLP | When Reasoning Meets Information Aggregation: A Case Study with Sports Narratives. | Yebowen Hu, Kaiqiang Song, Sangwoo Cho, Xiaoyang Wang, Wenlin Yao, Hassan Foroosh, Dong Yu, Fei Liu |
| 2024 | NAACL | MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction Tuning. | Fuxiao Liu, Xiaoyang Wang, Wenlin Yao, Jianshu Chen, Kaiqiang Song, Sangwoo Cho, Yaser Yacoob, Dong Yu |
| 2024 | NAACL | From Language Modeling to Instruction Following: Understanding the Behavior Shift in LLMs after Instruction Tuning. | Xuansheng Wu, Wenlin Yao, Jianshu Chen, Xiaoman Pan, Xiaoyang Wang, Ninghao Liu, Dong Yu |
| 2024 | WWW | Could Small Language Models Serve as Recommenders? Towards Data-centric Cold-start Recommendation. | Xuansheng Wu, Huachi Zhou, Yucheng Shi, Wenlin Yao, Xiao Huang, Ninghao Liu |
| 2023 | EACL | How do Words Contribute to Sentence Semantics? Revisiting Sentence Embeddings with a Perturbation Method. | Wenlin Yao, Lifeng Jin, Hongming Zhang, Xiaoman Pan, Kaiqiang Song, Dian Yu, Dong Yu, Jianshu Chen |
| 2023 | EMNLP | Bridging Continuous and Discrete Spaces: Interpretable Sentence Representation Learning via Compositional Operations. | James Y. Huang, Wenlin Yao, Kaiqiang Song, Hongming Zhang, Muhao Chen, Dong Yu |
| 2023 | ICLR | Knowledge-in-Context: Towards Knowledgeable Semi-Parametric Language Models. | Xiaoman Pan, Wenlin Yao, Hongming Zhang, Dian Yu, Dong Yu, Jianshu Chen |
| 2022 | ACL | C-MORE: Pretraining to Answer Open-Domain Questions by Consulting Millions of References. | Xiang Yue, Xiaoman Pan, Wenlin Yao, Dian Yu, Dong Yu, Jianshu Chen |
| 2022 | ACL | Learning-by-Narrating: Narrative Pre-Training for Zero-Shot Dialogue Comprehension. | Chao Zhao, Wenlin Yao, Dian Yu, Kaiqiang Song, Dong Yu, Jianshu Chen |
| 2022 | EMNLP | Salience Allocation as Guidance for Abstractive Summarization. | Fei Wang, Kaiqiang Song, Hongming Zhang, Lifeng Jin, Sangwoo Cho, Wenlin Yao, Xiaoyang Wang, Muhao Chen, Dong Yu |
| 2022 | EMNLP | Z-LaVI: Zero-Shot Language Solver Fueled by Visual Imagination. | Yue Yang, Wenlin Yao, Hongming Zhang, Xiaoyang Wang, Dong Yu, Jianshu Chen |
| 2022 | EMNLP | Efficient Zero-shot Event Extraction with Context-Definition Alignment. | Hongming Zhang, Wenlin Yao, Dong Yu |
| 2022 | EMNLP | NarraSum: A Large-Scale Dataset for Abstractive Narrative Summarization. | Chao Zhao, Faeze Brahman, Kaiqiang Song, Wenlin Yao, Dian Yu, Snigdha Chaturvedi |
| 2022 | ICDM | ZeroKBC: A Comprehensive Benchmark for Zero-Shot Knowledge Base Completion. | Pei Chen, Wenlin Yao, Hongming Zhang, Xiaoman Pan, Dian Yu, Dong Yu, Jianshu Chen |
| 2021 | EMNLP | Connect-the-Dots: Bridging Semantics between Words and Definitions via Aligning Word Sense Inventories. | Wenlin Yao, Xiaoman Pan, Lifeng Jin, Jianshu Chen, Dian Yu, Dong Yu |
| 2020 | AAAI | Weakly-Supervised Fine-Grained Event Recognition on Social Media Texts for Disaster Management. | Wenlin Yao, Cheng Zhang, Shiva Saravanan, Ruihong Huang, Ali Mostafavi |
| 2020 | EMNLP | Weakly Supervised Subevent Knowledge Acquisition. | Wenlin Yao, Zeyu Dai, Maitreyi Ramaswamy, Bonan Min, Ruihong Huang |
| 2018 | ACL | Temporal Event Knowledge Acquisition via Identifying Narratives. | Wenlin Yao, Ruihong Huang |
| 2017 | IJCNLP | Using Context Events in Neural Network Models for Event Temporal Status Identification. | Zeyu Dai, Wenlin Yao, Ruihong Huang |
| 2017 | RANLP | Online Deception Detection Refueled by Real World Data Collection. | Wenlin Yao, Zeyu Dai, Ruihong Huang, James Caverlee |
| 2017 | RANLP | A Weakly Supervised Approach to Train Temporal Relation Classifiers and Acquire Regular Event Pairs Simultaneously. | Wenlin Yao, Saipravallika Nettyam, Ruihong Huang |