| 2026 | EVGeoQA: Benchmarking LLMs on Dynamic, Multi-Objective Geo-Spatial Exploration. | Jianfei Wu, Zhichun Wang, Zhensheng Wang, Zhiyu He |
| 2026 | Reflective RAG: Self-Evaluation Driven Strategy Optimization in Agentic Retrieval-Augmented Generation. | Haiyan Wu, Chenchen Wang, Chaoqun Sun, Chengxiong Lu, Yanhong Chen, Zhiqiang Zhang, Xiaoqing Feng |
| 2026 | Parallel-SFT: Improving Zero-Shot Cross-Programming-Language Transfer for Code RL. | Zhaofeng Wu, Shiqi Wang, Boya Peng, Anuj Kumar Goyal, Melanie Kambadur, Sebastian Ruder, Yoon Kim, Chloe Bi |
| 2026 | SLIP: Soft Label Mechanism and Key-Extraction-Guided CoT-based Defense Against Instruction Backdoor in APIs. | Zhengxian Wu, Juan Wen, Wanli Peng, Haowei Chang, Yinghan Zhou, Yiming Xue |
| 2026 | Bidirectional Semantic Enhancement for Schema Routing Across Large-Scale Databases. | Yuyang Wu, Xiaoliang Wang, Cam-Tu Nguyen |
| 2026 | Internalizing Multi-Agent Reasoning for Accurate and Efficient LLM-based Recommendation. | Yang Wu, Haoze Wang, Qian Li, Jun Zhang, Huan Yu, Jie Jiang |
| 2026 | Breaking the Evaluation Paradox: Evaluating High-Entropy Search with Computationally Irreducible Constraints. | Juntao Wu, Wei Wen, Xianting Huang, Shuai Pang, Ruizhi Qiao, Xing Sun, Ke Wang |
| 2026 | No One Fits All: From Fixed Prompting to Learned Routing in Multilingual LLMs. | Wei-Chi Wu, Sheng-Lun Wei, Hen-Hsen Huang, Hsin-Hsi Chen |
| 2026 | PRISM: Probing Reasoning, Instruction, and Source Memory in LLM Hallucinations. | Yuhe Wu, Guangyu Wang, Yuran Chen, Jiatong Zhang, Yutong Zhang, Yujie Chen, Jiaming Shang, Guang Zhang, Zhuang Liu |
| 2026 | InferPilot: Autonomous Inference Attacks Against ML Services With LLM-Based Agents. | Yixin Wu, Rui Wen, Chi Cui, Michael Backes, Yang Zhang |
| 2026 | VisRet: Visualization Improves Knowledge-Intensive Text-to-Image Retrieval. | Di Wu, Yixin Wan, Kai-Wei Chang |
| 2026 | LLM Prompt Duel Optimizer: Efficient Label-Free Prompt Optimization. | Yuanchen Wu, Saurabh Verma, Justin Lee, Fangzhou Xiong, Poppy Zhang, Amel Awadelkarim, Xu Chen, Yubai Yuan, Shawndra Hill |
| 2026 | TRAC: Teacher-Guided Token Reward with Adaptive Calibration for Robust Policy Optimization. | Sitong Wu, Haoru Tan, Xichen Zhang, Bin Xia, Wenhu Zhang, Xiaojuan Qi, Bei Yu, Jiaya Jia |
| 2026 | TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification. | Jianghao Wu, Feilong Tang, Yulong Li, Ming Hu, Haochen Xue, Shoaib Jameel, Zongyuan Ge, Yutong Xie, Imran Razzak |
| 2026 | Emotion Trajectory-aware Retrieval for Markov-driven Emotion Anticipation in LLM-based Emotional Support Conversation. | Hongyan Wu, Zhiliang Tian, Zhen Huang, Tengyue Hu, Linbo Qiao, Yifu Gao, Feng Liu, Dongsheng Li |
| 2026 | Targeting the Needle, Ignoring the Haystack: Anchoring Crucial Cues for Evolving Scam Call Detection via an LLM-Assisted Classifier. | Tong Wu, Qinliang Su, Jianxing Yu, Bo Liang, Minhua Huang |
| 2026 | Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning. | Yuhang Wu, Xiangqing Shen, Fanfan Wang, Cangqi Zhou, Zhen Wu, Xinyu Dai, Rui Xia |
| 2026 | Concise Math Reasoning via Difficulty-Aware Distillation. | Yifan Wu, Jingze Shi, Bingheng Wu, Jiayi Zhang, Xiaotian Lin, Yizhang Zhu, Zhaoyang Yu, Bang Liu, Chenglin Wu, Nan Tang, Yuyu Luo |
| 2026 | FLAIR: Steering LLM Mathematical Problem Solving based on A Fuzzy-Logic-AssIsted Reasoner. | Hao Wu, Hongru Sun, Wanqing Li, Xinguo Yu, Hao Ming, Xiao Luo, Wenbin Zhang, Jiahong Zhao, Yi Guo, Jie Yang |
| 2026 | Beyond Static Synthetic Noise: Assessing the Robustness of Large Language Models to Natural Context Variation in the Real World. | Yulong Wu, Viktor Schlegel, Riza Batista-Navarro |
| 2026 | Beyond Templates: Dynamic Adaptation of Reasoning Demonstrations via Feasibility-Aware Exploration. | Yong Wu, Weihang Pan, Ke Li, Chen Binhui, Ping Li, Binbin Lin |
| 2026 | ImF: Embedding an Implicit Fingerprint in Your Large Language Models. | Jiaxuan Wu, Wanli Peng, Hang Fu, Yiming Xue, Juan Wen |
| 2026 | SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis. | Zijian Wu, Jinjie Ni, Xiangyan Liu, Zichen Liu, Hang Yan, Michael Qizhe Shieh |
| 2026 | Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling. | Florian Valentin Wunderlich, Lars Benedikt Kaesberg, Jan Philip Wahle, Terry Ruas, Bela Gipp |
| 2026 | RbtAct: Rebuttal as Supervision for Actionable Review Feedback Generation. | Sihong Wu, Yiling Ma, Yilun Zhao, Tiansheng Hu, Owen Jiang, Manasi Patwardhan, Arman Cohan |