| 2026 | IF-RewardBench: Benchmarking Judge Models for Instruction-Following Evaluation. | Bosi Wen, Yilin Niu, Cunxiang Wang, Xiaoying Ling, Ying Zhang, Pei Ke, Hongning Wang, Minlie Huang |
| 2026 | IF-CRITIC: Towards a Fine-Grained LLM Critic for Instruction-Following Evaluation. | Bosi Wen, Yilin Niu, Cunxiang Wang, Pei Ke, Xiaoying Ling, Ying Zhang, Aohan Zeng, Hongning Wang, Minlie Huang |
| 2026 | Switching Heads and Softening Tokens: Turnkey Solutions to Visually Grounded Document QA. | Ximing Wen, Wenbo Li, Sudipta Paul, Yashas Malur Saidutta, Kalpa Gunaratna, Srinivas Chappidi |
| 2026 | Formally Specifying the Intended Behavior of the Program: LLM-Driven Neuro-Symbolic Program Specification Synthesis. | Cheng Wen, Junjie Hu, YiKun Hu, Jie Su, Bin Yu, Dugang Liu, Zhiwu Xu, Weidi Sun, Shengchao Qin, Cong Tian |
| 2026 | Safe-SAIL: Towards a Fine-grained Safety Landscape of Large Language Models via Sparse Autoencoder Interpretation Framework. | Jiaqi Weng, Han Zheng, Hanyu Zhang, Ej Zhou, Qinqin He, Jialing Tao, Hui Xue, Zhixuan Chu, Xiting Wang |
| 2026 | AnchorAlign: A Novel Anchor Alignment-enhanced Generative Method for Joint Named Entity Recognition and Relation Extraction. | Xiaolong Weng, Yuanyun Zhou, Boyu Qiu, Zehua Wang, Ying Xiong, Buzhou Tang |
| 2026 | FineSteer: A Unified Framework for Fine-Grained Inference-Time Steering in Large Language Models. | Zixuan Weng, Jinghuai Zhang, Kunlin Cai, Ying Li, Peiran Wang, Yuan Tian |
| 2026 | UniDataBench: Evaluating Data Analytics Agents Across Structured and Unstructured Data. | Han Weng, Zhou Liu, Yuanfeng Song, Xiaoming Yin, Xing Chen, Wentao Zhang |
| 2026 | SpecBound: Adaptive Bounded Self-Speculation with Layer-wise Confidence Calibration. | Zhuofan Wen, Yang Feng |
| 2026 | CodeRise: Bootstrapping LLMs for Ultra Low-Resource Programming Languages via Progressive Self-Refinement Curriculum. | Tengfei Wen, Xuanang Chen, Ben He, Xiaoliang Cong, Le Sun |
| 2026 | UniCreative: Unifying Long-form Logic and Short-form Sparkle via Reference-Free Reinforcement Learning. | Xiaolong Wei, Zerun Zhu, Simin Niu, Xingyu Zhang, Peiying Yu, Changxuan Xiao, Yuchen Li, Jicheng Yang, Zhejun Zhao, Chong Meng, Long Xia, Daiting Shi |
| 2026 | Anchor: Branch-Point Data Generation for GUI Agents. | Jinbiao Wei, Yilun Zhao, Kangqi Ni, Arman Cohan |
| 2026 | Libra-VLA: Achieving Learning Equilibrium via Asynchronous Coarse-to-Fine Dual-System. | Yifei Wei, Linqing Zhong, Yi Liu, Yuxiang Lu, Xindong He, Maoqing Yao, Guanghui Ren |
| 2026 | CIRAG: Construction-Integration Retrieval and Adaptive Generation for Multi-hop Question Answering. | Zili Wei, Yilin Wang, Xiaocui Yang, Shi Feng, Weidong Bao, Daling Wang, Zihan Wang, Yifei Zhang |
| 2026 | GenProve: Learning to Generate Text with Fine-Grained Provenance. | Jingxuan Wei, Xingyue Wang, Yanghaoyu Liao, Jie Dong, Yuchen Liu, Caijun Jia, Bihui Yu, Junnan Zhu |
| 2026 | A Survey of Reasoning-Intensive Retrieval: Progress and Challenges. | Yiyang Wei, Tingyu Song, Siyue Zhang, Yilun Zhao |
| 2026 | PACE: Predictive Adaptive Context Extraction for Long-Horizon LLM Agents. | Lei Wei, Xiao Peng, TT, Guannan Zhang, Chenhao Jiang, Hongyu Li, Lanbo Lin, Yuanwu Xu, Jiayao Liu, Kesu Wang, Bin Wang |
| 2026 | The Evolution of Thought: Tracking LLM Overthinking via Reasoning Dynamics Analysis. | Zihao Wei, Liang Pang, Jiahao Liu, Wenjie Shi, Jingcheng Deng, Shicheng Xu, Zenghao Duan, Jingang Wang, Fei Sun, Huawei Shen, Xueqi Cheng |
| 2026 | Lost in Translation, and Found: Detecting and Interpreting Translation Effects. | Shira Wein, Anna Serbina, Jiyuan Ji, Nathan Wolf, Jason DeGraaff, Prajakta Kini, Maria Leonor Pacheco |
| 2026 | Beyond Static Personas: Situational Personality Steering for Large Language Models. | Zesheng Wei, Mengxiang Li, Zilei Wang, Yang Deng |
| 2026 | From Past To Path: Masked History Learning for Next-Item Prediction in Generative Recommendation. | Kaiwen Wei, Kejun He, Xiaomian Kang, Jie Zhang, Ymyang, Li Jin, Zhenyang Li, Jiang Zhong, Richard He Bai, Junnan Zhu |
| 2026 | MMR-GRPO: Accelerating GRPO-Style Training through Diversity-Aware Reward Reweighting. | Kangda Wei, Ruihong Huang |
| 2026 | Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation. | Tianjun Wei, Huizhong Guo, Yingpeng Du, Zhu Sun, Huang Chen, Dongxia Wang, Jie Zhang |
| 2026 | A Multi-Agent Framework for High-Interaction Terminal Simulation. | Kai Wei, Yuwen Cui, Kehan Shen, Hua Wei, Guangjing Wang |
| 2026 | One Persona, Many Cues, Different Results: How Sociodemographic Cues Impact LLM Personalization. | Franziska Weeber, Vera Neplenbroek, Jan Batzner, Sebastian Pad |