| 2025 | How Far Can LLMs Improve from Experience? Measuring Test-Time Learning Ability in LLMs with Human Comparison. | Jiayin Wang, Zhiqiang Guo, Weizhi Ma, Min Zhang |
| 2025 | CESRec: Constructing Pseudo Interactions for Sequential Recommendation via Conversational Feedback. | Yifan Wang, Shen Gao, Jiabao Fang, Rui Yan, Billy Chiu, Shuo Shang |
| 2025 | Reasoning Model Unlearning: Forgetting Traces, Not Just Answers, While Preserving Reasoning Skills. | Changsheng Wang, Chongyu Fan, Yihua Zhang, Jinghan Jia, Dennis Wei, Parikshit Ram, Nathalie Baracaldo, Sijia Liu |
| 2025 | On the Role of Entity and Event Level Conceptualization in Generalizable Reasoning: A Survey of Tasks, Methods, Applications, and Future Directions. | Weiqi Wang, Tianqing Fang, Haochen Shi, Baixuan Xu, Wenxuan Ding, Liyu Zhang, Wei Fan, Jiaxin Bai, Haoran Li, Xin Liu, Yangqiu Song |
| 2025 | Mitigating Geospatial Knowledge Hallucination in Large Language Models: Benchmarking and Dynamic Factuality Aligning. | Shengyuan Wang, Jie Feng, Tianhui Liu, Dan Pei, Yong Li |
| 2025 | SkewRoute: Training-Free LLM Routing for Knowledge Graph Retrieval-Augmented Generation via Score Skewness of Retrieved Context. | Hairu Wang, Yuan Feng, Yukun Cao, Xike Xie, S. Kevin Zhou |
| 2025 | Wait, We Don't Need to "Wait"! Removing Thinking Tokens Improves Reasoning Efficiency. | Chenlong Wang, Yuanning Feng, Dongping Chen, Zhaoyang Chu, Ranjay Krishna, Tianyi Zhou |
| 2025 | DAC: Decomposed Automation Correction for Text-to-SQL. | Dingzirui Wang, Longxu Dou, Xuanliang Zhang, Qingfu Zhu, Wanxiang Che |
| 2025 | ICL-Bandit: Relevance Labeling in Advertisement Recommendation Systems via LLM. | Lu Wang, Chiming Duan, Pu Zhao, Fangkai Yang, Yong Shi, Xuefeng Luo, Bingjing Xu, Weiwei Deng, Qingwei Lin, Dongmei Zhang |
| 2025 | When Audio and Text Disagree: Revealing Text Bias in Large Audio-Language Models. | Cheng Wang, Gelei Deng, Xianglin Yang, Han Qiu, Tianwei Zhang |
| 2025 | Extending Automatic Machine Translation Evaluation to Book-Length Documents. | Kuang-Da Wang, Shuoyang Ding, Chao-Han Huck Yang, Ping-Chun Hsieh, Wen-Chih Peng, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | Optimizing Cross-Client Domain Coverage for Federated Instruction Tuning of Large Language Models. | Zezhou Wang, Yaxin Du, Xingjun Ma, Yu-Gang Jiang, Zhuzhong Qian, Siheng Chen |
| 2025 | ViDoRAG: Visual Document Retrieval-Augmented Generation via Dynamic Iterative Reasoning Agents. | Qiuchen Wang, Ruixue Ding, Zehui Chen, Weiqi Wu, Shihang Wang, Pengjun Xie, Feng Zhao |
| 2025 | CLIP-UP: A Simple and Efficient Mixture-of-Experts CLIP Training Recipe with Sparse Upcycling. | Xinze Wang, Chen Chen, Yinfei Yang, Hong-You Chen, Bowen Zhang, Aditya Pal, Xiangxin Zhu, Xianzhi Du |
| 2025 | Separate the Wheat from the Chaff: Winnowing Down Divergent Views in Retrieval Augmented Generation. | Song Wang, Zihan Chen, Peng Wang, Zhepei Wei, Zhen Tan, Yu Meng, Cong Shen, Jundong Li |
| 2025 | QUIDS: Query Intent Description for Exploratory Search via Dual Space Modeling. | Yumeng Wang, Xiuying Chen, Suzan Verberne |
| 2025 | RICO: Improving Accuracy and Completeness in Image Recaptioning via Visual Reconstruction. | Yuchi Wang, Yishuo Cai, Shuhuai Ren, Sihan Yang, Linli Yao, Yuanxin Liu, Yuanxing Zhang, Pengfei Wan, Xu Sun |
| 2025 | Teaching LLMs to Plan, Not Just Solve: Plan Learning Boosts LLMs Generalization in Reasoning Tasks. | Tianlong Wang, Junzhe Chen, Weibin Liao, Xueting Han, Jing Bai |
| 2025 | Plugging Schema Graph into Multi-Table QA: A Human-Guided Framework for Reducing LLM Reliance. | Xixi Wang, Miguel Costa, Jordanka Kovaceva, Shuai Wang, Francisco C. Pereira |
| 2025 | METok: Multi-Stage Event-based Token Compression for Efficient Long Video Understanding. | Mengyue Wang, Shuo Chen, Kristian Kersting, Volker Tresp, Yunpu Ma |
| 2025 | Measuring Risk of Bias in Biomedical Reports: The RoBBR Benchmark. | Jianyou Wang, Weili Cao, Longtian Bao, Youze Zheng, Gil Pasternak, Kaicheng Wang, Xiaoyue Wang, Ramamohan Paturi, Leon Bergen |
| 2025 | Your Mileage May Vary: How Empathy and Demographics Shape Human Preferences in LLM Responses. | Yishan Wang, Amanda Cercas Curry, Flor Miriam Plaza del Arco |
| 2025 | Discrete Minds in a Continuous World: Do Language Models Know Time Passes? | Minghan Wang, Ye Bai, Thuy-Trang Vu, Ehsan Shareghi, Gholamreza Haffari |
| 2025 | WebInject: Prompt Injection Attack to Web Agents. | Xilong Wang, John Bloch, Zedian Shao, Yuepeng Hu, Shuyan Zhou, Neil Zhenqiang Gong |
| 2025 | Identifying and Answering Questions with False Assumptions: An Interpretable Approach. | Zijie Wang, Eduardo Blanco |