| 2026 | Evaluation of Multilingual Ability to Use Spatial Deictic Expressions in Vision-Language Models. | Kaito Watanabe, Taisei Yamamoto, Tomoki Doi, Hitomi Yanaka |
| 2026 | ClinDet-Bench: Beyond Abstention, Evaluating Judgment Determinability of LLMs in Clinical Decision-Making. | Yusuke Watanabe, Yohei Kobashi, Takeshi Kojima, Yusuke Iwasawa, Yasushi Okuno, Yutaka Matsuo |
| 2026 | LLM-Based Zero-Shot Soft Labeling for Anticipating Disagreement in Negotiation Dialogues. | Ken Watanabe, Katsuhide Fujita |
| 2026 | SwissGov-RSD: A Human-annotated, Cross-lingual Benchmark for Token-level Recognition of Semantic Differences Between Related Documents. | Michelle Wastl, Jannis Vamvas, Rico Sennrich |
| 2026 | Mina: A Multilingual LLM-Powered Legal Assistant Agent for Empowering Access to Justice in Bangladesh. | Azmine Toushik Wasi, Wahid Faisal, Mst Rafia Islam, Md. Rizwan Parvez |
| 2026 | One-step Nonautoregressive Natural Language Generation with Shortcut Flow Matching Models. | Jedrzej Warczynski, Ondrej Dusek, Mateusz Lango |
| 2026 | Speech-Hands: A Self-Reflection Voice Agentic Approach to Speech Recognition and Audio Reasoning with Omni Perception. | Zhen Wan, Chao-Han Huck Yang, Jinchuan Tian, Hanrong Ye, Ankita Pasad, Szu-Wei Fu, Arushi Goel, Ryo Hachiuma, Shizhe Diao, Kunal Dhawan, Sreyan Ghosh, Yusuke Hirota, Zhehuai Chen, Rafael Valle, Chenhui Chu, Shinji Watanabe, Boris Ginsburg, Yu-Chiang Frank Wang |
| 2026 | Limited Linguistic Diversity in Embodied AI Datasets. | Selma Liliane Wanna, Agnes Luhtaru, Jonathan Salfity, Ryan Barron, Juston Moore, Cynthia Matuszek, Mitch Pryor |
| 2026 | COMPASS: Enhancing Agent Long-Horizon Reasoning with Evolving Context. | Guangya Wan, Mingyang Ling, Xiaoqi Ren, Rujun Han, Sheng Li, Zizhao Zhang |
| 2026 | "Newspaper Eat" Means "Not Tasty": A Taxonomy and Benchmark for Coded Language in Real-World Chinese Online Reviews. | Ruyuan Wan, Changye Li, Ting-Hao 'Kenneth' Huang |
| 2026 | Test-Time Scaling in Multimodal Foundation Models: A Comprehensive Survey of Generation and Reasoning. | Cong Wan, Ying He, Zhongzhan Huang, Hefeng Wu |
| 2026 | PERM: Psychology-grounded Empathetic Reward Modeling for Large Language Models. | Chengbing Wang, Wuqiang Zheng, Yang Zhang, Fengbin Zhu, Junyi Cheng, Yi Xie, Wenjie Wang, Fuli Feng |
| 2026 | Causal-ESC: Reliable Policy Learning for Emotional Support Conversation via Causal Inference. | Xv Wang, Wang Zhenyu, Guanyu Zheng, Rui Zhang |
| 2026 | A Survey of Large Language Models for Text-Guided Molecular Discovery: From Molecule Generation to Optimization. | Ziqing Wang, Kexin Zhang, Zihan Zhao, Yibo Wen, Abhishek Pandey, Han Liu, Kaize Ding |
| 2026 | ColorBrowserAgent: Complex Long-Horizon Browser Agent with Adaptive Knowledge Evolution. | Jihong Wang, Jiamu Zhou, Weiming Zhang, Teng Wang, Weiwen Liu, Zhuosheng Zhang, Xingyu Lou, Weinan Zhang, Huarong Deng, Jun Wang |
| 2026 | From Off-Policy to On-Policy: Enhancing GUI Agents via Bi-level Expert-to-Policy Assimilation. | Zezhou Wang, Ziyun Zhang, Xiaoyi Zhang, Zhuzhong Qian, Yan Lu |
| 2026 | GlossaGen: Making Academic Translation Smarter with Glossing. | Zixiao Wang, Duzhen Zhang, Juntian Zhang, Yuhan Liu, Guoming Li, Haolun Wu, Le Song, Xiuying Chen |
| 2026 | MADRA: Multi-Agent Debate for Risk-Aware Embodied Planning. | Junjian Wang, Lidan Zhao, Xi Sheryl Zhang |
| 2026 | Towards Scalable Lightweight GUI Agents via Multi-role Orchestration. | Ziwei Wang, Junjie Zheng, Leyang Yang, Sheng Zhou, Xiaoxuan Tang, Zhouhua Fang, Zhiwei Liu, Dajun Chen, Yong Li, Jiajun Bu |
| 2026 | Benchmarking the Fine-Grained Discriminability in Image-Text Retrieval via Controlled Contrastive Differences. | Zhen Wang, Xi Zhou, Yating Yang, Bo Ma, Lei Wang, Rui Dong, Azmat Anwar, Siru Miao |
| 2026 | SpeechLLM-as-Judges: Towards General and Interpretable Speech Quality Evaluation. | Hui Wang, Jinghua Zhao, Yifan Yang, Shujie Liu, Junyang Chen, Yanzhe Zhang, Shiwan Zhao, Jinyu Li, Jiaming Zhou, Haoqin Sun, Yan Lu, Yong Qin |
| 2026 | PlanE: Meta Planning of Data, Tuning, and Inference for Extractive-based LLMs. | Jiacheng Wang, Weiyan Zhang, Guangya Yu |
| 2026 | Time-for-Accuracy: Formalizing Chain-of-Thought as an Expansion of Logical Depth. | Yue Wang, Zhi Zhang, Wang Xi, Chengjie Sun, Lili Shan, Bingquan Liu |
| 2026 | Large-Scale Multimodal Knowledge Graph about Classical Chinese Poetry: Fine-grained Method and Comprehensive Evaluation. | Shuo Wang, Qing Zhu, Yang Xiao, Minglong Lei |
| 2026 | TingIS: Real-time Risk Event Discovery from Noisy Customer Incidents at Enterprise Scale. | Jun Wang, Ziyin Zhang, Rui Wang, Hang Yu, Peng Di |