| 2026 | Eval-RAR: Evaluation-Driven Retrieval-Augmented Reasoning via Reinforcement Learning. | Heng Yu, Rui Li, Qi Liu, Wenjun Feng, Junfeng Kang, Yi Zhan |
| 2026 | MONETA: Multimodal Industry Classification through Geographic Information with Multi Agent Systems. | Arda Yksel, Gabriel Thiem, Susanne Walter, Patrick Felka, Gabriela Alves Werb, Ivan Habernal |
| 2026 | Recovered in Translation: Efficient Pipeline for Automated Translation of Benchmarks and Datasets. | Hanna Yukhymenko, Anton Alexandrov, Martin T. Vechev |
| 2026 | Understanding and Mitigating Spurious Signal Amplification in Test-Time Reinforcement Learning for Math Reasoning. | Yongcan Yu, Lingxiao He, Jian Liang, Kuangpu Guo, Meng Wang, Qianlong Xie, Xingxing Wang, Ran He |
| 2026 | CAMO: An Agentic Framework for Automated Causal Discovery from Micro Behaviors to Macro Emergence in LLM Agent Simulations. | Xiangning Yu, Yuwei Guo, Yuqi Hou, Xiao Xue, Qun Ma |
| 2026 | Phun-Bench: Evaluating LLMs on Phonological Understanding in Chinese. | Xing Yue, Yongliang Shen, Weiming Lu |
| 2026 | HyperMem: Hypergraph Memory for Long-Term Conversations. | Juwei Yue, Chuanrui Hu, Jiawei Sheng, Zuyi Zhou, Wenyuan Zhang, Tingwen Liu, Li Guo, Yafeng Deng |
| 2026 | You Only Need One Single Token to Refine Safety Alignment. | Wenqian Yu, Shuo Chen, Zhijiang Li, Zhipeng Wang, Jindong Gu |
| 2026 | Spatial-RAG: Spatial Retrieval Augmented Generation for Real-World Geospatial Reasoning Questions. | Dazhou Yu, Riyang Bao, Ruiyu Ning, Jinghong Peng, Gengchen Mai, Liang Zhao |
| 2026 | Dunhuang-Bench: How Well Do MLLMs Understand Cultural Heritage? | Junyi Yuan, Jian Zhang, Tianxiu Yu, Yanlin Zhou, Xiaobo Jin, Qiufeng Wang, Fangyu Wu |
| 2026 | Where Paths Split: Localized, Calibrated Control of Moral Reasoning in Large Language Models. | Chenchen Yuan, Zheyu Zhang, Gjergji Kasneci |
| 2026 | Simulating Crisis Cognition: A Computational Framework for Hypothesis Generation in Crisis Communication. | Changsen Yuan, Yanghao Zhou, Chong Feng, Ge Shi |
| 2026 | Understanding LLM Reasoning for Abstractive Summarization. | Haohan Yuan, Haopeng Zhang |
| 2026 | Culture-Aware Machine Translation in Large Language Models: Benchmarking and Investigation. | Zekun Yuan, Yangfan Ye, Xiaocheng Feng, Baohang Li, Qichen Hong, Yunfei Lu, Dandan Tu, Bing Qin |
| 2026 | Understanding the Behaviors of Environment-aware Information Retrieval. | Ruifeng Yuan, Chaohao Yuan, David Dai, Yu Rong, Hong Cheng, Hou Pong Chan, Chenghao Xiao |
| 2026 | Shorten After You're Right: Lazy Length Penalties for Reasoning RL. | Danlong Yuan, Tian Xie, Shaohan Huang, Huishuai Zhang, Zhuocheng Gong, Chong Luo, Furu Wei, Dongyan Zhao |
| 2026 | Knowledge-to-Verification: Exploring RLVR for LLMs in Knowledge-Intensive Domains. | Zhonghang Yuan, Zhefan Wang, Fang Hu, Zihong Chen, Jinzhe Li, Gang Li, Jie Ying, Huanjun Kong, Songyang Zhang, Nanqing Dong |
| 2026 | HiGoE: Hierarchical Graph of Evidence to Enhance Retrieval-Augmented Generation for Long-context Summarization. | Long Yuan, Kaiwen Tian, Zi Chen, Bolong Zheng, Chuan Ma |
| 2026 | Behavior Knowledge Merge in Reinforced Agentic Models. | Xiangchi Yuan, Dachuan Shi, Chunhui Zhang, Zheyuan Liu, Shenglong Yao, Soroush Vosoughi, Wenke Lee |
| 2026 | FACTS: Table Summarization via Offline Template Generation with Agentic Workflows. | Ye Yuan, Mohammad Amin Shabani, Siqi Liu |
| 2026 | LeCoDe: A Benchmark Dataset for Interactive Legal Consultation Dialogue Evaluation. | Weikang Yuan, Kaisong Song, Zhuoren Jiang, Junjie Cao, Yujie Zhang, Jun Lin, Kun Kuang, Ji Zhang, Xiaozhong Liu |
| 2026 | Curing Miracle Steps in LLM Mathematical Reasoning with Rubric Rewards. | Youliang Yuan, Qiuyang Mang, Jingbang Chen, Hong Wan, Xiaoyuan Liu, Junjielong Xu, Jen-tse Huang, Wenxuan Wang, Wenxiang Jiao, Pinjia He |
| 2026 | MemSearcher: Iterative Memory Integration for Search Agent via End-to-End Reinforcement Learning. | Qianhao Yuan, Jie Lou, Zichao Li, Jiawei Chen, Yaojie Lu, Hongyu Lin, Le Sun, Debing Zhang, Xianpei Han |
| 2026 | Verify Before You Commit: Towards Faithful Reasoning in LLM Agents via Self-Auditing. | Wenhao Yuan, Chenchen Lin, Jian Chen, Jinfeng Xu, Xuehe Wang, Edith Cheuk-Han Ngai |
| 2026 | Benchmarking LLM's Capability in Reasoning over Conflicting Web References. | Yizhen Yuan, Rui Kong, Dongze Li, Yuanchun Li, Yunxin Liu |