| 2026 | Task-Aware LLM Routing with Multi-Level Task-Profile-Guided Data Synthesis for Cold-Start Scenarios. | Hui Liu, Bin Zou, Kecheng Chen, Jie Liu, Wenya Wang, Haoliang Li |
| 2026 | AI Agents for the Science of Science: A Survey of Tasks, Architectures, Evaluations, and Challenges. | Yixuan Liu, Yicheng Zhang |
| 2026 | SGVEF-LOOP: Coverage-Guided Progressive Topological Exploration and Fact-Grounded Metamorphic Evaluation for MCP Agents. | Zenghao Liu, Yansong Zhang |
| 2026 | CAKE: Causal-Guided Adaptive Knowledge Editing for LLMs. | Shuxin Liu, Jianhao Zhang |
| 2026 | RATE: Reviewer Profiling and Annotation-free Training for Expertise Ranking in Peer Review Systems. | Weicong Liu, Zixuan Yang, Yibo Zhao, Xiang Li |
| 2026 | HeteroSpec: Leveraging Contextual Heterogeneity for Efficient Speculative Decoding. | Siran Liu, Yang Ye, Qianchao Zhu, Zane Cao, Yongchao He |
| 2026 | Revitalizing Black-Box Interpretability: Actionable Interpretability for LLMs via Proxy Models. | Junhao Liu, Haonan Yu, Zhenyu Yan, Xin Zhang |
| 2026 | Discover and Prove: An Open-source Agentic Framework for Hard Mode Automated Theorem Proving in Lean 4. | Chengwu Liu, Yichun Yin, Ye Yuan, Jiaxuan Xie, Botao Li, Siqi Li, Jianhao Shen, Yan Xu, Lifeng Shang, Ming Zhang |
| 2026 | BAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search. | Shiyu Liu, Yongjing Yin, Jianhao Yan, Yunbo Tang, Qinggang Zhang, Bei Li, Xin Chen, Jingang Wang, Xunliang Cai, Jinsong Su |
| 2026 | ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition. | Yujie Liu, Zonglin Yang, Tong Xie, Jinjie Ni, Ben Gao, Yuqiang Li, Shixiang Tang, Wanli Ouyang, Erik Cambria, Dongzhan Zhou |
| 2026 | SAD: A Large-Scale Strategic Argumentative Dialogue Dataset. | Yongkang Liu, Jiayang Yu, Mingyang Wang, Yiqun Zhang, Ercong Nie, Shi Feng, Daling Wang, Kaisong Song, Hinrich Schtze |
| 2026 | An Experimental Study on the Influence of Culture on Cross-Lingual Sentiment Transfer. | Ahao Liu, Haitong Yang, Chuanrong Wang |
| 2026 | Learning to Translate by Translating: Stabilizing the Dual Loop via Semantic-Aware Self-Evolution. | Kui Liu, Mingming Yin, Zuoli Tang, Zihao Li, Chilin Fu, Xiaolu Zhang, Jun Zhou, Lixin Zou, Chenliang Li |
| 2026 | Safety-Aware Dialogue System for Postoperative Oral Cancer Care with Structured Clarification and a Clinically Curated Dataset. | Tzu-Chi Liu, Hui-Ying Yang, Shiow-Ching Shun, Yu-Chi Chen, Lu-Yen Anny Chen, Yong-Sheng Chen |
| 2026 | FocalOrder: Focal Preference Optimization for Reading Order Detection. | Fuyuan Liu, Dianyu Yu, He Ren, Nayu Liu, Xiaomian Kang, Delai Qiu, Fa Zhang, Genpeng Zhen, Shengping Liu, Jiaen Liang, Wei Huang, Yining Wang, Junnan Zhu |
| 2026 | Save the Good Prefix: Precise Error Penalization via Process-Supervised RL to Enhance LLM Reasoning. | Haolin Liu, Dian Yu, Sidi Lu, Yujun Zhou, Rui Liu, Zhenwen Liang, Haitao Mi, Chen-Yu Wei, Dong Yu |
| 2026 | Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models. | Shaonan Liu, Guo Yu, Xiaoling Luo, Shiyi Zheng, Jie Liu, Wenting Chen, Linlin Shen |
| 2026 | PDR: A Plug-and-Play Positional Decay Framework for LLM Pre-training Data Detection. | Jinhan Liu, Yibo Yang, Ruiying Lu, Piotr Piekos, Yimeng Chen, Peng Wang, Dandan Guo |
| 2026 | Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering. | Shuliang Liu, Songbo Yang, Dong Fang, Sihang Jia, Yuqi Tang, Lingfeng Su, Ruoshui Peng, Yibo Yan, Xin Zou, Xuming Hu |
| 2026 | OpenRubrics: Towards Scalable Synthetic Rubric Generation for Reward Modeling and LLM Alignment. | Tianci Liu, Ran Xu, Tony Yu, Ilgee Hong, Carl Yang, Tuo Zhao, Haoyu Wang |
| 2026 | Reflection in the Dark: Exposing and Escaping the Black Box in Reflective Prompt Optimization. | Shiyan Liu, Qifeng Xia, Qiyun Xia, Yisheng Liu, Xinyu Yu, Rui Qu |
| 2026 | Look Within or Beyond? A Theoretical Comparison Between Parameter-Efficient and Full Fine-Tuning. | Yongkang Liu, Xingle Xu, Ercong Nie, Zijing Wang, Shi Feng, Daling Wang, Qian Li, Hinrich Schtze |
| 2026 | Mitigating Judgment Preference Bias in Large Language Models through Group-Based Polling. | Shuliang Liu, Zhipeng Xu, Zhenghao Liu, Yukun Yan, Minghe Yu, Yu Gu, Chong Chen, Huiyuan Xie, Ge Yu |
| 2026 | Do LLMs Catch Their Own Mistakes? A Comprehensive Benchmark for Reflective Tool Use LLMs. | Zheyuan Liu, Liqiang Xiao, Yang Li, Hyokun Yun, Lihong Li, Chao Zhang, Meng Jiang |
| 2026 | Conflicts Make Large Reasoning Models Vulnerable to Attacks. | Honghao Liu, Chengjin Xu, Xuhui Jiang, Cehao Yang, Shengming Yin, Zhengwu Ma, Lionel Ni, Jian Guo |