| 2025 | RAG-Zeval: Enhancing RAG Responses Evaluator through End-to-End Reasoning and Ranking-Based Reinforcement Learning. | Kun Li, Yunxiang Li, Tianhua Zhang, Hongyin Luo, Xixin Wu, James R. Glass, Helen M. Meng |
| 2025 | Text or Pixels? Evaluating Efficiency and Understanding of LLMs with Visual Text Inputs. | Yanhong Li, Zixuan Lan, Jiawei Zhou |
| 2025 | MultiLingPoT: Boosting Mathematical Reasoning in LLMs through Multilingual Program Integration. | Nianqi Li, Zujie Liang, Siyu Yuan, Jiaqing Liang, Feng Wei, Yanghua Xiao |
| 2025 | NLP-ADBench: NLP Anomaly Detection Benchmark. | Yuangang Li, Jiaqi Li, Zhuo Xiao, Tiankai Yang, Yi Nian, Xiyang Hu, Yue Zhao |
| 2025 | CondAmbigQA: A Benchmark and Dataset for Conditional Ambiguous Question Answering. | Zongxi Li, Yang Li, Haoran Xie, S. Joe Qin |
| 2025 | HEAL: Hybrid Enhancement with LLM-based Agents for Text-attributed Hypergraph Self-supervised Representation Learning. | Ruochang Li, Xiao Luo, Zhiping Xiao, Wei Ju, Ming Zhang |
| 2025 | Towards Universal Debiasing for Language Models-based Tabular Data Generation. | Tianchun Li, Tianci Liu, Xingchen Wang, Rongzhe Wei, Pan Li, Lu Su, Jing Gao |
| 2025 | UPLex: Fine-Grained Personality Control in Large Language Models via Unsupervised Lexical Modulation. | Tianlong Li, Wenhao Liu, Muling Wu, Shihan Dou, Zhenghua Wang, Changze Lv, Xiaohua Wang, Xiaoqing Zheng, Xuanjing Huang |
| 2025 | InMind: Evaluating LLMs in Capturing and Applying Individual Human Reasoning Styles. | Zizhen Li, Chuanhao Li, Yibin Wang, Qi Chen, Diping Song, Yukang Feng, Jianwen Sun, Jiaxin Ai, Fanrui Zhang, Mingzhu Sun, Kaipeng Zhang |
| 2025 | LLMs as World Models: Data-Driven and Human-Centered Pre-Event Simulation for Disaster Impact Assessment. | Lingyao Li, Dawei Li, Zhenhui Ou, Xiaoran Xu, Jingxiao Liu, Zihui Ma, Runlong Yu, Min Deng |
| 2025 | MADS: Multi-Agent Dialogue Simulation for Diverse Persuasion Data Generation. | Mingjin Li, Yu Liu, Huayi Liu, Xiang Ye, Chao Jiang, Hongguang Zhang, Yu Ruan |
| 2025 | Layer-Aware Representation Filtering: Purifying Finetuning Data to Preserve LLM Safety Alignment. | Hao Li, Lijun Li, Zhenghao Lu, Xianyi Wei, Rui Li, Jing Shao, Lei Sha |
| 2025 | R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning. | Yuan Li, Qi Luo, Xiaonan Li, Bufan Li, Qinyuan Cheng, Bo Wang, Yining Zheng, Yuxin Wang, Zhangyue Yin, Xipeng Qiu |
| 2025 | Teaching According to Talents! Instruction Tuning LLMs with Competence-Aware Curriculum Learning. | Yangning Li, Tingwei Lu, Yinghui Li, Yankai Chen, Wei-Chieh Huang, Wenhao Jiang, Hui Wang, Hai-Tao Zheng, Philip S. Yu |
| 2025 | ReEvalMed: Rethinking Medical Report Evaluation by Aligning Metrics with Real-World Clinical Judgment. | Ruochen Li, Jun Li, Bailiang Jian, Kun Yuan, Youxiang Zhu |
| 2025 | Enrich-on-Graph: Query-Graph Alignment for Complex Reasoning with LLM Enriching. | Songze Li, Zhiqiang Liu, Zhengke Gui, Huajun Chen, Wen Zhang |
| 2025 | Humanity's Last Code Exam: Can Advanced LLMs Conquer Human's Hardest Code Competition? | Xiangyang Li, Xiaopeng Li, Kuicai Dong, Quanhu Zhang, Rongju Ruan, Xinyi Dai, Yasheng Wang, Ruiming Tang |
| 2025 | FG-PRM: Fine-grained Hallucination Detection and Mitigation in Language Model Mathematical Reasoning. | Ruosen Li, Ziming Luo, Xinya Du |
| 2025 | DICE: Structured Reasoning in LLMs through SLM-Guided Chain-of-Thought Correction. | Yiqi Li, Yusheng Liao, Zhe Chen, Yanfeng Wang, Yu Wang |
| 2025 | Don't Take the Premise for Granted: Evaluating the Premise Critique Ability of Large Language Models. | Jinzhe Li, Gengxu Li, Yi Chang, Yuan Wu |
| 2025 | RED: Unleashing Token-Level Rewards from Holistic Feedback via Reward Redistribution. | Jiahui Li, Lin Li, Tai-Wei Chang, Kun Kuang, Long Chen, Jun Zhou, Cheng Yang |
| 2025 | Building Data-Driven Occupation Taxonomies: A Bottom-Up Multi-Stage Approach via Semantic Clustering and Multi-Agent Collaboration. | Nan Li, Bo Kang, Tijl De Bie |
| 2025 | Reverse Prompt Engineering: A Zero-Shot, Genetic Algorithm Approach to Language Model Inversion. | Hanqing Li, Diego Klabjan |
| 2025 | Multimodal Document-level Triple Extraction via Dynamic Graph Enhancement and Relation-Aware Reflection. | Xiang Li, Runhai Jiao, Changyu Zhou, Shoupeng Qiao, Ruojiao Qiao, Ruifan Li |
| 2025 | GraphKV: Breaking the Static Selection Paradigm with Graph-Based KV Cache Eviction. | Xuelin Li, Xiangqi Jin, Linfeng Zhang |