| 2025 | EASYTOOL: Enhancing LLM-based Agents with Concise Tool Instruction. | Siyu Yuan, Kaitao Song, Jiangjie Chen, Xu Tan, Yongliang Shen, Kan Ren, Dongsheng Li, Deqing Yang |
| 2025 | EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms. | Siyu Yuan, Kaitao Song, Jiangjie Chen, Xu Tan, Dongsheng Li, Deqing Yang |
| 2025 | KS-Lottery: Finding Certified Lottery Tickets for Multilingual Transfer in Large Language Models. | Fei Yuan, Chang Ma, Shuai Yuan, Qiushi Sun, Lei Li |
| 2025 | Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models. | Hongbang Yuan, Yubo Chen, Pengfei Cao, Zhuoran Jin, Kang Liu |
| 2025 | How to Make LLMs Forget: On Reversing In-Context Knowledge Edits. | Paul Youssef, Zhixue Zhao, Jrg Schltterer, Christin Seifert |
| 2025 | Has this Fact been Edited? Detecting Knowledge Edits in Language Models. | Paul Youssef, Zhixue Zhao, Christin Seifert, Jrg Schltterer |
| 2025 | Ask Optimal Questions: Aligning Large Language Models with Retriever's Preference in Conversation. | Chanwoong Yoon, Gangwoo Kim, Byeongguk Jeon, Sungdong Kim, Yohan Jo, Jaewoo Kang |
| 2025 | Keep Guessing? When Considering Inference Scaling, Mind the Baselines. | Gal Yona, Or Honovich, Omer Levy, Roee Aharoni |
| 2025 | A Multi-modal Large Language Model with Graph-of-Thought for Effective Recommendation. | Zixuan Yi, Iadh Ounis |
| 2025 | How to Talk to Language Models: Serialization Strategies for Structured Entity Matching. | Haoteng Yin, Jinha Kim, Prashant Mathur, Krishanu Sarker, Vidit Bansal |
| 2025 | MMAU: A Holistic Benchmark of Agent Capabilities Across Diverse Domains. | Guoli Yin, Haoping Bai, Shuang Ma, Feng Nan, Yanchao Sun, Zhaoyang Xu, Shen Ma, Jiarui Lu, Xiang Kong, Aonan Zhang, Dian Ang Yap, Yizhe Zhang, Karsten Ahnert, Vik Kamath, Mathias Berglund, Dominic Walsh, Tobias Gindele, Juergen Wiest, Zhengfeng Lai, Xiaoming Wang, Jiulong Shan, Meng Cao, Ruoming Pang, Zirui Wang |
| 2025 | QSpell 250K: A Large-Scale, Practical Dataset for Chinese Search Query Spell Correction. | Dezhi Ye, Haomei Jia, Junwei Hu, Bowen Tian, Jie Liu, Haijin Liang, Jin Ma, Wenmin Wang |
| 2025 | Improving Reward Models with Synthetic Critiques. | Zihuiwen Ye, Fraser Greenlee-Scott, Max Bartolo, Phil Blunsom, Jon Ander Campos, Matthias Gall |
| 2025 | Beyond End-to-End VLMs: Leveraging Intermediate Text Representations for Superior Flowchart Understanding. | Junyi Ye, Ankan Dash, Wenpeng Yin, Guiling Wang |
| 2025 | Continual Learning in Multilingual Sign Language Translation. | Shakib Yazdani, Josef van Genabith, Cristina Espaa-Bonet |
| 2025 | Elevating Legal LLM Responses: Harnessing Trainable Logical Structures and Semantic Knowledge with Legal Reasoning. | Rujing Yao, Yang Wu, Chenghao Wang, Jingwei Xiong, Fang Wang, Xiaozhong Liu |
| 2025 | MCQG-SRefine: Multiple Choice Question Generation and Evaluation with Iterative Self-Critique, Correction, and Comparison Feedback. | Zonghai Yao, Aditya Parashar, Huixue Zhou, Won Seok Jang, Feiyun Ouyang, Zhichao Yang, Hong Yu |
| 2025 | Bridging the Visual Gap: Fine-Tuning Multimodal Models with Knowledge-Adapted Captions. | Moran Yanuka, Assaf Ben-Kish, Yonatan Bitton, Idan Szpektor, Raja Giryes |
| 2025 | STEP: Staged Parameter-Efficient Pre-training for Large Language Models. | Kazuki Yano, Takumi Ito, Jun Suzuki |
| 2025 | CuriousLLM: Elevating Multi-Document Question Answering with LLM-Enhanced Knowledge Graph Reasoning. | Zukang Yang, Zixuan Zhu, Jennifer Zhu |
| 2025 | A Unified Supervised and Unsupervised Dialogue Topic Segmentation Framework Based on Utterance Pair Modeling. | Shihao Yang, Ziyi Zhang, Yue Jiang, Chunsheng Qin, Shuhua Liu |
| 2025 | UCFE: A User-Centric Financial Expertise Benchmark for Large Language Models. | Yuzhe Yang, Yifei Zhang, Yan Hu, Yilin Guo, Ruoli Gan, Yueru He, Mingcong Lei, Xiao Zhang, Haining Wang, Qianqian Xie, Jimin Huang, Honghai Yu, Benyou Wang |
| 2025 | MAQA: Evaluating Uncertainty Quantification in LLMs Regarding Data Uncertainty. | Yongjin Yang, Haneul Yoo, Hwaran Lee |
| 2025 | SeqAR: Jailbreak LLMs with Sequential Auto-Generated Characters. | Yan Yang, Zeguan Xiao, Xin Lu, Hongru Wang, Xuetao Wei, Hailiang Huang, Guanhua Chen, Yun Chen |
| 2025 | COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis. | Weiqing Yang, Hanbin Wang, Zhenghao Liu, Xinze Li, Yukun Yan, Shuo Wang, Yu Gu, Minghe Yu, Zhiyuan Liu, Ge Yu |