| 2025 | Probing Narrative Morals: A New Character-Focused MFT Framework for Use with Large Language Models. | Luca Mitran, Sophie Wu, Andrew Piper |
| 2025 | How Can Input Reformulation Improve Tool Usage Accuracy in a Complex Dynamic Environment? A Study on tau-bench. | Venkatesh Mishra, Amir Saeidi, Satyam Raj, Mutsumi Nakamura, Gaowen Liu, Ali Payani, Jayanth Srinivasa, Chitta Baral |
| 2025 | TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games. | Prakamya Mishra, Jiang Liu, Jialian Wu, Xiaodong Yu, Zicheng Liu, Emad Barsoum |
| 2025 | Stratified Selective Sampling for Instruction Tuning with Dedicated Scoring Strategy. | Paramita Mirza, Lucas Weber, Fabian Kch |
| 2025 | FilBench: Can LLMs Understand and Generate Filipino? | Lester James Validad Miranda, Elyanah Aco, Conner G. Manuel, Jan Christian Blaise Cruz, Joseph Marvin Imperial |
| 2025 | Multi-Document Event Extraction Using Large and Small Language Models. | Qingkai Min, Zitian Qu, Qipeng Guo, Xiangkun Hu, Zheng Zhang, Yue Zhang |
| 2025 | CTR-Guided Generative Query Suggestion in Conversational Search. | Erxue Min, Hsiu-Yuan Huang, Xihong Yang, Min Yang, Xin Jia, Yunfang Wu, Hengyi Cai, Junfeng Wang, Shuaiqiang Wang, Dawei Yin |
| 2025 | Towards General-Domain Word Sense Disambiguation: Distilling Large Language Model into Compact Disambiguator. | Liqiang Ming, Sheng-hua Zhong, Yuncong Li |
| 2025 | Zipf's and Heaps' Laws for Tokens and LLM-generated Texts. | Nikolay Mikhaylovskiy |
| 2025 | Examining Multilingual Embedding Models Cross-Lingually Through LLM-Generated Adversarial Examples. | Andrianos Michail, Simon Clematide, Rico Sennrich |
| 2025 | Data Augmentation for Maltese NLP using Transliterated and Machine Translated Arabic Data. | Kurt Micallef, Nizar Habash, Claudia Borg |
| 2025 | Easy Dataset: A Unified and Extensible Framework for Synthesizing LLM Fine-Tuning Data from Unstructured Documents. | Ziyang Miao, Qiyu Sun, Jingyuan Wang, Yuchen Gong, Yaowei Zheng, Shiqi Li, Richong Zhang |
| 2025 | TASO: Task-Aligned Sparse Optimization for Parameter-Efficient Model Adaptation. | Daiye Miao, Yufang Liu, Jie Wang, Changzhi Sun, Yunke Zhang, Demei Yan, Shaokang Dong, Qi Zhang, Yuanbin Wu |
| 2025 | Discursive Circuits: How Do Language Models Understand Discourse Relations? | Yisong Miao, Min-Yen Kan |
| 2025 | Visual Contextual Attack: Jailbreaking MLLMs with Image-Driven Context Injection. | Ziqi Miao, Yi Ding, Lijun Li, Jing Shao |
| 2025 | BANMIME : Misogyny Detection with Metaphor Explanation on Bangla Memes. | Md Ayon Mia, Akm Moshiur Rahman Mazumder, Khadiza Sultana Sayma, Md Fahim, Md. Tahmid Hasan Fuad, Muhammad Ibrahim Khan, AKMMahbubur Rahman |
| 2025 | Exploring the Hidden Capacity of LLMs for One-Step Text Generation. | Gleb Mezentsev, Ivan V. Oseledets |
| 2025 | Token-Level Metrics for Detecting Incorrect Gold Annotations in Named Entity Recognition. | Elena Merdjanovska, Alan Akbik |
| 2025 | SFAL: Semantic-Functional Alignment Scores for Distributional Evaluation of Auto-Interpretability in Sparse Autoencoders. | Fabio Mercorio, Filippo Pallucchini, Daniele Potert, Antonio Serino, Andrea Seveso |
| 2025 | Assumed Identities: Quantifying Gender Bias in Machine Translation of Gender-Ambiguous Occupational Terms. | Orfeas Menis-Mastromichalakis, Giorgos Filandrianos, Maria Symeonaki, Giorgos Stamou |
| 2025 | FusionDTI: Fine-grained Binding Discovery with Token-level Fusion for Drug-Target Interaction. | Zhaohan Meng, Zaiqiao Meng, Ke Yuan, Iadh Ounis |
| 2025 | Speech Vecalign: an Embedding-based Method for Aligning Parallel Speech Documents. | Chutong Meng, Philipp Koehn |
| 2025 | Don't Forget the Base Retriever! A Low-Resource Graph-based Retriever for Multi-hop Question Answering. | Andr Melo, Enting Chen, Pavlos Vougiouklis, Chenxin Diao, Shriram Piramanayagam, Ruofei Lai, Jeff Z. Pan |
| 2025 | Demystifying optimized prompts in language models. | Rimon Melamed, Lucas H. McCabe, H. Howie Huang |
| 2025 | NileChat: Towards Linguistically Diverse and Culturally Aware LLMs for Local Communities. | Abdellah El Mekki, Houdaifa Atou, Omer Nacar, Shady Shehata, Muhammad Abdul-Mageed |