| 2025 | Automatic Extraction of Metaphoric Analogies from Literary Texts: Task Formulation, Dataset Construction, and Evaluation. | Joanne Boisson, Zara Siddique, Hsuvas Borkakoty, Dimosthenis Antypas, Luis Espinosa Anke, Jos Camacho-Collados |
| 2025 | BBPOS: BERT-based Part-of-Speech Tagging for Uzbek. | Latofat Bobojonova, Arofat Akhundjanova, Phil Sidney Ostheimer, Sophie Fellenz |
| 2025 | Add Noise, Tasks, or Layers? MaiNLP at the VarDial 2025 Shared Task on Norwegian Dialectal Slot and Intent Detection. | Verena Blaschke, Felicia Krner, Barbara Plank |
| 2025 | Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-Tuning. | Jing Bi, Yuting Wu, Weiwei Xing, Zhenjie Wei |
| 2025 | Automating Annotation Guideline Improvements using LLMs: A Case Study. | Adrien Bibal, Nathaniel Gerlek, Goran Muric, Elizabeth Boschee, Steven Fincke, Mike Ross, Steven N. Minton |
| 2025 | PToco: Prefix-based Token-level Collaboration Enhances Reasoning for Multi-LLMs. | Yuang Bian, Yupian Lin, Jingping Liu, Tong Ruan |
| 2025 | Chat Bankman-Fried: an Exploration of LLM Alignment in Finance. | Claudia Biancotti, Carolina Camassa, Andrea Coletta, Oliver Giudice, Aldo Glielmo |
| 2025 | UR2N: Unified Retriever and ReraNker. | Riyaz Ahmad Bhat, Jaydeep Sen, Rudra Murthy, Vignesh P |
| 2025 | XTR meets ColBERTv2: Adding ColBERTv2 Optimizations to XTR. | Riyaz Ahmad Bhat, Jaydeep Sen |
| 2025 | AAIG at GenAI Detection Task 1: Exploring Syntactically-Aware, Resource-Efficient Small Autoregressive Decoders for AI Content Detection. | Avanti Bhandarkar, Ronald Wilson, Damon L. Woodard |
| 2025 | Lost in Variation: An Unsupervised Methodology for Mining Lexico-syntactic Patterns in Middle Arabic Texts. | Julien Bezanon, Rimane Karam, Gal Lejeune |
| 2025 | bAI-bAI: A Context-Aware Transliteration System for Baybayin Scripts. | Jacob Simon Bernardo, Maria Regina Justina E. Estuar |
| 2025 | PANDA - Paired Anti-hate Narratives Dataset from Asia: Using an LLM-as-a-Judge to Create the First Chinese Counterspeech Dataset. | Michael Bennie, Demi Zhang, Bushi Xiao, Jing Cao, Chryseis Xinyi Liu, Jian Meng, Alayo Tripp |
| 2025 | CODEOFCONDUCT at Multilingual Counterspeech Generation: A Context-Aware Model for Robust Counterspeech Generation in Low-Resource Languages. | Michael Bennie, Bushi Xiao, Chryseis Xinyi Liu, Demi Zhang, Jian Meng, Alayo Tripp |
| 2025 | HiTZ at VarDial 2025 NorSID: Overcoming Data Scarcity with Language Transfer and Automatic Data Annotation. | Jaione Bengoetxea, Mikel Zubillaga, Ekhi Azurmendi, Maite Heredia, Julen Etxaniz, Markel Ferro, Jeremy Barnes |
| 2025 | Luna: A Lightweight Evaluation Model to Catch Language Model Hallucinations with High Accuracy and Low Cost. | Masha Belyi, Robert Friel, Shuai Shao, Atindriyo Sanyal |
| 2025 | Evaluating the Capabilities of Large Language Models for Multi-label Emotion Understanding. | Tadesse Destaw Belay, Israel Abebe Azime, Abinew Ali Ayele, Grigori Sidorov, Dietrich Klakow, Philipp Slusallek, Olga Kolesnikova, Seid Muhie Yimam |
| 2025 | A REGNLP Framework: Developing Retrieval-Augmented Generation for Regulatory Document Analysis. | Ozan Bayer, Elif Nehir Ulu, Yasemin Sarkin, Ekrem St, Defne Buse elik, Alper Karamanlioglu, Ismail Karakaya, Berkan Demirel |
| 2025 | IberoBench: A Benchmark for LLM Evaluation in Iberian Languages. | Irene Baucells, Javier Aula-Blasco, Iria de-Dios-Flores, Silvia Paniagua Surez, Naiara Prez, Anna Salles, Susana Sotelo Doco, Jlia Falco, Jos Javier Saiz, Robiert Seplveda-Torres, Jeremy Barnes, Pablo Gamallo, Aitor Gonzalez-Agirre, German Rigau, Marta Villegas |
| 2025 | How Well Can Large Language Models Reflect? A Human Evaluation of LLM-generated Reflections for Motivational Interviewing Dialogues. | Erkan Basar, Xin Sun, Iris Hendrickx, Jan de Wit, Tibor Bosse, Gert-Jan de Bruijn, Jos A. Bosch, Emiel Krahmer |
| 2025 | GraphRAG: Leveraging Graph-Based Efficiency to Minimize Hallucinations in LLM-Driven RAG for Finance Data. | Mariam Barry, Gatan Caillaut, Pierre Halftermeyer, Raheel Qader, Mehdi Mouayad, Fabrice Le Deit, Dimitri Cariolaro, Joseph Gesnouin |
| 2025 | Acquired TASTE: Multimodal Stance Detection with Textual and Structural Embeddings. | Guy Barel, Oren Tsur, Dan Vilenchik |
| 2025 | Analysing Zero-Shot Readability-Controlled Sentence Simplification. | Abdullah Barayan, Jos Camacho-Collados, Fernando Alva-Manchego |
| 2025 | Mirror Minds : An Empirical Study on Detecting LLM-Generated Text via LLMs. | Josh Baradia, Shubham Gupta, Suman Kundu |
| 2025 | How Likely Do LLMs with CoT Mimic Human Reasoning? | Guangsheng Bao, Hongbo Zhang, Cunxiang Wang, Linyi Yang, Yue Zhang |