| 2026 | Active Learning for Corpus Refinement: Cost-Effective Preprocessing to Improve Validity of Applied Quantitative Text Analysis. | Jakob Steglich, Stephan Poppe |
| 2026 | Annotation-Efficient Vision-Language Model Adaptation to the Polish Language Using the LLaVA Framework. | Grzegorz Statkiewicz, Alicja Dobrzeniecka, Karolina Seweryn, Aleksandra Krasnodebska, Karolina Piosek, Katarzyna Bogusz, Sebastian Cygert, Wojciech Kusa |
| 2026 | Uncertainty Quantification for Evaluating Gender Bias in Machine Translation. | Ieva Staliunaite, Julius Cheng, Andreas Vlachos |
| 2026 | Improving the OOD Performance of Closed-Source LLMs on NLI Through Strategic Data Selection. | Joe Stacey, Lisa Alazraki, Aran Ubhi, Beyza Ermis, Aaron Mueller, Marek Rei |
| 2026 | Elections go bananas: A First Large-scale Multilingual Study of Pluralia Tantum using LLMs. | Elena Spaziani, Kamyar Zeinalipour, Pierluigi Cassotti, Nina Tahmasebi |
| 2026 | Thesis Proposal: Multimodal Benchmark for Music Understanding in Large Language Models. | Toms Sourada |
| 2026 | QueerGen: How LLMs Reflect Societal Norms on Gender and Sexuality in Sentence Completion Task. | Mae Sosto, Delfina Sol Martinez Pandiani, Laura Hollink |
| 2026 | Automating Android Build Repair: Bridging the Reasoning-Execution Gap in LLM Agents with Domain-Specific Tools. | Ha Min Son, Huan Ren, Xin Liu, Zhe Zhao |
| 2026 | Coding Agents with Multimodal Browsing are Generalist Problem Solvers. | Aditya Bharat Soni, Boxuan Li, Xingyao Wang, Valerie Chen, Graham Neubig |
| 2026 | KNN-SSD: Enabling Dynamic Self-Speculative Decoding via Nearest Neighbor Layer Set Optimization. | Mingbo Song, Heming Xia, Jun Zhang, Chak Tou Leong, Qiancheng Xu, Wenjie Li, Sujian Li |
| 2026 | RoZO: Geometry-Aware Zeroth-Order Fine-Tuning on Low-Rank Adapters for Black-Box Large Language Models. | Zichen Song, Weijia Li |
| 2026 | Who Plays Which Role? Protagonist Detection and Classification in Moral Discourse. | Mirko Sommer, Maria Becker |
| 2026 | Thunder-NUBench: A Benchmark for LLMs' Sentence-Level Negation Understanding. | Yeonkyoung So, Gyuseong Lee, Sungmok Jung, Joonhak Lee, JiA Kang, Sangho Kim, Jaejin Lee |
| 2026 | MathMist: A Parallel Multilingual Benchmark Dataset for Mathematical Problem Solving and Reasoning. | Mahbub E. Sobhani, Md. Faiyaz Abdullah Sayeedi, Tasnim Mohiuddin, Md Mofijul Islam, Swakkhar Shatabda |
| 2026 | Do Multi-Agents Solve Better Than Single? Evaluating Agentic Frameworks for Diagram-Grounded Geometry Problem Solving and Reasoning. | Mahbub E. Sobhani, Md. Faiyaz Abdullah Sayeedi, Mohammad Nehad Alam, Proma Hossain Progga, Swakkhar Shatabda |
| 2026 | Evaluating Cost-Efficiency of LLMs in a RAG Setup on Polish Wikipedia: Quality vs. Energy Consumption. | Patrycja Smits, Tomasz Walkowiak |
| 2026 | DART: Leveraging Multi-Agent Disagreement for Tool Recruitment in Multimodal Reasoning. | Nithin Sivakumaran, Justin Chih-Yao Chen, David Wan, Yue Zhang, Jaehong Yoon, Elias Stengel-Eskin, Mohit Bansal |
| 2026 | Learning to Judge: LLMs Designing and Applying Evaluation Rubrics. | Clemencia Siro, Pourya Aliannejadi, Mohammad Aliannejadi |
| 2026 | Lost in Activations: A Neuron-level Analysis of Encoders for Cross-Lingual Emotion Detection. | Pranaydeep Singh, Orphe De Clercq, Els Lefever |
| 2026 | Nanda Family: Open-Weights Generative Large Language Models for Hindi. | Aaryamonvikram Singh, Debopriyo Banerjee, Dhruv Sahnan, Monojit Choudhury, Shivam Chauhan, Rocktim Jyoti Das, Xudong Han, Haonan Li, Alok Anil Jadhav, Utkarsh Agarwal, Mukund Choudhary, Fajri Koto, Junaid Bhat, Awantika Shukla, Samujjwal Ghosh, Samta Kamboj, Onkar Pandit, Lalit Pradhan, Rahul Pal, Sunil Kumar Sahu, Parvez Mullah, Ali El Filali, Zainul Abedien Ahmed Quraishi, Neha Sengupta, Gokul Ramakrishnan, Rituraj Joshi, Gurpreet Gosal, Avraham Sheinin, Natalia Vassilieva, Preslav Nakov |
| 2026 | When Words Wear Masks: Detecting Malicious Intents and Hostile Impacts of Online Hate Speech. | Priyansh Singhal, Piyush Joshi |
| 2026 | COMPACT: Building Compliance Paralegals via Clause Graph Reasoning over Contracts. | Ayush Singh, Dishank Aggarwal, Pranav Bhagat, Ainulla Khan, Sameer Malik, Amar Prakash Azad |
| 2026 | How effective are VLMs in assisting humans in inferring the quality of mental models from Multimodal short answers? | Pritam Sil, Durgaprasad Karnam, Vinay Reddy Venumuddala, Pushpak Bhattacharyya |
| 2026 | Logic Haystacks: Probing LLMs' Long-Context Logical Reasoning (Without Easily Identifiable Unrelated Padding). | Damien Sileo |
| 2026 | Shifting Perspectives: Steering Vectors for Robust Bias Mitigation in LLMs. | Zara Siddique, Irtaza Khalid, Liam D. Turner, Luis Espinosa Anke |