| 2026 | Don't Judge a Book by its Cover: Testing LLMs' Robustness Under Logical Obfuscation. | Abhilekh Borah, Shubhra Ghosh, Kedar Joshi, Aditya Kumar Guru, Kripabandhu Ghosh |
| 2026 | Using a Human-AI Teaming Approach to Create and Curate Scientific Datasets with the SciLire System. | Necva Blc, Jessica Irons, Changhyun Lee, Brian Jin, Maciej Rybinski, Huichen Yang, Andreas Duenser, Stephen Wan |
| 2026 | Trainable, Multiword-aware Linguistic Tokenization Using Modern Neural Networks. | Clara Boesenberg, Kilian Evang |
| 2026 | Do language models accommodate their users? A study of linguistic convergence. | Terra Blevins, Susanne Sophie Schmalwieser, Benjamin Roth |
| 2026 | ELLA: Efficient Lifelong Learning for Adapters in Large Language Models. | Shristi Das Biswas, Yue Zhang, Anwesan Pal, Radhika Bhargava, Kaushik Roy |
| 2026 | Learning from Child-directed Speech in Two-language Scenarios: A French-English Case-Study. | Liel Binyamin, Elior Sulem |
| 2026 | VideoMind: Thinking in Steps for Long Video Understanding. | Shubhang Bhatnagar, Renxiong Wang, Kapil Krishnakumar, Adel Ahmadyan, Zhaojiang Lin, Lambert Mathias, Xin Luna Dong, Babak Damavandi, Narendra Ahuja, Seungwhan Moon |
| 2026 | Activation-Space Personality Steering: Hybrid Layer Selection for Stable Trait Control in LLMs. | Pranav Bhandari, Nicolas Fay, Sanjeevan Selvaganapathy, Amitava Datta, Usman Naseem, Mehwish Nasim |
| 2026 | PictureStories: Predicting the Task Adherence of Language Learner Answers to a Picture Story-Based Writing Task. | Marie Bexte, Andrew Caines, Diane Nicholls, Paula Buttery, Torsten Zesch |
| 2026 | A Multi-Task Learning Framework for Modeling Engagement and Topic-Sensitive Responses in Arabic Women's Discourse. | Mabrouka Bessghaier, Md. Rafiul Biswas, Shimaa Ibrahim, Wajdi Zaghouani |
| 2026 | Teaching Small Language Models to Learn Logic through Meta-Learning. | Leonardo Bertolazzi, Manuel Vargas Guzmn, Raffaella Bernardi, Maciej Malicki, Jakub Szymanik |
| 2026 | Is This LLM Library Learning? Evaluation Must Account For Compute and Behaviour. | Ian Berlot-Attwell, Tobias Sesterhenn, Frank Rudzicz, Xujie Si |
| 2026 | Beyond Names: How Grammatical Gender Markers Bias LLM-based Educational Recommendations. | Luca Benedetto, Antonia Donvito, Alberto Lucchetti, Andrea Cappelli, Paula Buttery |
| 2026 | Detecting Overflow in Compressed Token Representations for Retrieval-Augmented Generation. | Julia Belikova, Danila Rozhevskii, Dennis Svirin, Konstantin Polev, Alexander Panchenko |
| 2026 | Coupling Local Context and Global Semantic Prototypes via a Hierarchical Architecture for Rhetorical Roles Labeling. | Anas Belfathi, Nicolas Hernandez, Laura Monceaux, Warren Bonnard, Mary Catherine Lavissire, Christine Jacquin, Richard Dufour |
| 2026 | PEFT-Factory: Unified Parameter-Efficient Fine-Tuning of Autoregressive Large Language Models. | Rbert Belanec, Ivan Srba, Mria Bielikov |
| 2026 | PEFT-Bench: A Parameter-Efficient Fine-Tuning Methods Benchmark. | Rbert Belanec, Branislav Pecher, Ivan Srba, Mria Bielikov |
| 2026 | Jailbreaks as Inference-Time Alignment: A Framework for Understanding Safety Failures in LLMs. | James Beetham, Souradip Chakraborty, Mengdi Wang, Furong Huang, Amrit Singh Bedi, Mubarak Shah |
| 2026 | Token Pruning for Improving Graph-Generating State Space Model Performance. | Monish Beegamudre, Jack Zheng, Margaret Capetz |
| 2026 | Stay Focused: Problem Drift in Multi-Agent Debate. | Jonas Becker, Lars Benedikt Kaesberg, Andreas Stephan, Jan Philip Wahle, Terry Ruas, Bela Gipp |
| 2026 | StarFlow: Generating Structured Workflow Outputs From Sketch Images. | Patrice Bchard, Chao Wang, Amirhossein Abaskohi, Juan A. Rodrguez, Christopher Pal, David Vzquez, Spandana Gella, Sai Rajeswar, Perouz Taslakian |
| 2026 | QFrBLiMP: a Quebec-French Benchmark of Linguistic Minimal Pairs. | David Beauchemin, Pier-Luc Veilleux, Richard Khoury, Johanna-Pascale Roy |
| 2026 | Vision-Language Models Align with Human Neural Representations in Concept Processing. | Anna Bavaresco, Marianne de Heer Kloots, Sandro Pezzelle, Raquel Fernndez |
| 2026 | ReBPE: Iteratively Improving the Internal Structure of a Structured Tokeniser by Mining its Internal Structure. | Thomas Bauwens, Miryam de Lhoneux |
| 2026 | Hype or not? Formalizing Automatic Promotional Language Detection in Biomedical Research. | Bojan Batalo, Erica K. Shimomoto, Dipesh Satav, Neil Millar |