| 2025 | Small Changes, Large Consequences: Analyzing the Allocational Fairness of LLMs in Hiring Contexts. | Preethi Seshadri, Hongyu Chen, Sameer Singh, Seraphina Goldfarb-Tarrant |
| 2025 | Generalizing to Unseen Disaster Events: A Causal View. | Philipp Seeberger, Steffen Freisinger, Tobias Bocklet, Korbinian Riedhammer |
| 2025 | Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions. | Wesley Scivetti, Melissa Torgbi, Mollie Shichman, Taylor Pellegrin, Austin Blodgett, Claire Bonial, Harish Tayyar Madabushi |
| 2025 | RASTeR: Robust, Agentic, and Structured Temporal Reasoning. | Daniel Schumacher, Fatemeh Haji, Tara Grey, Niharika Bandlamudi, Nupoor Karnik, Gagana Uday Kumar, Cho-Yu Jason Chiang, Peyman Najafirad, Nishant Vishwamitra, Anthony Rios |
| 2025 | Differential Mamba. | Nadav Schneider, Itamar Zimerman, Eliya Nachmani |
| 2025 | PosterSum: A Multimodal Benchmark for Scientific Poster Summarization. | Rohit Saxena, Pasquale Minervini, Frank Keller |
| 2025 | Pragmatic Theories Enhance Understanding of Implied Meanings in LLMs. | Takuma Sato, Seiya Kawano, Koichiro Yoshino |
| 2025 | Can Language Models Handle a Non-Gregorian Calendar? The Case of the Japanese wareki. | Mutsumi Sasaki, Go Kamoda, Ryosuke Takahashi, Kosuke Sato, Kentaro Inui, Keisuke Sakaguchi, Benjamin Heinzerling |
| 2025 | Mitigating Label Length Bias in Large Language Models. | Mario Sanz-Guerrero, Katharina von der Wense |
| 2025 | GeoSAFE - A Novel Geospatial Artificial Intelligence Safety Assurance Framework and Evaluation for LLM Moderation. | Nihar Sanda, Rajat Shinde, Sumit Nawathe, William Seawright, Shaona Ghosh, Manil Maskey |
| 2025 | SEER: The Span-based Emotion Evidence Retrieval Benchmark. | Aneesha Sampath, Oya Aran, Emily Mower Provost |
| 2025 | Beyond statistical significance: Quantifying uncertainty and statistical variability in multilingual and multitask NLP evaluation. | Jonne Slev, Duygu Ataman, Constantine Lignos |
| 2025 | Are Relational Triple Extraction Frameworks Sufficient for Hyper-relational Facts ? | Pratik Saini, Chayan Sarkar, Tapas Nayak |
| 2025 | MINDS: A Cross-Cultural Dialogue Corpus for Social Norm Classification and Adherence Detection. | Pritish Sahu, Anirudh Som, Ajay Divakaran, Dimitra Vergyri |
| 2025 | Breaking Language Barriers or Reinforcing Bias? A Study of Gender and Racial Disparities in Multilingual Contrastive Vision Language Models. | Zahraa Al Sahili, Ioannis Patras, Matthew Purver |
| 2025 | Benchmarking Bangla Causality: A Dataset of Implicit and Explicit Causal Sentences and Cause-Effect Relations. | Diya Saha, Sudeshna Jana, Manjira Sinha, Tirthankar Dasgupta |
| 2025 | Large Language Models Encode Semantics and Alignment in Linearly Separable Representations. | Baturay Saglam, Paul Kassianik, Blaine Nelson, Sajana Weerawardhena, Yaron Singer, Amin Karbasi |
| 2025 | Learning a Continue-Thinking Token for Enhanced Test-Time Scaling. | Liran Ringel, Elad Tolochinsky, Yaniv Romano |
| 2025 | Native Design Bias: Studying the Impact of English Nativeness on Language Model Performance. | Manon Reusens, Philipp Borchert, Jochen De Weerdt, Bart Baesens |
| 2025 | How do we measure privacy in text? A survey of text anonymization metrics. | Yaxuan Ren, Krithika Ramesh, Yaxing Yao, Anjalie Field |
| 2025 | How Much is Too Much? Exploring LoRA Rank Trade-offs for Retaining Knowledge and Domain Robustness. | Darshita Rathore, Vineet Kumar, Chetna Bansal, Anindya Moitra |
| 2025 | Merging Two Grammar Worlds: Exploring the Relationship between Universal Dependencies and Signal Temporal Logic. | Christopher Rashidian, Sabine Brunswicker |
| 2025 | Reasoning Models Reason Well, Until They Don't. | Revanth Rameshkumar, Jimson Huang, Yunxin Sun, Fei Xia, Abulhair Saparov |
| 2025 | KERLQA: Knowledge-Enhanced Reinforcement Learning for Question Answering in Low-resource Languages. | Sello Ralethe, Jan Buys |
| 2025 | No Universal Prompt: Unifying Reasoning through Adaptive Prompting for Temporal Table Reasoning. | Abhishek Rajgaria, Kushagra Dixit, Mayank Vyas, Harshavardhan Kalalbandi, Dan Roth, Vivek Gupta |