| 2025 | Can LLMs Judge Debates? Evaluating Non-Linear Reasoning via Argumentation Theory Semantics. | Reza Sanayei, Srdjan Vesic, Eduardo Blanco, Mihai Surdeanu |
| 2025 | Are Language Models Consequentialist or Deontological Moral Reasoners? | Keenan Samway, Max Kleiman-Weiner, David Guzman Piedrahita, Rada Mihalcea, Bernhard Schlkopf, Zhijing Jin |
| 2025 | PersonaGym: Evaluating Persona Agents and LLMs. | Vinay Samuel, Henry Peng Zou, Yue Zhou, Shreyas Chaudhari, Ashwin Kalyan, Tanmay Rajpurohit, Ameet Deshpande, Karthik R. Narasimhan, Vishvak Murahari |
| 2025 | CIE: Controlling Language Model Text Generations Using Continuous Signals. | Vinay Samuel, Harshita Diddee, Yiming Zhang, Daphne Ippolito |
| 2025 | Benchmarking LLMs on Semantic Overlap Summarization. | John Salvador, Naman Bansal, Mousumi Akter, Souvika Sarkar, Anupam Das, Shubhra Kanti Karmaker |
| 2025 | Navigating the Unknown: Intent Classification and Out-of-Distribution Detection Using Large Language Models. | Yusuf Sali, Sitki Can Toraman |
| 2025 | MedCOD: Enhancing English-to-Spanish Medical Translation of Large Language Models Using Enriched Chain-of-Dictionary Framework. | Md. Shahidul Salim, Lian Fu, Arav Adikesh Ramakrishnan, Zonghai Yao, Hong Yu |
| 2025 | LaMP-QA: A Benchmark for Personalized Long-form Question Answering. | Alireza Salemi, Hamed Zamani |
| 2025 | ChartGaze: Enhancing Chart Understanding in LVLMs with Eye-Tracking Guided Attention Refinement. | Ali Salamatian, Amirhossein Abaskohi, Wan-Cyuan Fan, Mir Rayat Imtiaz Hossain, Leonid Sigal, Giuseppe Carenini |
| 2025 | MemInsight: Autonomous Memory Augmentation for LLM Agents. | Rana Salama, Jason Cai, Michelle Yuan, Anna Currey, Monica Sunkara, Yi Zhang, Yassine Benajiba |
| 2025 | Combining Constrained and Unconstrained Decoding via Boosting: BoostCD and Its Application to Information Extraction. | Marija Sakota, Robert West |
| 2025 | Instructing Large Language Models for Low-Resource Languages: A Systematic Study for Basque. | Oscar Sainz, Naiara Prez, Julen Etxaniz, Joseba Fernandez de Landa, Itziar Aldabe, Iker Garca-Ferrero, Aimar Zabala, Ekhi Azurmendi, German Rigau, Eneko Agirre, Mikel Artetxe, Aitor Soroa |
| 2025 | Anatomy of a Feeling: Narrating Embodied Emotions via Large Vision-Language Models. | Mohammad Saim, Phan Anh Duong, Cat Luong, Aniket Bhanderi, Tianyu Jiang |
| 2025 | DIWALI - Diversity and Inclusivity aWare cuLture specific Items for India: Dataset and Assessment of LLMs for Cultural Text Adaptation in Indian Context. | Pramit Sahoo, Maharaj Brahma, Maunendra Sankar Desarkar |
| 2025 | FairCoT: Enhancing Fairness in Text-to-Image Generation via Chain of Thought Reasoning with Multimodal Large Language Models. | Zahraa Al Sahili, Ioannis Patras, Matthew Purver |
| 2025 | Side Effects of Erasing Concepts from Diffusion Models. | Shaswati Saha, Sourajit Saha, Manas Gaur, Tejas Gokhale |
| 2025 | sudoLLM: On Multi-role Alignment of Language Models. | Soumadeep Saha, Akshay Chaturvedi, Joy Mahapatra, Utpal Garain |
| 2025 | A Survey of Cognitive Distortion Detection and Classification in NLP. | Archie Sage, Jeroen Keppens, Helen Yannakoudakis |
| 2025 | Beyond Hate Speech: NLP's Challenges and Opportunities in Uncovering Dehumanizing Language. | Hamidreza Saffari, Mohammadamin Shafiei, Hezhao Zhang, Lasana T. Harris, Nafise Sadat Moosavi |
| 2025 | Evaluating NL2SQL via SQL2NL. | Mohammadtaher Safarzadeh, Afshin Oroojlooy, Dan Roth |
| 2025 | Beyond Content: How Grammatical Gender Shapes Visual Representation in Text-to-Image Models. | Muhammed Saeed, Shaina Raza, Ashmal Vayani, Muhammad Abdul-Mageed, Ali Emami, Shady Shehata |
| 2025 | Lemmatization as a Classification Task: Results from Arabic across Multiple Genres. | Mostafa Saeed, Nizar Habash |
| 2025 | We Politely Insist: Your LLM Must Learn the Persian Art of Taarof. | Nikta Gohari Sadr, Sahar Heidariasl, Karine Megerdoomian, Laleh Seyyed-Kalantari, Ali Emami |
| 2025 | SQUiD: Synthesizing Relational Databases from Unstructured Text. | Mushtari Sadia, Zhenning Yang, Yunming Xiao, Ang Chen, Amrita Roy Chowdhury |
| 2025 | VestaBench: An Embodied Benchmark for Safe Long-Horizon Planning Under Multi-Constraint and Adversarial Settings. | Tanmana Sadhu, Yanan Chen, Ali Pesaranghader |