| 2026 | Learning Shortcut Models for Efficient Recursive Reasoning. | Shiv Shankar |
| 2026 | Resource-Limited Joint Multimodal Sentiment Reasoning and Classification via Chain-of-Thought Enhancement and Distillation. | Haonan Shangguan, Xiaocui Yang, Shi Feng, Daling Wang, Yifei Zhang, Feiliang Ren, Ge Yu |
| 2026 | GROKE: Vision-Free Navigation Instruction Evaluation via Graph Reasoning on OpenStreetMap. | Farzad Shami, Subhrasankha Dey, Nico Van de Weghe, Henrikki Tenkanen |
| 2026 | MEAV: Model Editing with Alignment Vectors for inference time LLM alignment in single and multidomain preference spectrum. | Sadat Shahriar, Zheng Qi, Nikolaos Pappas, Srikanth Doss, Kishaloy Halder, Monica Sunkara, Manuel Mager, Yassine Benajiba |
| 2026 | Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models. | Arya Shah, Deepali Mishra, Chaklam Silpasuwanchai |
| 2026 | ROSCO-Omni: Multimodal LLM-Based Communication Understanding for Non- and Minimally-Speaking Autistic Individuals. | Siddhant Bikram Shah, Kristina T. Johnson |
| 2026 | PII-VisBench: Evaluating Personally Identifiable Information Safety in Vision Language Models Along a Continuum of Visibility. | G. M. Shahariar, Zabir Al Nazi, Md. Olid Hasan Bhuiyan, Zhouxing Shi |
| 2026 | BiMol-Diff: A Unified Diffusion Framework for Molecular Generation and Captioning. | Aditya Hemant Shahane, Anuj Kumar Sirohi, Devansh Arora, Nitin Kumar, Prathosh AP, Sandeep Kumar |
| 2026 | Constructing Interpretable Features from Compositional Neuron Groups. | Or David Shafran, Atticus Geiger, Mor Geva |
| 2026 | Propaganda Signals in LLMs: Perspectival Divergence and Narrative Framing in the Russia-Ukraine War. | Ofir Shabat, Ido Guy, Kira Radinsky |
| 2026 | SecureGate: Learning When to Reveal PII Safely via Token-Gated Dual-Adapters for Federated LLMs. | Mohamed Shaaban, Mohamed Elmahallawy |
| 2026 | Lost in Simulation: LLM-Simulated Users are Unreliable Proxies for Human Users in Agentic Evaluations. | Preethi Seshadri, Samuel Cahyawijaya, Ayomide Odumakinde, Sameer Singh, Seraphina Goldfarb-Tarrant |
| 2026 | OpenExempt: A Diagnostic Benchmark for Legal Reasoning and a Framework for Creating Custom Benchmarks on Demand. | Sergio Servantez, Sarah B. Lawsky, Rajiv Jain, Daniel W. Linna Jr., Kristian J. Hammond |
| 2026 | Behavior-Aware Item Modeling via Dynamic Procedural Solution Representations for Knowledge Tracing. | Jun Seo, Sangwon Ryu, Heejin Do, Hyounghun Kim, Gary Lee |
| 2026 | Emotion-Wheel-Guided Audio-Referred Text Representation for Multimodal Emotion Recognition in Conversation. | Eunseon Seong, Harim Lee, Dahye Kim, Changhyun Kim, Dong-Kyu Chae |
| 2026 | SPIO: Ensemble and Selective Strategies via LLM-Based Multi-Agent Planning in Automated Data Science. | Wonduk Seo, Juhyeon Lee, Yanjun Shao, Qingshan Zhou, Seunghyun Lee, Yi Bu |
| 2026 | ADVICE: Answer-Dependent Verbalized Confidence Estimation. | Ki Jung Seo, Sehun Lim, Taeuk Kim |
| 2026 | P-Check: Advancing Personalized Reward Model via Learning to Generate Dynamic Checklist. | Kwangwook Seo, Dongha Lee |
| 2026 | Automated Creativity Evaluation of Language Models Across Open-Ended Tasks. | Tan Min Sen, Zachary Choy Kit Chun, Syed Ali Redha Alsagoff, Nadya Yuki Wangsajaya, Mohor Banerjee, Swaagat Bikash Saikia, Alvin Chan Guo Chan |
| 2026 | Confident, Calibrated, or Complicit: Safety Alignment and Ideological Bias in LLM Hate Speech Detection. | Sanjeevan Selvaganapathy, Mehwish Nasim |
| 2026 | Mitigating Tokenization-Induced Distance Distortion in Long-Context Multilingual Machine Translation. | Khotso Selialia, Antoine Nzeyimana, Fatima M. Anwar |
| 2026 | Evolutionary Search for Automated Design of Uncertainty Quantification Methods. | Mikhail Seleznyov, Daniil Korbut, Viktor Moskvoretskii, Oleg Somov, Alexander Panchenko, Elena Tutubalina |
| 2026 | A2O: LLM-based Agentic Learning of Action-to-Object Features for Video Action Recognition. | Taiki Sekii, Fumiaki Sato |
| 2026 | Measuring Distribution Shift in User Prompts and Its Effects on LLM Performance. | Parker Seegmiller, Sarah Masud Preum |
| 2026 | How Much Would a Clinician Edit This Draft? Evaluating LLM Alignment for Patient Message Response Drafting. | Parker Seegmiller, Joseph Gatto, Sarah E. Greer, Ganza Belise Isingizwe, Rohan Ray, Timothy E. Burdick, Sarah Masud Preum |