| 2026 | Large Language Models' Internal Perception of Symbolic Music. | Andrew Shin, Kunitake Kaneko |
| 2026 | J-ClinicalBench: A Benchmark for Evaluating Large Language Models on Practical Clinical Tasks in Japanese. | Seiji Shimizu, Tomohiro Nishiyama, H. I S. A D. A Shohei, Himi Yamato, Shoko Wakamiya, Yuki Yanagisawa, Masami Tsuchiya, Satoko Hori, Eiji Aramaki |
| 2026 | STAR-IL: A Dataset for Style-Aware Machine Translation of Product Reviews in Indian Languages. | Ketaki Shetye, Dipti Misra Sharma, Parameswari Krishnamurthy |
| 2026 | AraHopeCorpus: Annotation Guidelines and Dataset for Hope Speech in Arabic Social Media Crisis Discourse. | Esra'a Ahmad Sharqawi, Wajdi Zaghouani |
| 2026 | Task-Lens: Cross-Task Utility Based Speech Dataset Profiling for Low-Resource Indian Languages. | Swati Sharma, Divya V. Sharma, Anubha Gupta |
| 2026 | Once upon a Kernel: Extracting Important Events from Narratives. | Anshu Kiran Sharma, Miguel Castiblanco-Melendez, Alejandro Morales, Mark A Finlayson |
| 2026 | Towards Consistent Detection of Cognitive Distortions: LLM-Based Annotation and Dataset-Agnostic Evaluation. | Neha Sharma, Navneet Agarwal, Kairit Sirts |
| 2026 | The Sensorimotor Norms for the Chinese Classifiers. | Yimei Shao, Yu-Yin Hsu, Chu-Ren Huang |
| 2026 | Scripting History: A Diachronic Urdu Text and Image Corpus from the 18Th to 19Th Centuries. | Sana Shams, Sahar Rauf, Asad Mustafa, Muhammad Zeeshan Javed, Qurat ul Ain Akram, Sarmad Hussain, Miriam Butt |
| 2026 | PersianAnonymizer: Evaluating LLM-Labeled Training for Efficient NER-based Anonymization in Persian. | Mohammad Hossein Shalchian, Mostafa Amiri, Amir Mahdi Sadeghzadeh |
| 2026 | A Benchmark Dataset and Comparative Evaluation of Phonemized and Romanized Urdu for Text-to-Speech. | M. Kaab Bin Shahid, Muhammed Izharuddin |
| 2026 | Biases in Translation: Assessing Opinion Distortion in Machine Translated Texts. | Nazanin Shafiabadi, Franois Yvon |
| 2026 | Decomposing Sign Language Movements: A Multi-Band Visualization Method for Articulatory Analysis. | Antonio F. G. Sevilla, Jos Mara Lahoz-Bengoechea |
| 2026 | S-GRADES - Studying Generalization of Student Response Assessments in Diverse Evaluative Settings. | Tasfia Seuti, Sagnik Ray Choudhury |
| 2026 | A Scalable Pipeline for Novelty Detection in Skill Extraction Using Large Language Models. | Gian Seifert, Simon Clematide |
| 2026 | MuSaG: A Multimodal German Sarcasm Dataset with Full-Modal Annotations. | Aaron Robert Scott, Maike Zfle, Jan Niehues |
| 2026 | A Sociophonetic Analysis of Racial Bias in Commercial ASR Systems Using the Pacific Northwest English Corpus. | Michael Scott, Siyu Liang, Alicia Beckford Wassink, Gina-Anne Levow |
| 2026 | Dialectal Filtering: Synthesizing Kurdish Corpora for Low-Resource Varieties by Utilizing "Noise" in Large Textual Data. | Christian Schuler, Raman Ahmad, Anrn Wng, Daniil Gurgurov, Timo Baumann, Simon Ostermann, Josef van Genabith |
| 2026 | Is This Idea Novel? An Automated Benchmark for Judgment of Research Ideas. | Tim Schopf, Michael Frber |
| 2026 | CorSpell: Introducing a Semiautomatic Tool for Spelling Normalization in Brazilian Portuguese. | Juliana Schoffen, Dennis Giovani Balreira, Elisa Marchioro Stumpf, Larissa Goulart, Tanara Zingano Kuhn, Rafael Oleques Nunes, Gabriel Ricci Pazzinato, Isadora Dahmer Hanauer, Jos Henrique de Souza Silva, Luiza Sarmento Divino, Marine Matte |
| 2026 | DAMETA: An LLM Benchmark for Danish Metaphor Interpretation with Systematically Varied Distractors. | Nina Skovgaard Schneidermann, Sanni Nimb, Nathalie Carmen Hau Norman, Sussi Olsen, Bolette Pedersen |
| 2026 | HalleluBERT: Let Every Token That Has Meaning Bear Its Weight. | Raphael Schmitt |
| 2026 | HotelCheckSpan: A Benchmark Dataset for LLM Faithfulness. | Patricia Schmidtov, Ondrej Dusek, Saad Mahamood |
| 2026 | GePaDeSE: A New Resource for Clause-Level Aspect in German Parliamentary Debates. | Julian Schlenker, Ines Rehbein, Lilly Brauner, Florian Ertz, Ines Reinig, Simone Paolo Ponzetto |
| 2026 | FormosanMT: A Multilingual Parallel Corpus of the Formosan Language Family. | Hunter Scheppat, Joshua K. Hartshorne, Sema Ko, ric Le Ferrand, Emily Prud'hommeaux |