| 2026 | LFQA-HP-1M: A Large-Scale Human Preference Dataset for Long-Form Question Answering. | Rafid Ishrak Jahan, Fahmid Shahriar Iqbal, Sagnik Ray Choudhury |
| 2026 | Towards Reliable Evaluation of Emotional Text Generation in LLMs: Human vs. Automatic Metrics. | Sadegh Jafari, Els Lefever, Vronique Hoste |
| 2026 | BLooP: Zero-Shot Abstractive Summarization Using Large Language Models with Bigram Lookahead Promotion. | Varun Iyer, Cornelia Caragea |
| 2026 | Comparing Reading Behavior across Reader Expertise and Text Complexity: Insights from the French Eye-Tracking Corpus (FETA). | Oksana Ivchenko, Natalia Grabar |
| 2026 | Evaluation of Co-Speech Gesture Tracking Techniques in Naturalistic Interactions. | Victoria Ivanova, Naomi Harte |
| 2026 | NAIST LIFE STORY: A Seven-Year Crowdsourced Dataset of Japanese Emotion-related Episodes. | Kazuhiro Ito, Junko Hayashi, Hiroyuki Nagai, Shoko Wakamiya, Eiji Aramaki |
| 2026 | LIT-RAGBench: Benchmarking Generator Capabilities of Large Language Models in Retrieval-Augmented Generation. | Koki Itai, Shunichi Hasegawa, Yuta Yamamoto, Gouki Minegishi, Masaki Otsuki |
| 2026 | Coordinate Structure Extraction for Patent Claims Using Multilingual LLMs. | Tsukasa Ishimaru, Takehito Utsuro, Masaaki Nagata |
| 2026 | TARAZ: Persian Short-Answer Question Benchmark for Cultural Evaluation of Language Models. | Reihaneh Iranmanesh, Saeedeh Davoudi, Pasha Abrishamchian, Ophir Frieder, Nazli Goharian |
| 2026 | A Resource and Evaluation Method for Phonological Continuity in Japanese Sign Language. | Jundai Inoue, Daisuke Hara, Makoto Miwa |
| 2026 | Phrase-Level Segmentation on Medieval Corpora for Aligning Multilingual Texts. | Lucence Ing, Matthias Gille Levenson, Carolina Macedo |
| 2026 | A Parallel Corpus of the Parable of the Prodigal Son: Building a Resource for Documenting Language Varieties in Mainland France. | Lucence Ing, Juliette Janes, Sven Kdel, Benot Sagot |
| 2026 | Who Benchmarks the Benchmarks? A Case Study of LLM Evaluation in Icelandic. | Finnur gst Ingimundarson, Steinunn Rut Fririksdttir, Bjarki rmannsson, Iris Edda Nowenstein, Steinr Steingrmsson |
| 2026 | VDAct 2.0: Scaling Video-Grounded Dialogue for Event-driven Activity Understanding with LLM-Assisted Filtering. | Wiradee Imrattanatrai, Masaki Asada, Kimihiro Hasegawa, Ken Fukuda, Teruko Mitamura |
| 2026 | How Pragmatics Shape Articulation: A Computational Case Study in STEM ASL Discourse. | Saki Imai, Lee Kezar, Laurel Aichler, Mert Inan, Erin Walker, Alicia Wooten, Lorna Cobban Quandt, Malihe Alikhani |
| 2026 | Reasoning over Object Descriptions Improves Coreference Resolution in Task-Based Dialogue Systems. | Oier Ijurco, Oier Lopez de Lacalle |
| 2026 | Multilingual Structured Sentiment Analysis for Environmental Sustainability. | Muhammad Okky Ibrohim, Tommaso Caselli, Cristina Bosco, Valerio Basile |
| 2026 | PRIVaThe: An Annotated Dataset of Multi-Objectives Web Search Sessions. | Claire Ibarboure, Ludovic Tanguy, Franck Amadieu, Josiane Mothe |
| 2026 | Distribution-aware Low-bitwidth Quantization for Large Language Models. | Bao Tan Duy Huynh, Takashi Tsunakawa, Masafumi Nishida |
| 2026 | How Long Does a Quick Kiss Take? Studying Event Duration of Light Verb Constructions Using Explicit Word Embeddings. | Lin de Huybrecht, Geraint A. Wiggins |
| 2026 | Multilingual, Multimodal Pipeline for Creating Authentic and Structured Fact-Checked Claim Dataset. | Zehra Melce Hsnbeyi, Virginie Mouilleron, Leonie Uhling, Daniel Foppe, Tatjana Scheffler, Djam Seddah |
| 2026 | RespondeoQA: A Benchmark for Bilingual Latin-English Question Answering. | Marisa Hudspeth, Patrick J. Burns, Brendan T. O'Connor |
| 2026 | Harnessing Synergy in Context and Emoji for Joint Detection of Harmful Online Content in Multi-turn Conversations. | Feiyan Hu, Ciara Anne Byrne, Jiang Zhou, Rena Maycock, Mark Langan |
| 2026 | From Variance to Invariance: Qualitative Content Analysis for Narrative Graph Annotation. | Junbo Huang, Max Weinig, Ulrich Fritsche, Ricardo Usbeck |
| 2026 | Efficient Financial Language Understanding via Distillation with Synthetic Data. | Wen-Fong Xavier Huang, Edwin Simpson |