| 2025 | CaseSumm: A Large-Scale Dataset for Long-Context Summarization from U.S. Supreme Court Opinions. | Mourad Heddaya, Kyle MacMillan, Hongyuan Mei, Chenhao Tan, Anup Malani |
| 2025 | HMT: Hierarchical Memory Transformer for Efficient Long Context Language Processing. | Zifan He, Yingqi Cao, Zongyue Qin, Neha Prakriya, Yizhou Sun, Jason Cong |
| 2025 | Measuring memorization in language models via probabilistic extraction. | Jamie Hayes, Marika Swanberg, Harsh Chaudhari, Itay Yona, Ilia Shumailov, Milad Nasr, Christopher A. Choquette-Choo, Katherine Lee, A. Feder Cooper |
| 2025 | Subasa - Adapting Language Models for Low-resourced Offensive Language Detection in Sinhala. | Shanilka Haturusinghe, Tharindu Cyril Weerasooriya, Christopher M. Homan, Marcos Zampieri, Sidath Ravindra Liyanage |
| 2025 | Efficient Nearest Neighbor based Uncertainty Estimation for Natural Language Processing Tasks. | Wataru Hashimoto, Hidetaka Kamigaito, Taro Watanabe |
| 2025 | ProMQA: Question Answering Dataset for Multimodal Procedural Activity Understanding. | Kimihiro Hasegawa, Wiradee Imrattanatrai, Zhi-Qi Cheng, Masaki Asada, Susan Holm, Yuran Wang, Ken Fukuda, Teruko Mitamura |
| 2025 | "All that Glitters": Techniques for Evaluations with Unreliable Model and Human Annotations. | Michael Hardy |
| 2025 | Soft Syntactic Reinforcement for Neural Event Extraction. | Anran Hao, Jian Su, Shuo Sun, Teo Yong Sen |
| 2025 | Large Language Models Can Solve Real-World Planning Rigorously with Formal Verification Tools. | Yilun Hao, Yongchao Chen, Yang Zhang, Chuchu Fan |
| 2025 | AMR-RE: Abstract Meaning Representations for Retrieval-Based In-Context Learning in Relation Extraction. | Peitao Han, Lis Pereira, Fei Cheng, Wan-Jou She, Eiji Aramaki |
| 2025 | Incremental Sentence Processing Mechanisms in Autoregressive Transformer Language Models. | Michael Hanna, Aaron Mueller |
| 2025 | Generating Complex Question Decompositions in the Face of Distribution Shifts. | Kelvin Han, Claire Gardent |
| 2025 | Concept-Reversed Winograd Schema Challenge: Evaluating and Improving Robust Reasoning in Large Language Models via Abstraction. | Kaiqiao Han, Tianqing Fang, Zhaowei Wang, Yangqiu Song, Mark Steedman |
| 2025 | SLIM: Let LLM Learn More and Forget Less with Soft LoRA and Identity Mixture. | Jiayi Han, Liang Du, Hongwei Du, Xiangguo Zhou, Yiwen Wu, Yuanfang Zhang, Weibo Zheng, Donghong Han |
| 2025 | PREMISE: Matching-based Prediction for Accurate Review Recommendation. | Wei Han, Hui Chen, Soujanya Poria |
| 2025 | Beyond Literal Token Overlap: Token Alignability for Multilinguality. | Katharina Hmmerl, Tomasz Limisiewicz, Jindrich Libovick, Alexander Fraser |
| 2025 | A Grounded Typology of Word Classes. | Coleman Haley, Sharon Goldwater, Edoardo M. Ponti |
| 2025 | KODIS: A Multicultural Dispute Resolution Dialogue Corpus. | James Hale, Sushrita Rakshit, Kushal Chawla, Jeanne M. Brett, Jonathan Gratch |
| 2025 | kNN Retrieval for Simple and Effective Zero-Shot Multi-speaker Text-to-Speech. | Karl El Hajal, Ajinkya Kulkarni, Enno Hermann, Mathew Magimai-Doss |
| 2025 | On the Impacts of Contexts on Repository-Level Code Generation. | Nam Le Hai, Dung Manh Nguyen, Nghi D. Q. Bui |
| 2025 | BanTH: A Multi-label Hate Speech Detection Dataset for Transliterated Bangla. | Fabiha Haider, Fariha Tanjim Shifat, Md Farhan Ishmam, Md Sakib Ul Rahman Sourove, Deeparghya Dutta Barua, Md Fahim, Farhad Alam Bhuiyan |
| 2025 | TCProF:Time-Complexity Prediction SSL Framework. | Joonghyuk Hahn, Hyeseon Ahn, Jungin Kim, Soohan Lim, Yo-Sub Han |
| 2025 | SANDWiCH: Semantical Analysis of Neighbours for Disambiguating Words in Context ad Hoc. | Daniel Guzman-Olivares, Lara Quijano Snchez, Federico Liberatore |
| 2025 | Personalized Help for Optimizing Low-Skilled Users' Strategy. | Feng Gu, Wichayaporn Wongkamjan, Jordan Lee Boyd-Graber, Jonathan K. Kummerfeld, Denis Peskoff, Jonathan May |
| 2025 | OLMES: A Standard for Language Model Evaluations. | Yuling Gu, Oyvind Tafjord, Bailey Kuehl, Dany Haddad, Jesse Dodge, Hannaneh Hajishirzi |