| 2026 | MultiCW: A Large-Scale Balanced Benchmark Dataset for Training Robust Check-Worthiness Detection Models. | Martin Hyben, Sebastian Kula, Jn Cegin, Jakub Simko, Ivan Srba, Rbert Mro |
| 2026 | Personality Editing for Language Models through Adjusting Self-Referential Queries. | Seojin Hwang, Yumin Kim, Byeongjeong Kim, Donghoon Shin, Hwanhee Lee |
| 2026 | Logits-Based Block Pruning with Affine Transformations for Large Language Models. | Zekun Hu, Yichu Xu, De-Chuan Zhan |
| 2026 | HateXScore: A Metric Suite for Evaluating Reasoning Quality in Hate Speech Explanations. | Yujia Hu, Roy Ka-Wei Lee |
| 2026 | Toward Safe and Human-Aligned Game Conversational Recommendation via Multi-Agent Decomposition. | Zheng Hui, Xiaokai Wei, Yexi Jiang, Kevin Gao, Chen Wang, Se-eun Yoon, Rachit Pareek, Michelle Gong |
| 2026 | HapticLLaMA: A Multimodal Sensory Language Model for Haptic Captioning. | Guimin Hu, Daniel Hershcovich, Hasti Seifi |
| 2026 | PATCH: Mitigating PII Leakage in Language Models with Privacy-Aware Targeted Circuit PatcHing. | Anthony Hughes, Vasisht Duddu, N. Asokan, Nikolaos Aletras, Ning Ma |
| 2026 | Contextual morphologically-guided tokenization for Latin encoder models. | Marisa Hudspeth, Patrick J. Burns, Brendan T. O'Connor |
| 2026 | Diffusion Language Model Inference with Monte Carlo Tree Search. | Zheng Huang, Kiran Ramnath, Yueyan Chen, Aosong Feng, Sangmin Woo, Balasubramaniam Srinivasan, Zhichao Xu, Kang Zhou, Shuai Wang, Haibo Ding, Lin Lee Cheong |
| 2026 | Tackling Distractor Documents in Multi-Hop QA with Reinforcement and Curriculum Learning. | Jerry Huang, Siddarth Madala, Risham Sidhu, Cheng Niu, Hao Peng, Julia Hockenmaier, Tong Zhang |
| 2026 | CSPB: Conversational Speech Processing Benchmark for Self-supervised Speech Models. | Zili Huang, Matthew Maciejewski, Leibny Paola Garca-Perera, Shinji Watanabe, Sanjeev Khudanpur |
| 2026 | Investigating the Multilingual Calibration Effects of Language Model Instruction Tuning. | Jerry Huang, Peng Lu, Qiuhao Zeng, Yusuke Iwasawa, Yutaka Matsuo, Sarath Chandar, Edison Marrese-Taylor, Irene Li |
| 2026 | How to Contextualize Empirical Data for Risk Analysis with LLMs: A Case Study of Power Outages. | Haiyun Huang, Yukun Li, Marco A. Pretell, Jacob Naroian, Ebadah Khan, Liping Liu |
| 2026 | OD-Stega: LLM-Based Relatively Secure Steganography via Optimized Distributions. | Yu-Shin Huang, Peter Just, Hanyun Yin, Krishna Narayanan, Ruihong Huang, Chao Tian |
| 2026 | Divide, Reweight, and Conquer: A Logit Arithmetic Approach for In-Context Learning. | Chengsong Huang, Langlin Huang, Jiaxin Huang |
| 2026 | MADIAVE: Multi-Agent Debate for Implicit Attribute Value Extraction. | Wei-Chieh Huang, Cornelia Caragea |
| 2026 | MathEDU: Feedback Generation on Problem-Solving Processes for Mathematical Learning Support. | Wei-Ling Hsu, Yu-Chien Tang, An-Zi Yen |
| 2026 | CHROMIC: Chronological Reasoning Across Multi-Panel Comics. | Bingxuan Hou, Jiayi Lin, Chenyang Zhang, Dapeng Yin, Shuyue Zhu, Qingqing Hong, Mengna Gao, Jun-li Wang |
| 2026 | FFE-Hallu: Hallucinations in Fixed Figurative Expressions: A Benchmark of Idioms and Proverbs in the Persian Language. | Faezeh Hosseini, Mohammadali Yousefzadeh, Yadollah Yaghoobzadeh |
| 2026 | The Mediomatix Corpus: Parallel Data for Romansh Language Varieties via Comparable Schoolbooks. | Zachary William Hopton, Jannis Vamvas, Andrin Bchler, Anna Rutkiewicz, Rico Cathomas, Rico Sennrich |
| 2026 | How Many Ratings per Item are Necessary for Reliable Significance Testing? | Christopher M. Homan, Flip Korn, Deepak Pandita, Chris Welty |
| 2026 | SoS: Analysis of Surface over Semantics in Multilingual Text-To-Image Generation. | Carolin Holtermann, Florian Schneider, Anne Lauscher |
| 2026 | TempViz: On the Evaluation of Temporal Knowledge in Text-to-Image Models. | Carolin Holtermann, Nina Krebs, Anne Lauscher |
| 2026 | MAPS: A Multilingual Benchmark for Agent Performance and Security. | Omer Hofman, Jonathan Brokman, Oren Rachmil, Shamik Bose, Vikas Pahuja, Toshiya Shimizu, Trisha Starostina, Kelly Marchisio, Seraphina Goldfarb-Tarrant, Roman Vainshtein |
| 2026 | SpARK: An Embarrassingly Simple Sparse Watermarking in LLMs with Enhanced Text Quality. | Duy C. Hoang, Hung T. Q. Le, Rui Chu, Ping Li, Weijie Zhao, Yingjie Lao, Khoa D. Doan |