| 2025 | LiTEx: A Linguistic Taxonomy of Explanations for Understanding Within-Label Variation in Natural Language Inference. | Pingjun Hong, Beiduo Chen, Siyao Peng, Marie-Catherine de Marneffe, Barbara Plank |
| 2025 | NormGenesis: Multicultural Dialogue Generation via Exemplar-Guided Social Norm Modeling and Violation Recovery. | Minki Hong, Jangho Choi, Jihie Kim |
| 2025 | Measuring Sycophancy of Language Models in Multi-turn Dialogues. | Jiseung Hong, Grace Byun, Seungone Kim, Kai Shu |
| 2025 | Distilling Many-Shot In-Context Learning into a Cheat Sheet. | Ukyo Honda, Soichiro Murakami, Peinan Zhang |
| 2025 | Will Annotators Disagree? Identifying Subjectivity in Value-Laden Arguments. | Amir Homayounirad, Enrico Liscio, Tong Wang, Catholijn M. Jonker, Luciano Cavalcante Siebert |
| 2025 | Table-Text Alignment: Explaining Claim Verification Against Tables in Scientific Papers. | Xanh Ho, Sunisth Kumar, Yun-Ang Wu, Florian Boudin, Atsuhiro Takasu, Akiko Aizawa |
| 2025 | Improving Neutral Point-of-View Generation with Data- and Parameter-Efficient RL. | Jessica Hoffmann, Christiane Ahlheim, Zac Yu, Aria Walfrand, Jarvis Jin, Marie Tano, Ahmad Beirami, Erin MacMurray van Liemt, Nithum Thain, Hakim Sidahmed, Lucas Dixon |
| 2025 | Evaluating Taxonomy Free Character Role Labeling (TF-CRL) in News Stories using Large Language Models. | David G. Hobson, Derek Ruths, Andrew Piper |
| 2025 | Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters. | Tatsuya Hiraoka, Kentaro Inui |
| 2025 | Comprehensive Evaluation on Lexical Normalization: Boundary-Aware Approaches for Unsegmented Languages. | Shohei Higashiyama, Masao Utiyama |
| 2025 | MaGiX: A Multi-Granular Adaptive Graph Intelligence Framework for Enhancing Cross-Lingual RAG. | Nguyen Manh Hieu, Vu Lam Anh, Hung Pham Van, Nam Le Hai, Ngo Van Linh, Nguyen Thi Ngoc Diep, Thien Huu Nguyen |
| 2025 | Social Bias Evaluation for Large Language Models Requires Prompt Variations. | Rem Hida, Masahiro Kaneko, Naoaki Okazaki |
| 2025 | Minimal, Local, and Robust: Embedding-Only Edits for Implicit Bias in T2I Models. | Feng He, Chao Zhang, Zhixue Zhao |
| 2025 | ESGenius: Benchmarking LLMs on Environmental, Social, and Governance (ESG) and Sustainability Knowledge. | Chaoyue He, Xin Zhou, Yi Wu, Xinjia Yu, Yan Zhang, Lei Zhang, Di Wang, Shengfei Lyu, Hong Xu, Xiaoqiao Wang, Wei Liu, Chunyan Miao |
| 2025 | Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law. | Yanjin He, Qingkai Zeng, Meng Jiang |
| 2025 | pFedRAG: A Personalized Federated Retrieval-Augmented Generation System with Depth-Adaptive Tiered Embedding Tuning. | Hangyu He, Xin Yuan, Kai Wu, Ren Ping Liu, Wei Ni |
| 2025 | Distill Visual Chart Reasoning Ability from LLMs to MLLMs. | Wei He, Zhiheng Xi, Wanxu Zhao, Xiaoran Fan, Yiwen Ding, Zifei Shan, Tao Gui, Qi Zhang, Xuanjing Huang |
| 2025 | FuzzAug: Data Augmentation by Coverage-guided Fuzzing for Neural Test Generation. | Yifeng He, Jicheng Wang, Yuyang Rong, Hao Chen |
| 2025 | Layer-wise Minimal Pair Probing Reveals Contextual Grammatical-Conceptual Hierarchy in Speech Representations. | Linyang He, Qiaolin Wang, Xilin Jiang, Nima Mesgarani |
| 2025 | ROBOTO2: An Interactive System and Dataset for LLM-assisted Clinical Trial Risk of Bias Assessment. | Anthony Hevia, Sanjana Shivani Chintalapati, Veronica Ka Wai Lai, Thanh Tam Nguyen, Wai-Tat Wong, Terry Klassen, Lucy Lu Wang |
| 2025 | Seeing Through Words, Speaking Through Pixels: Deep Representational Alignment Between Vision and Language Models. | Zoe Wanying He, Sean Trott, Meenakshi Khosla |
| 2025 | Biology-Instructions: A Dataset and Benchmark for Multi-Omics Sequence Understanding Capability of Large Language Models. | Haonan He, Yuchen Ren, Yining Tang, Ziyang Xu, Junxian Li, Minghao Yang, Di Zhang, Dong Yuan, Tao Chen, Shufei Zhang, Yuqiang Li, Nanqing Dong, Wanli Ouyang, Dongzhan Zhou, Peng Ye |
| 2025 | Beyond Correctness: Confidence-Aware Reward Modeling for Enhancing Large Language Model Reasoning. | Qianxi He, Qingyu Ren, Shanzhe Lei, Xuhong Wang, Yingchun Wang |
| 2025 | LogicTree: Structured Proof Exploration for Coherent and Rigorous Logical Reasoning with Large Language Models. | Kang He, Kaushik Roy |
| 2025 | ECC: An Emotion-Cause Conversation Dataset for Empathy Response. | Yuanyuan He, Yongsen Pan, Wei Li, Jiali You, Jiawen Deng, Fuji Ren |