| 2025 | Attributes as Textual Genes: Leveraging LLMs as Genetic Algorithm Simulators for Conditional Synthetic Data Generation. | Guangzeng Han, Weisi Liu, Xiaolei Huang |
| 2025 | InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning. | Xiaotian Han, Yiren Jian, Xuefeng Hu, Haogeng Liu, Yiqi Wang, Qihang Fan, Yuang Ai, Huaibo Huang, Ran He, Zhenheng Yang, Quanzeng You |
| 2025 | TrojanWave: Exploiting Prompt Learning for Stealthy Backdoor Attacks on Large Audio-Language Models. | Asif Hanif, Maha Tufail Agro, Fahad Shamshad, Karthik Nandakumar |
| 2025 | No Black Boxes: Interpretable and Interactable Predictive Healthcare with Knowledge-Enhanced Agentic Causal Discovery. | Xiaoxue Han, Pengfei Hu, Chang Lu, Jun-En Ding, Feng Liu, Yue Ning |
| 2025 | Rule Discovery for Natural Language Inference Data Generation Using Out-of-Distribution Detection. | Juyoung Han, Hyunsun Hwang, Changki Lee |
| 2025 | From Understanding to Generation: An Efficient Shortcut for Evaluating Language Models. | Viktor Hangya, Fabian Kch, Darina Gold |
| 2025 | VerifiAgent: a Unified Verification Agent in Language Model Reasoning. | Jiuzhou Han, Wray L. Buntine, Ehsan Shareghi |
| 2025 | Simple Factuality Probes Detect Hallucinations in Long-Form Natural Language Generation. | Jiatong Han, Neil Band, Muhammed Razzak, Jannik Kossen, Tim G. J. Rudner, Yarin Gal |
| 2025 | Identifying Noise in Human-Created Datasets using Training Dynamics from Generative Models. | Maeda F. Hanafi, Ishan Jindal, Yannis Katsis, Lucian Popa, Huaiyu Zhu |
| 2025 | R-BPE: Improving BPE-Tokenizers with Token Reuse. | Nancy Hamdan, Osama Rakan Al Mraikhat, Fadi A. Zaraket |
| 2025 | DSG-MCTS: A Dynamic Strategy-Guided Monte Carlo Tree Search for Diversified Reasoning in Large Language Models. | Rui Ha, Chaozhuo Li, Rui Pu, Litian Zhang, Xi Zhang, Sen Su |
| 2025 | Rating Roulette: Self-Inconsistency in LLM-As-A-Judge Frameworks. | Rajarshi Haldar, Julia Hockenmaier |
| 2025 | MV-CLAM: Multi-View Molecular Interpretation with Cross-Modal Projection via Language Model. | Sumin Ha, Jun Hyeong Kim, Yinhua Piao, Changyun Cho, Sun Kim |
| 2025 | Reflective Agreement: Combining Self-Mixture of Agents with a Sequence Tagger for Robust Event Extraction. | Fatemeh Haji, Mazal Bethany, Cho-Yu Jason Chiang, Anthony Rios, Peyman Najafirad |
| 2025 | Thunder-DeID: Accurate and Efficient De-identification Framework for Korean Court Judgments. | Sungeun Hahm, Heejin Kim, Gyuseong Lee, Hyunji M. Park, Jaejin Lee |
| 2025 | Neutral Is Not Unbiased: Evaluating Implicit and Intersectional Identity Bias in LLMs Through Structured Narrative Scenarios. | Saba Ghanbari Haez, Mauro Dragoni |
| 2025 | SpeechLLMs for Large-scale Contextualized Zero-shot Slot Filling. | Kadri Hacioglu, Manjunath K. E, Andreas Stolcke |
| 2025 | PromptSuite: A Task-Agnostic Framework for Multi-Prompt Generation. | Eliya Habba, Noam Dahan, Gili Lior, Gabriel Stanovsky |
| 2025 | Reward-Weighted Sampling: Enhancing Non-Autoregressive Characteristics in Masked Diffusion LLMs. | Daehoon Gwak, Minseo Jung, Junwoo Park, Minho Park, ChaeHun Park, Junha Hyung, Jaegul Choo |
| 2025 | Invisible Entropy: Towards Safe and Efficient Low-Entropy LLM Watermarking. | Tianle Gu, Zongqi Wang, Kexin Huang, Yuanqi Yao, Xiangliang Zhang, Yujiu Yang, Xiuying Chen |
| 2025 | Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation. | Jihao Gu, Yingyao Wang, Meng Cao, Pi Bu, Jun Song, Bo Zheng, Yancheng He, Shilong Li |
| 2025 | FSTs vs ICL: Generalisation in LLMs for an under-resourced language. | Ximena Gutierrez-Vasques, Mikel Segura Elizalde, Victor Mijangos |
| 2025 | Cost-Effective E-Commerce Catalog Translation at Scale Ensuring Named Entity Protection. | Asier Gutirrez-Fandio, Jorge Yero Salazar, Clement Ruin, Alejandro Quintero Roba, Shangeetha Ravichandran, Jesus Perez-Martin, Pankaj Adsul, Suruchi Garg, Leonardo Lezcano |
| 2025 | The Green KNIGHT: Green Machine Translation with Knowledge-Distilled, Narrow, Inexpensive, Greedy, Hybrid Transformers. | Andreas Guta, Frithjof Petrick, Peter Polk |
| 2025 | ArgCMV: An Argument Summarization Benchmark for the LLM-era. | Omkar Gurjar, Agam Goyal, Eshwar Chandrasekharan |