| 2025 | Position: We Can't Understand AI Using our Existing Vocabulary. | John Hewitt, Robert Geirhos, Been Kim |
| 2025 | Primal-Dual Neural Algorithmic Reasoning. | Yu He, Ellen Vitercik |
| 2025 | Decision-aware Training of Spatiotemporal Forecasting Models to Select a Top-K Subset of Sites for Intervention. | Kyle Heuton, F. Samuel Muench, Shikhar Shrestha, Thomas J. Stopka, Michael C. Hughes |
| 2025 | Compression via Pre-trained Transformers: A Study on Byte-Level Multimodal Data. | David Heurtel-Depeiges, Anian Ruoss, Joel Veness, Tim Genewein |
| 2025 | Importance Corrected Neural JKO Sampling. | Johannes Hertrich, Robert Gruhlke |
| 2025 | Measuring In-Context Computation Complexity via Hidden State Prediction. | Vincent Herrmann, Rbert Csords, Jrgen Schmidhuber |
| 2025 | In-Context Linear Regression Demystified: Training Dynamics and Mechanistic Interpretability of Multi-Head Softmax Attention. | Jianliang He, Xintian Pan, Siyu Chen, Zhuoran Yang |
| 2025 | On the Duality between Gradient Transformations and Adapters. | Lucas Torroba Hennigen, Hunter Lang, Han Guo, Yoon Kim |
| 2025 | Secant Line Search for Frank-Wolfe Algorithms. | Deborah Hendrych, Sebastian Pokutta, Mathieu Besanon, David Martnez-Rubio |
| 2025 | FuseUNet: A Multi-Scale Feature Fusion Method for U-like Networks. | Quansong He, Xiangde Min, Kaishen Wang, Tao He |
| 2025 | Gradient Inversion of Multimodal Models. | Omri Ben Hemo, Alon Zolfi, Oryan Yehezkel, Omer Hofman, Roman Vainshtein, Hisashi Kojima, Yuval Elovici, Asaf Shabtai |
| 2025 | Improving the Scaling Laws of Synthetic Data with Deliberate Practice. | Reyhane Askari Hemmat, Mohammad Pezeshki, Elvis Dohmatob, Florian Bordes, Pietro Astolfi, Melissa Hall, Jakob Verbeek, Michal Drozdzal, Adriana Romero-Soriano |
| 2025 | GIVE: Structured Reasoning of Large Language Models with Knowledge Graph Inspired Veracity Extrapolation. | Jiashu He, Mingyu Derek Ma, Jinxuan Fan, Dan Roth, Wei Wang, Alejandro Ribeiro |
| 2025 | Sample Complexity of Distributionally Robust Off-Dynamics Reinforcement Learning with Online Interaction. | Yiting He, Zhishuai Liu, Weixin Wang, Pan Xu |
| 2025 | Going Deeper into Locally Differentially Private Graph Neural Networks. | Longzhu He, Chaozhuo Li, Peng Tang, Sen Su |
| 2025 | Subspace Optimization for Large Language Models with Convergence Guarantees. | Yutong He, Pengrui Li, Yipeng Hu, Chuyan Chen, Kun Yuan |
| 2025 | LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models. | Lukas Helff, Felix Friedrich, Manuel Brack, Kristian Kersting, Patrick Schramowski |
| 2025 | ConceptAttention: Diffusion Transformers Learn Highly Interpretable Features. | Alec Helbling, Tuna Han Salih Meral, Benjamin Hoover, Pinar Yanardag, Duen Horng Chau |
| 2025 | Olica: Efficient Structured Pruning of Large Language Models without Retraining. | Jiujun He, Huazhen Lin |
| 2025 | Machines and Mathematical Mutations: Using GNNs to Characterize Quiver Mutation Classes. | Jesse He, Helen Jenne, Herman Chau, Davis Brown, Mark Raugas, Sara C. Billey, Henry Kvinge |
| 2025 | ReferSplat: Referring Segmentation in 3D Gaussian Splatting. | Shuting He, Guangquan Jie, Changshuo Wang, Yun Zhou, Shuming Hu, Guanbin Li, Henghui Ding |
| 2025 | Double-Filter: Efficient Fine-tuning of Pre-trained Vision-Language Models via Patch&Layer Filtering. | Yaoqin He, Junchen Fu, Kaiwen Zheng, Songpei Xu, Fuhai Chen, Jie Li, Joemon M. Jose, Xuri Ge |
| 2025 | To Steer or Not to Steer? Mechanistic Error Reduction with Abstention for Language Models. | Anna Hedstrm, Salim I. Amoukou, Tom Bewley, Saumitra Mishra, Manuela Veloso |
| 2025 | Step-DAD: Semi-Amortized Policy-Based Bayesian Experimental Design. | Marcel Hedman, Desi R. Ivanova, Cong Guan, Tom Rainforth |
| 2025 | DA-KD: Difficulty-Aware Knowledge Distillation for Efficient Large Language Models. | Changyi He, Yifu Ding, Jinyang Guo, Ruihao Gong, Haotong Qin, Xianglong Liu |