| 2025 | Evaluating Test-Time Scaling LLMs for Legal Reasoning: OpenAI o1, DeepSeek-R1, and Beyond. | Yinghao Hu, Yaoyao Yu, Leilei Gan, Bin Wei, Kun Kuang, Fei Wu |
| 2025 | FlowMalTrans: Unsupervised Binary Code Translation for Malware Detection Using Flow-Adapter Architecture. | Minghao Hu, Junzhe Wang, Weisen Zhao, Qiang Zeng, Lannan Luo |
| 2025 | No Free Lunch: Retrieval-Augmented Generation Undermines Fairness in LLMs, Even for Vigilant Users. | Mengxuan Hu, Hongyi Wu, Ronghang Zhu, Zihan Guan, Dongliang Guo, Daiqing Qi, Sheng Li |
| 2025 | OpenRLHF: A Ray-based Easy-to-use, Scalable and High-performance RLHF Framework. | Jian Hu, Xibin Wu, Wei Shen, Jason Klein Liu, Weixun Wang, Songlin Jiang, Haoran Wang, Hao Chen, Bin Chen, Wenkai Fang, Xianyu, Yu Cao, Haotian Xu, Yiming Liu |
| 2025 | MMAPG: A Training-Free Framework for Multimodal Multi-hop Question Answering via Adaptive Planning Graphs. | Yiheng Hu, Xiaoyang Wang, Qing Liu, Xiwei Xu, Qian Fu, Wenjie Zhang, Liming Zhu |
| 2025 | Towards Robust Few-Shot Relation Classification: Incorporating Relation Description with Agreement. | Mengting Hu, Jianfeng Wu, Ming Jiang, Yalan Xie, Zhunheng Wang, Rui Ying, Xiaoyi Liu, Ruixuan Xu, Hang Gao, Renhong Cheng |
| 2025 | Source-primed Multi-turn Conversation Helps Large Language Models Translate Documents. | Hanxu Hu, Jannis Vamvas, Rico Sennrich |
| 2025 | Quantifying Language Disparities in Multilingual Large Language Models. | Songbo Hu, Ivan Vulic, Anna Korhonen |
| 2025 | GuessingGame: Measuring the Informativeness of Open-Ended Questions in Large Language Models. | Dylan Hutson, Daniel Vennemeyer, Aneesh Deshmukh, Justin Zhan, Tianyu Jiang |
| 2025 | Explaining Length Bias in LLM-Based Preference Evaluations. | Zhengyu Hu, Linxin Song, Jieyu Zhang, Zheyuan Xiao, Tianfu Wang, Zhengyu Chen, Nicholas Jing Yuan, Jianxun Lian, Kaize Ding, Hui Xiong |
| 2025 | Koel-TTS: Enhancing LLM based Speech Generation with Preference Alignment and Classifier Free Guidance. | Shehzeen Samarah Hussain, Paarth Neekhara, Xuesong Yang, Edresson Casanova, Subhankar Ghosh, Roy Fejgin, Mikyas T. Desta, Rafael Valle, Jason Li |
| 2025 | VIVA+: Human-Centered Situational Decision-Making. | Zhe Hu, Yixiao Ren, Guanzhong Liu, Jing Li, Yu Yin |
| 2025 | HEAL: A Hypothesis-Based Preference-Aware Analysis Framework. | Yifu Huo, Chenglong Wang, Qiren Zhu, Shunjie Xing, Tong Xiao, Chunliang Zhang, Tongran Liu, JingBo Zhu |
| 2025 | LM-Searcher: Cross-domain Neural Architecture Search with LLMs via Unified Numerical Encoding. | Yuxuan Hu, Jihao Liu, Ke Wang, Jinliang Zheng, Weikang Shi, Manyuan Zhang, Qi Dou, Rui Liu, Aojun Zhou, Hongsheng Li |
| 2025 | Dipper: Diversity in Prompts for Producing Large Language Model Ensembles in Reasoning Tasks. | Wenyang Hu, Gregory Kang Ruey Lau, Diwen Liu, Jizhuo Chen, See-Kiong Ng, Bryan Kian Hsiang Low |
| 2025 | Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning. | Wenbin Hu, Haoran Li, Huihao Jing, Qi Hu, Ziqian Zeng, Sirui Han, Heli Xu, Tianshu Chu, Peizhao Hu, Yangqiu Song |
| 2025 | Mitigating Sequential Dependencies: A Survey of Algorithms and Systems for Generation-Refinement Frameworks in Autoregressive Models. | Yunhai Hu, Zining Liu, Zhenyuan Dong, Tianfan Peng, Bradley McDanel, Sai Qian Zhang |
| 2025 | OkraLong: A Flexible Retrieval-Augmented Framework for Long-Text Question Answering. | Yulong Hui, Yihao Liu, Yao Lu, Huanchen Zhang |
| 2025 | Proactive Hearing Assistants that Isolate Egocentric Conversations. | Guilin Hu, Malek Itani, Tuochao Chen, Shyamnath Gollakota |
| 2025 | MLWQ: Efficient Small Language Model Deployment via Multi-Level Weight Quantization. | Chun Hu, Junhui He, Shangyu Wu, Yuxin He, Chun Jason Xue, Qingan Li |
| 2025 | HapticCap: A Multimodal Dataset and Task for Understanding User Experience of Vibration Haptic Signals. | Guimin Hu, Daniel Hershcovich, Hasti Seifi |
| 2025 | Toxicity Red-Teaming: Benchmarking LLM Safety in Singapore's Low-Resource Languages. | Yujia Hu, Ming Shan Hee, Preslav Nakov, Roy Ka-Wei Lee |
| 2025 | FinTrust: A Comprehensive Benchmark of Trustworthiness Evaluation in Finance Domain. | Tiansheng Hu, Tongyan Hu, Liuyang Bai, Yilun Zhao, Arman Cohan, Chen Zhao |
| 2025 | PEPE: Long-context Extension for Large Language Models via Periodic Extrapolation Positional Encodings. | Jikun Hu, Dongsheng Guo, Yuli Liu, Qingyao Ai, Lixuan Wang, Xuebing Sun, Qilei Zhang, Quan Zhou, Cheng Luo |
| 2025 | Computational Analysis of Conversation Dynamics through Participant Responsivity. | Margaret A. Hughes, Brandon Roy, Elinor Poole-Dayan, Deb Roy, Jad Kabbara |