| 2025 | Towards Enforcing Company Policy Adherence in Agentic Workflows. | Naama Zwerdling, David Boaz, Ella Rabinovich, Guy Uziel, David Amid, Ateret Anaby-Tavor |
| 2025 | Evaluating Large Language Models for Cross-Lingual Retrieval. | Longfei Zuo, Pingjun Hong, Oliver Kraus, Barbara Plank, Robert Litschko |
| 2025 | Rule-Guided Extraction: A Hierarchical Rule Optimization Framework for Document-Level Event Argument Extraction. | Yue Zuo, Yuxiao Fei, Wanting Ning, Jiayi Huang, Yubo Feng, Lishuang Li |
| 2025 | EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models. | Tao Zou, Xinghua Zhang, Haiyang Yu, Minzheng Wang, Fei Huang, Yongbin Li |
| 2025 | Multi-Value-Product Retrieval-Augmented Generation for Industrial Product Attribute Value Identification. | Huike Zou, Haiyang Yang, Yindu Su, Chen Li Yu, Qinye Xie, Chengbao Lian, Qingheng Zhang, Shuguang Han, Fei Huang, Jufeng Chen |
| 2025 | SEARA: An Automated Approach for Obtaining Optimal Retrievers. | Yuheng Zou, Yiran Wang, Yuzhu Tian, Min Zhu, Yanhua Huang |
| 2025 | Do LLMs Understand Wine Descriptors Across Cultures? A Benchmark for Cultural Adaptations of Wine Reviews. | Chenye Zou, Xingyue Wen, Tianyi Hu, Qian Janice Wang, Daniel Hershcovich |
| 2025 | 1+1\ensuremath>2: A Synergistic Sparse and Low-Rank Compression Method for Large Language Models. | Zeliang Zong, Kai Zhang, Zheyang Li, Wenming Tan, Ye Ren, Yiyan Zhai, Jilin Hu |
| 2025 | Experience Report: Implementing Machine Translation in a Regulated Industry. | Marco Zocca, Per Fallgren, David Buffoni |
| 2025 | FaMTEB: Massive Text Embedding Benchmark in Persian Language. | Erfan Zinvandi, Morteza Alikhani, Mehran Sarmadi, Zahra Pourbahman, Sepehr Arvin, Reza Kazemi, Arash Amini |
| 2025 | ProcVQA: Benchmarking the Effects of Structural Properties in Mined Process Visualizations on Vision-Language Model Performance. | Kazi Tasnim Zinat, Saad Mohammad Abrar, Shoumik Saha, Sharmila Duppala, Saimadhav Naga Sakhamuri, Zhicheng Liu |
| 2025 | Culture Cartography: Mapping the Landscape of Cultural Knowledge. | Caleb Ziems, William Barr Held, Jane Yu, Amir Goldberg, David Grusky, Diyi Yang |
| 2025 | DemonAgent: Dynamically Encrypted Multi-Backdoor Implantation Attack on LLM-based Agent. | Pengyu Zhu, Zhenhong Zhou, Yuanhe Zhang, Shilinlu Yan, Kun Wang, Sen Su |
| 2025 | A Survey on Multi-modal Intent Recognition: Recent Advances and New Frontiers. | Zhihong Zhu, Fan Zhang, Yunyan Zhang, Jinghan Sun, Zhiqi Huang, Qingqing Long, Bowen Xing, Xian Wu |
| 2025 | MASTER: Multi-Agent Security Through Exploration of Roles and Topological Structures - A Comprehensive Framework. | Yifan Zhu, Chao Zhang, Xin Shi, Xueqiao Zhang, Yi Yang, Yawei Luo |
| 2025 | How Accurate Are LLMs at Multi-Question Answering on Conversational Transcripts? | Xiliang Zhu, Shi Zong, David Rossouw |
| 2025 | SafeScientist: Enhancing AI Scientist Safety for Risk-Aware Scientific Discovery. | Kunlun Zhu, Jiaxun Zhang, Ziheng Qi, Nuoxing Shang, Zijia Liu, Peixuan Han, Yu Su, Haofei Yu, Jiaxuan You |
| 2025 | Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking. | Junda Zhu, Lingyong Yan, Shuaiqiang Wang, Dawei Yin, Lei Sha |
| 2025 | Reinforcement Learning for Large Language Models via Group Preference Reward Shaping. | Huaisheng Zhu, Siyuan Xu, Hangfan Zhang, Teng Xiao, Zhimeng Guo, Shijie Zhou, Shuyue Hu, Vasant G. Honavar |
| 2025 | Chain-of-Thought Matters: Improving Long-Context Language Models with Reasoning Path Supervision. | Dawei Zhu, Xiyu Wei, Guangxiang Zhao, Wenhao Wu, Haosheng Zou, Junfeng Ran, Xun Wang, Lin Sun, Xiangzheng Zhang, Sujian Li |
| 2025 | TableEval: A Real-World Benchmark for Complex, Multilingual, and Multi-Structured Table Question Answering. | Junnan Zhu, Jingyi Wang, Bohan Yu, Xiaoyu Wu, Junbo Li, Lei Wang, Nan Xu |
| 2025 | Certainty in Uncertainty: Reasoning over Uncertain Knowledge Graphs with Statistical Guarantees. | Yuqicheng Zhu, Jingcheng Wu, Yizhen Wang, Hongkuan Zhou, Jiaoyan Chen, Evgeny Kharlamov, Steffen Staab |
| 2025 | ConvSearch-R1: Enhancing Query Reformulation for Conversational Search with Reasoning via Reinforcement Learning. | Changtai Zhu, Siyin Wang, Ruijun Feng, Kai Song, Xipeng Qiu |
| 2025 | Bridging the Capability Gap: Joint Alignment Tuning for Harmonizing LLM-based Multi-Agent Systems. | Minghang Zhu, Zhengliang Shi, Zhiwei Xu, Shiguang Wu, Lingjie Wang, Pengjie Ren, Zhaochun Ren, Zhumin Chen |
| 2025 | LLM-based Conversational Recommendation Agents with Collaborative Verbalized Experience. | Yaochen Zhu, Harald Steck, Dawen Liang, Yinhan He, Nathan Kallus, Jundong Li |