| 2026 | Evaluating the Impact of SAE-based Language Steering on LLM Performance. | Sebastian Zwirner, Wentao Hu, Koshiro Aoki, Daisuke Kawahara |
| 2026 | PromptFE: Automated Feature Engineering by Prompting. | Yufeng Zou, Jean Utke, Diego Klabjan, Han Liu |
| 2026 | Active Generalized Category Discovery with Diverse LLM Feedback. | Henry Peng Zou, Siffi Singh, Yi Nian, Jianfeng He, Jason Cai, Saab Mansour, Hang Su |
| 2026 | Early-Exit and Instant Confidence Translation Quality Estimation. | Vilm Zouhar, Maike Zfle, Beni Egressy, Julius Cheng, Mrinmaya Sachan, Jan Niehues |
| 2026 | Biasless Language Models Learn Unnaturally: How LLMs Fail to Distinguish the Possible from the Impossible. | Imry Ziv, Nur Geffen Lan, Emmanuel Chemla |
| 2026 | SPARTA: Evaluating Reasoning Segmentation Robustness through Black-Box Adversarial Paraphrasing in Text Autoencoder Latent Space. | Viktoriia Zinkovich, Anton Antonov, Andrei Spiridonov, Denis Shepelev, Andrey Moskalenko, Daria Pugacheva, Elena Tutubalina, Andrey Kuznetsov, Vlad Shakhuro |
| 2026 | Rethinking Prompt Optimizers: From Prompt Merits to Optimization. | Zixiao Zhu, Hanzhang Zhou, Zijian Feng, Tianjiao Li, Chua Jia Jim Deryl, Lee Onn Mak, Gee Wah Ng, Kezhi Mao |
| 2026 | Show or Tell? Modeling the evolution of request-making in Human-LLM conversations. | Shengqi Zhu, Jeffrey M. Rzeszotarski, David Mimno |
| 2026 | SCoNE: a Self-Correcting and Noise-Augmented Method for Complex Biological and Chemical Named Entity Recognition. | Xingyu Zhu, Claire Ndellec, Balzs Nagy, Lszl Vidcs, Robert Bossy |
| 2026 | Teams of LLM Agents can Exploit Zero-Day Vulnerabilities. | Yuxuan Zhu, Antony Kellermann, Akul Gupta, Philip Li, Richard Fang, Rohan Bindu, Daniel Kang |
| 2026 | RAFFLES: Reasoning-based Attribution of Faults for LLM Systems. | Chenyang Zhu, Spencer Hong, Jingyu Wu, Kushal Chawla, Yuhui Tang, Youbing Yin, Nathan Wolfe, Erin Babinsky, Daben Liu |
| 2026 | WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning. | Yuchen Zhuang, Di Jin, Jiaao Chen, Wenqi Shi, Hanrui Wang, Chao Zhang |
| 2026 | What Breaks Knowledge Graph based RAG? Benchmarking and Empirical Insights into Reasoning under Incomplete Knowledge. | Dongzhuoran Zhou, Yuqicheng Zhu, Xiaxia Wang, Hongkuan Zhou, Yuan He, Jiaoyan Chen, Steffen Staab, Evgeny Kharlamov |
| 2026 | The Curse of Verbalization: How Presentation Order Constrains LLM Reasoning. | Yue Zhou, Henry Peng Zou, Barbara Di Eugenio, Yang Zhang |
| 2026 | What Matters to an LLM? Behavioral and Computational Evidences from Summarization. | Yongxin Zhou, Changshun Wu, Philippe Mulhem, Didier Schwab, Maxime Peyrard |
| 2026 | TextMineX: Data, Evaluation Framework and Ontology-guided LLM Pipeline for Humanitarian Mine Action. | Chenyue Zhou, Grkan Solmaz, Flavio Cirillo, Kiril Gashteovski, Jonathan Frst |
| 2026 | Utterance-level Detection Framework for LLM-Involved Content Detection in Conversational Setting. | Muyang Zhou, Huaxia Rui |
| 2026 | Amory: Building Coherent Narrative-Driven Agent Memory through Agentic Reasoning. | Yue Zhou, Xiaobo Guo, Belhassen Bayar, Srinivasan H. Sengamedu |
| 2026 | SIRAJ: Diverse and Efficient Red-Teaming for LLM Agents via Distilled Structured Reasoning. | Kaiwen Zhou, Ahmed Elgohary, A S. M. Iftekhar, Amin Saied |
| 2026 | Program-of-Thought Reveals LLM Abstraction Ceilings. | Mike Zhou, Fenil Denish Bardoliya, Vivek Gupta, Dan Roth |
| 2026 | Language Lives in Sparse Dimensions: Toward Interpretable and Efficient Multilingual Control for Large Language Models. | Chengzhi Zhong, Fei Cheng, Qianying Liu, Yugo Murawaki, Chenhui Chu, Sadao Kurohashi |
| 2026 | Validating Automatic Evaluation of Controllable Counterspeech Generation: Rankings Matter More Than Scores. | Yi Zheng, Bjrn Ross, Walid Magdy |
| 2026 | Are All Prompt Components Value-Neutral? Understanding the Heterogeneous Adversarial Robustness of Dissected Prompt in LLMs. | Yujia Zheng, Tianhao Li, Haotian Huang, Tianyu Zeng, Jingyu Lu, Chuangxin Chu, Yuekai Huang, Ziyou Jiang, Qian Xiong, Yuyao Ge, Mingyang Li |
| 2026 | Tracing Multilingual Knowledge Acquisition Dynamics in Domain Adaptation: A Case Study of Biomedical Adaptation. | Xin Zhao, Naoki Yoshinaga, Tsuta Yuma, Akiko Aizawa |
| 2026 | Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering. | Haiyan Zhao, Xuansheng Wu, Fan Yang, Bo Shen, Ninghao Liu, Mengnan Du |