| 2025 | EmoBench-UA: A Benchmark Dataset for Emotion Detection in Ukrainian. | Daryna Dementieva, Nikolay Babakov, Alexander Fraser |
| 2025 | Can LLMs Explain Themselves Counterfactually? | Zahra Dehghanighobadi, Asja Fischer, Muhammad Bilal Zafar |
| 2025 | Case-Based Decision-Theoretic Decoding with Quality Memories. | Hiroyuki Deguchi, Masaaki Nagata |
| 2025 | Ferret: Faster and Effective Automated Red Teaming with Reward-Based Scoring Technique. | Pala Tej Deep, Vernon Toh, Rishabh Bhardwaj, Soujanya Poria |
| 2025 | Error Typing for Smarter Rewards: Improving Process Reward Models with Error-Aware Hierarchical Supervision. | Pala Tej Deep, Panshul Sharma, Amir Zadeh, Chuan Li, Soujanya Poria |
| 2025 | Identifying Unlearned Data in LLMs via Membership Inference Attacks. | Advit Deepak, Megan Mou, Jing Huang, Diyi Yang |
| 2025 | Artificial Impressions: Evaluating Large Language Model Behavior Through the Lens of Trait Impressions. | Nicholas Deas, Kathleen McKeown |
| 2025 | A Comprehensive Framework to Operationalize Social Stereotypes for Responsible AI Evaluations. | Aida Mostafazadeh Davani, Sunipa Dev, Hctor Prez-Urbina, Vinodkumar Prabhakaran |
| 2025 | Recover-LoRA: Data-Free Accuracy Recovery of Degraded Language Models via Low-Rank Adaptation. | Devleena Das, Rajeev Patwari, Ashish Sirasao |
| 2025 | RaDeR: Reasoning-aware Dense Retrieval Models. | Debrup Das, Sen Nuallin, Razieh Rahimi |
| 2025 | Can LLMs be Literary Companions?: Analysing LLMs on Bengali Figures of Speech Identification. | Sourav Das, Kripabandhu Ghosh |
| 2025 | Visual-Aware Speech Recognition for Noisy Scenarios. | Balaji Darur, Karan Singla |
| 2025 | One Planner To Guide Them All ! Learning Adaptive Conversational Planners for Goal-oriented Dialogues. | Huy Quang Dao, Lizi Liao |
| 2025 | Improving Large Language Models Function Calling and Interpretability via Guided-Structured Templates. | Hy Dang, Tianyi Liu, Zhuofeng Wu, Jingfeng Yang, Haoming Jiang, Tao Yang, Pei Chen, Zhengyang Wang, Helen Wang, Huasheng Li, Bing Yin, Meng Jiang |
| 2025 | Exploring Response Uncertainty in MLLMs: An Empirical Evaluation under Misleading Scenarios. | Yunkai Dang, Mengxi Gao, Yibo Yan, Xin Zou, Yanggan Gu, Jungang Li, Jingyu Wang, Peijie Jiang, Aiwei Liu, Jia Liu, Xuming Hu |
| 2025 | From Word to World: Evaluate and Mitigate Culture Bias in LLMs via Word Association Test. | Xunlian Dai, Li Zhou, Benyou Wang, Haizhou Li |
| 2025 | Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities. | Qirun Dai, Dylan Zhang, Jiaqi W. Ma, Hao Peng |
| 2025 | PhysicsArena: The First Multimodal Physics Reasoning Benchmark Exploring Variable, Process, and Solution Dimensions. | Song Dai, Yibo Yan, Jiamin Su, Dongfang Zihao, Yubo Gao, Yonghua Hei, Jungang Li, Junyan Zhang, Sicheng Tao, Zhuoran Gao, Xuming Hu |
| 2025 | Media Source Matters More Than Content: Unveiling Political Bias in LLM-Generated Citations. | Sunhao Dai, Zhanshuo Cao, Wenjie Wang, Liang Pang, Jun Xu, See-Kiong Ng, Tat-Seng Chua |
| 2025 | DispatchQA: A Benchmark for Small Function Calling Language Models in E-Commerce Applications. | Joachim Daiber, Victor Maricato, Ayan Sinha, Andrew Rabinovich |
| 2025 | Unsupervised Concept Vector Extraction for Bias Control in LLMs. | Hannah Cyberey, Yangfeng Ji, David Evans |
| 2025 | Self-Guided Function Calling in Large Language Models via Stepwise Experience Recall. | Sijia Cui, Aiyao He, Shuai Xu, Hongming Zhang, Yanna Wang, Qingyang Zhang, Yajing Wang, Bo Xu |
| 2025 | Anecdoctoring: Automated Red-Teaming Across Language and Place. | Alejandro Cuevas, Saloni Dash, Bharat Kumar Nayak, Dan Vann, Madeleine I. G. Daepp |
| 2025 | Do RAG Systems Really Suffer From Positional Bias? | Florin Cuconasu, Simone Filice, Guy Horowitz, Yoelle Maarek, Fabrizio Silvestri |
| 2025 | Analyzing Gambling Addictions: A Spanish Corpus for Understanding Pathological Behavior. | Manuel Couto, Marcos Fernndez-Pichel, Mario Ezra Aragn, David E. Losada |