| 2025 | Noise May Drown Out Words but Foster Compositionality: The Advantage of the Erasure and Deletion Noisy Channels on Emergent Communication. | Cezary Klamra, Francijn Keur, Raquel G. Alhama |
| 2025 | AURA-QG: Automated Unsupervised Replicable Assessment for Question Generation. | Rajshekar K, Harshad Khadilkar, Pushpak Bhattacharyya |
| 2025 | Doppelganger-JC: Benchmarking the LLMs' Understanding of Cross-Lingual Homographs between Japanese and Chinese. | Yuka Kitamura, Jiahao Huang, Akiko Aizawa |
| 2025 | HEARTS: A Holistic Framework for Explainable, Sustainable and Robust Text Stereotype Detection. | Theo King, Zekun Wu, Adriano S. Koshiyama, Emre Kazim, Philip C. Treleaven |
| 2025 | Persona is a Double-Edged Sword: Rethinking the Impact of Role-play Prompts in Zero-shot Reasoning Tasks. | Junseok Kim, Nakyeong Yang, Kyomin Jung |
| 2025 | Do LLMs Need Inherent Reasoning Before Reinforcement Learning? A Study in Korean Self-Correction. | Hongjin Kim, Jaewook Lee, Kiyoung Lee, Jong-hun Shin, Soojong Lim, Oh-Woog Kwon |
| 2025 | Enhancing Coreference Resolution with LLM-driven Data Augmentation and Adversarial Filtering. | Dohyeon Kim, Gayeon Jung, Jeongseon Cho, Jihoon Yang |
| 2025 | PerMed-MM: A Multimodal, Multi-Specialty Persian Medical Benchmark for Evaluating Vision Language Models. | Ali Khoramfar, Mohammad Javad Dousti, Heshaam Faili |
| 2025 | StuD: A Multimodal Approach for Stuttering Detection with RAG and Fusion Strategies. | Pragya Khanna, Priyanka Kommagouni, Vamshi Raghu Simha Narasinga, Anil Vuppala |
| 2025 | CLASSER: Cross-lingual Annotation Projection enhancement through Script Similarity for Fine-grained Named Entity Recognition. | Prachuryya Kaushik, Ashish Anand |
| 2025 | Online Learning Defense against Iterative Jailbreak Attacks via Prompt Optimization. | Masahiro Kaneko, Zeerak Talat, Timothy Baldwin |
| 2025 | From Anger to Joy: How Nationality Personas Shape Emotion Attribution in Large Language Models. | Mahammed Kamruzzaman, Abdullah Al Monsur, Gene Louis Kim, Anshuman Chhabra |
| 2025 | Learning from *Sufficient* Rationales: Analysing the Relationship Between Explanation Faithfulness and Token-level Regularisation Strategies. | Jonathan Kamp, Lisa Beinborn, Antske Fokkens |
| 2025 | Does Synthetic Data Help Named Entity Recognition for Low-Resource Languages? | Gaurav Kamath, Sowmya Vajjala |
| 2025 | A Detailed Factor Analysis for the Political Compass Test: Navigating Ideologies of Large Language Models. | Sadia Kamal, Lalu Prasad Yadav Prakash, S. M. Rafiuddin, Mohammed Rakib, Atriya Sen, Sagnik Ray Choudhury |
| 2025 | A Word-Splitting Approach to Kannada Sanskrit Sandhi Words Useful in Effective English Translation. | Shanta Kallur, Basavaraj S. Anami |
| 2025 | Ibom NLP: A Step Toward Inclusive Natural Language Processing for Nigeria's Minority Languages. | Oluwadara Kalejaiye, Luel Hagos Beyene, David Ifeoluwa Adelani, Mmekut-Mfon Gabriel Edet, Aniefon Daniel Akpan, Eno-Abasi Urua, Anietie Andy |
| 2025 | Learning from Hallucinations: Mitigating Hallucinations in LLMs via Internal Representation Intervention. | Sora Kadotani, Kosuke Nishida, Kyosuke Nishida |
| 2025 | Improving Multilingual Capabilities with Cultural and Local Knowledge in Large Language Models While Enhancing Native Performance. | Ram Mohan Rao Kadiyala, Siddartha Pullakhandam, Siddhant Gupta, Jebish Purbey, Drishti Sharma, Kanwal Mehreen, Muhammad Arham, Suman Debnath, Hamza Farooq |
| 2025 | DSBC : Data Science task Benchmarking with Context engineering. | Ram Mohan Rao Kadiyala, Jebish Purbey, Siddhant Gupta, Giulio Martini, Suman Debnath, Hamza Farooq |
| 2025 | Uncovering Cultural Representation Disparities in Vision-Language Models. | Ram Mohan Rao Kadiyala, Siddhant Gupta, Jebish Purbey, Srishti Yadav, Suman Debnath, Alejandro Salamanca, Desmond Elliott |
| 2025 | CultureGuard: Towards Culturally-Aware Dataset and Guard Model for Multilingual Safety Applications. | Raviraj Joshi, Rakesh Paul, Kanishk Singla, Anusha Kamath, Michael Evans, Katherine Luna, Shaona Ghosh, Utkarsh Vaidya, Eileen Peters Long, Sanjay Singh Chauhan, Niranjan Wartikar |
| 2025 | ELR-1000: A Community-Generated Dataset for Endangered Indic Indigenous Languages. | Neha Joshi, Pamir Gogoi, Aasim Mirza, Aayush Jansari, Aditya Yadavalli, Ayushi Pandey, Arunima Shukla, Deepthi Sudharsan, Kalika Bali, Vivek Seshadri |
| 2025 | Large Language Models Exhibit Limited Reasoning Ability on Coding Problems. | Jinyoung Jo, Jonah Engelmann, Sean Choi |
| 2025 | R2-KG: General-Purpose Dual-Agent Framework for Reliable Reasoning on Knowledge Graphs. | Sumin Jo, Junseong Choi, Jiho Kim, Edward Choi |