| 2025 | Cracking the Code: Multi-domain LLM Evaluation on Real-World Professional Exams in Indonesia. | Fajri Koto |
| 2025 | Diverse In-Context Example Selection After Decomposing Programs and Aligned Utterances Improves Semantic Parsing. | Mayank Kothyari, Sunita Sarawagi, Soumen Chakrabarti, Gaurav Arora, Srujana Merugu |
| 2025 | Untangling Hate Speech Definitions: A Semantic Componential Analysis Across Cultures and Domains. | Katerina Korre, Arianna Muti, Federico Ruggeri, Alberto Barrn-Cedeo |
| 2025 | FeRG-LLM : Feature Engineering by Reason Generation Large Language Models. | Jeonghyun Ko, Gyeongyun Park, Donghoon Lee, Kyunam Lee |
| 2025 | Empowering Retrieval-based Conversational Recommendation with Contrasting User Preferences. | Heejin Kook, Junyoung Kim, Seongmin Park, Jongwuk Lee |
| 2025 | SWITCH: Studying with Teacher for Knowledge Distillation of Large Language Models. | Jahyun Koo, Yerin Hwang, Yongil Kim, Taegwan Kang, Hyunkyung Bae, Kyomin Jung |
| 2025 | C²: Scalable Auto-Feedback for LLM-based Chart Generation. | Woosung Koh, Jang Han Yoon, Minhyung Lee, Youngjin Song, Jaegwan Cho, Jaehyun Kang, Taehyeon Kim, Se-Young Yun, Youngjae Yu, Bongshin Lee |
| 2025 | GroundCocoa: A Benchmark for Evaluating Compositional & Conditional Reasoning in Language Models. | Harsh Kohli, Sachin Kumar, Huan Sun |
| 2025 | You Only Read Once (YORO): Learning to Internalize Database Knowledge for Text-to-SQL. | Hideo Kobayashi, Wuwei Lan, Peng Shi, Shuaichen Chang, Jiang Guo, Henghui Zhu, Zhiguo Wang, Patrick Ng |
| 2025 | LlamaLens: Specialized Multilingual LLM for Analyzing News and Social Media Content. | Mohamed Bayan Kmainasi, Ali Ezzat Shahroor, Maram Hasanain, Sahinur Rahman Laskar, Naeemul Hassan, Firoj Alam |
| 2025 | Unmasking Database Vulnerabilities: Zero-Knowledge Schema Inference Attacks in Text-to-SQL Systems. | Dorde Klisura, Anthony Rios |
| 2025 | Advocating Character Error Rate for Multilingual ASR Evaluation. | Thennal D. K, Jesin James, Deepa P. Gopinath, Muhammed Ashraf K |
| 2025 | The Impact of Inference Acceleration on Bias of LLMs. | Elisabeth Kirsten, Ivan Habernal, Vedant Nanda, Muhammad Bilal Zafar |
| 2025 | The Geometry of Prompting: Unveiling Distinct Mechanisms of Task Adaptation in Language Models. | Artem Kirsanov, Chi-Ning Chou, Kyunghyun Cho, SueYeon Chung |
| 2025 | Few-shot Personalization of LLMs with Mis-aligned Responses. | Jaehyung Kim, Yiming Yang |
| 2025 | Obliviate: Neutralizing Task-agnostic Backdoors within the Parameter-efficient Fine-tuning Paradigm. | Jaehan Kim, Minkyoo Song, Seung Ho Na, Seungwon Shin |
| 2025 | The BiGGen Bench: A Principled Benchmark for Fine-grained Evaluation of Language Models with Language Models. | Seungone Kim, Juyoung Suk, Ji Yong Cho, Shayne Longpre, Chaeeun Kim, Dongkeun Yoon, Guijin Son, Yejin Choi, Sheikh Shafayat, Jinheon Baek, Sue Hyun Park, Hyeonbin Hwang, Jinkyung Jo, Hyowon Cho, Haebin Shin, Seongyun Lee, Hanseok Oh, Noah Lee, Namgyu Ho, Se June Joo, Miyoung Ko, Yoonjoo Lee, Hyungjoo Chae, Jamin Shin, Joel Jang, Seonghyeon Ye, Bill Yuchen Lin, Sean Welleck, Graham Neubig, Moontae Lee, Kyungjae Lee, Minjoon Seo |
| 2025 | LLM-guided Plan and Retrieval: A Strategic Alignment for Interpretable User Satisfaction Estimation in Dialogue. | Sangyeop Kim, Sohhyung Park, Jaewon Jung, Jinseok Kim, Sungzoon Cho |
| 2025 | SIMPLOT: Enhancing Chart Question Answering by Distilling Essentials. | Wonjoong Kim, Sangwu Park, Yeonjun In, Seokwon Han, Chanyoung Park |
| 2025 | AdvisorQA: Towards Helpful and Harmless Advice-seeking Question Answering with Collective Intelligence. | Minbeom Kim, Hwanhee Lee, Joonsuk Park, Hwaran Lee, Kyomin Jung |
| 2025 | HEISIR: Hierarchical Expansion of Inverted Semantic Indexing for Training-free Retrieval of Conversational Data using LLMs. | Sangyeop Kim, Hangyeul Lee, Yohan Lee |
| 2025 | Learning to Explore and Select for Coverage-Conditioned Retrieval-Augmented Generation. | Takyoung Kim, Kyungjae Lee, Young Rok Jang, Ji Yong Cho, Gangwoo Kim, Minseok Cho, Moontae Lee |
| 2025 | Query-focused Referentiability Learning for Zero-shot Retrieval. | Jaeyoung Kim, Dohyeon Lee, Seung-won Hwang |
| 2025 | KMI: A Dataset of Korean Motivational Interviewing Dialogues for Psychotherapy. | Hyunjong Kim, Suyeon Lee, Yeongjae Cho, Eunseo Ryu, Yohan Jo, Suran Seong, Sungzoon Cho |
| 2025 | From Evidence to Belief: A Bayesian Epistemology Approach to Language Models. | Minsu Kim, Sangryul Kim, James Thorne |