| 2026 | Understanding Conversational Implicatures in Humans and LLMs. | Daeun Kang |
| 2026 | A Multilingual Social Bias Benchmark Incorporating Thinking Processes. | Masahiro Kaneko, Danushka Bollegala, Timothy Baldwin |
| 2026 | Chain-of-Thought Degrades Visual Spatial Reasoning Capabilities of Multimodal LLMs. | Sai Srinivas Kancheti, Aditya Sanjiv Kanade, Vineeth N. Balasubramanian, Tanuja Ganu |
| 2026 | Efficient PRM Training Data Synthesis via Formal Verification. | Ryo Kamoi, Yusen Zhang, Nan Zhang, Sarkar Snigdha Sarathi Das, Ranran Haoran Zhang, Wenpeng Yin, Rui Zhang |
| 2026 | Improving the Distributional Alignment of LLMs using Supervision. | Gauri Kambhatla, Sanjana Gautam, Angela Zhang, Alexander Liu, Ravi Srinivasan, Junyi Jessy Li, Matthew Lease |
| 2026 | Leveraging Generative AI for Extracting Business Requirements from Legacy COBOL and PL/I Code. | Ankur Kalohia |
| 2026 | POLARIS: A Gdel Agent Framework for Small Language Models through Experience-Abstracted Policy Repair. | Aditya Namdev Kakade, Vivek Srivastava, Shirish S. Karande |
| 2026 | Presentation Slide Translation and Layout Error Correction by LLMs. | Futo Kajita, Nobuyori Nishimura, Takehito Utsuro, Naoki Muto, Chee Siang Leow, Hiromitsu Nishizaki |
| 2026 | PRISMA: Preference-Reinforced Self-Training Approach for Interpretable Emotionally Intelligent Negotiation Dialogues. | Prajwal Vijay Kajare, Priyanshu Priya, Bikash Santra, Asif Ekbal |
| 2026 | Synergizing Semantic Anchors and Ordinal Smoothed Cross-Entropy for Speech Fluency Classification. | Mulati Kahaer, Sirajahmat Ruzmamat, Xudong Pang, Subinuer Maimaitituerxun, Zaokere Kadeer, Abudurexiti Reheman, Wenwen Lu, Panpan Zheng, Aishan Wumaier |
| 2026 | Unifying Inference-Time Planning Language Generation. | Prabhu Prakash Kagitha, Bo Sun, Ishan Desai, Andrew Zhu, Cassie Huang, Manling Li, Ziyang Li, Li Zhang |
| 2026 | PluRule: A Benchmark for Moderating Pluralistic Communities on Social Media. | Zoher Kachwala, Bao Tran Truong, Rasika Muralidharan, Haewoon Kwak, Jisun An, Filippo Menczer |
| 2026 | AUDITA: A New Dataset to Audit Humans vs. AI Skill at Audio QA. | Tasnim Kabir, Dmytro Kurdydyk, Aadi Palnitkar, Liam Dorn, Ahmed Haj Ahmed, Jordan Lee Boyd-Graber |
| 2026 | Potato 2.0: A Comprehensive Annotation Platform with AI-in-the-Loop Support. | David Jurgens, Michael Chen, Lina Iyer |
| 2026 | LOGICAL-COMMONSENSEQA: A Benchmark for Logical Commonsense Reasoning. | Obed Junias, Maria Leonor Pacheco |
| 2026 | Thunder-KoNUBench: A Corpus-Aligned Benchmark for Korean Negation Understanding. | Sungmok Jung, Yeonkyoung So, Joonhak Lee, Sangho Kim, Yelim Ahn, Jaejin Lee |
| 2026 | Towards Scalable Lifelong Knowledge Editing with Selective Knowledge Suppression. | Dahyun Jung, Jaewook Lee, Heuiseok Lim |
| 2026 | STAR-Teaming: A Strategy-Response Multiplex Network Approach to Automated LLM Red Teaming. | MinJae Jung, YongTaek Lim, Chaeyun Kim, Junghwan Kim, Kihyun Kim, Minwoo Kim |
| 2026 | No Reader Left Behind: Multi-Agent Summaries Everyone Can Understand. | Jimin Jung, MyoungJin Kim, Jaehyung Seo, Heuiseok Lim |
| 2026 | Sommelier: Scalable Open Multi-turn Audio Pre-processing for Full-duplex Speech Language Models. | Kyudan Jung, Jihwan Kim, Soyoon Kim, Jeonghoon Kim, Jaegul Choo, Cheonbok Park |
| 2026 | Empirical Analysis of Task Mixture Effects in Small-scale Instruction Tuning: A Statistical Approach. | Jeesu Jung, Sangkeun Jung |
| 2026 | Tracing Logit Trajectories Across Layer Depth: Dataset-Level Explainability for Language Models. | Jeesu Jung, Sangkeun Jung |
| 2026 | Talk to Your Slides: High-Efficiency Slide Editing via Language-Driven Structured Data Manipulation. | Kyudan Jung, Hojun Cho, Jooyeol Yun, Soyoung Yang, Jaehyeok Jang, Jaegul Choo |
| 2026 | Style over Story: Measuring LLM Narrative Preferences via Structured Selection. | Donghoon Jung, Jiwoo Choi, Songeun Chae, Seohyon Jung |
| 2026 | Persona-Grounded Safety Evaluation of AI Companions in Multi-Turn Conversations. | Prerna Juneja, Lika Lomidze |