| 2026 | ODASim: Ordered, Distinctive and Absolute Semantic Similarity for Code Explanation Evaluation. | Prince Kumar, Vitobha Munigala, Jaydeep Sen, Ashish R. Mittal, Vishwajeet Kumar, Srikanth G. Tamilselvam |
| 2026 | When Reviews Disagree: Fine-Grained Contradiction Analysis in Scientific Peer Reviews. | Sandeep Kumar, Yash Kamdar, Abid Hossain, Bharti Kumari, Tanik Saikh, Asif Ekbal |
| 2026 | PolyAudio: Advancing Multi-Audio Reasoning in Large Audio Language Models with Interleaved Multi-Audio Contexts. | Sonal Kumar, Sreyan Ghosh, Yueqian Lin, S. Sakshi, Ashish Seth, Yiran Chen, Ramani Duraiswami, Dinesh Manocha |
| 2026 | Mind the Pause: Disfluency-Aware Objective Tuning for Multilingual Speech Correction with LLMs. | Deepak Kumar, Baban Gain, Asif Ekbal |
| 2026 | Modular Monolingual Adaptation using Pretrained Language Models. | Nalin Kumar, Ondrej Dusek |
| 2026 | Paper Circle: An Open-source Multi-agent Research Discovery and Analysis Framework. | Komal Kumar, Aman Chadha, Salman Khan, Fahad Shahbaz Khan, Hisham Cholakkal |
| 2026 | Revisiting Evaluation of Question Answering Systems in Low-Resource Indic Languages: Bridging Human and Metric Alignment. | Anuj Kumar, Satyadev Ahlawat, Yamuna Prasad, Virendra Singh |
| 2026 | Meta-Tool: Efficient Few-Shot Tool Adaptation for Small Language Models. | Sachin Kumar |
| 2026 | Label and Explanation Variation in LLM-Based Annotation: a Case Study in Natural Language Inference. | Artur Kulmizev, Erika Lombart, Patrick Watrin, Marie-Catherine de Marneffe |
| 2026 | Better and Worse with Scale: How Contextual Entrainment Diverges with Model Size. | Dikshant Kukreja, Kshitij Sah, Gautam Gupta, Avinash Anand, Rajiv Ratn Shah, Zhengkui Wang, Aik Beng Ng, Erik Cambria |
| 2026 | Different types of syntactic agreement recruit the same units within large language models. | Daria Kryvosheieva, Andrea Gregor de Varda, Evelina Fedorenko, Greta Tuckute |
| 2026 | Valid Survey Simulations with Limited Human Data: The Roles of Prompting, Fine-Tuning, and Rectification. | Stefan Krsteski, Giuseppe Russo, Serina Chang, Robert West, Kristina Gligoric |
| 2026 | Multilingual Refusal Alignment for Safer Large Language Models. | Aleksandra Krasnodebska, Wojciech Kusa, Aldo Lipani |
| 2026 | Robust In-Context Selection via Online Learned Position-Corrected Attention. | Deeksha Koul, Gaurav Kumar, Yash Sabale, Sunita Sarawagi |
| 2026 | Data-efficient Targeted Token-level Preference Optimization for LLM-based Text-to-Speech. | Rikuto Kotoge, Yuichi Sasaki |
| 2026 | Can Compact Language Models Search Like Agents? Distillation-Guided Policy Optimization for Preserving Agentic RAG Capabilities. | Rikuto Kotoge, Mai Nishimura, Jiaxin Ma |
| 2026 | To Think or Not to Think: The Hidden Cost of Meta-Training with Excessive CoT Examples. | Vignesh Kothapalli, Ata Fatahi Baarzi, Hamed Firooz, Maziar Sanjabi |
| 2026 | Social Dynamics as Critical Vulnerabilities that Undermine Objective Decision-Making in LLM Collectives. | Changgeon Ko, Jisu Shin, Hoyun Song, Huije Lee, Eui Jun Hwang, Jong C. Park |
| 2026 | EMCEE: Improving Multilingual Capability of LLMs via Bridging Knowledge and Reasoning with Extracted Synthetic Multilingual Context. | Hamin Koo, Jaehyung Kim |
| 2026 | Preference Estimation via Opponent Modeling in Multi-Agent Negotiation. | Yuta Konishi, Kento Yamamoto, Eisuke Sonomoto, Rikuho Takeda, Ryo Furukawa, Yusuke Muraki, Takafumi Shimizu, Kazuma Fukumura, Yuya Kanemoto, Takayuki Ito, Shiyao Ding |
| 2026 | MobileWorld: Benchmarking Autonomous Mobile Agents in Agent-User Interactive and MCP-Augmented Environments. | Quyu Kong, Xu Zhang, Zhenyu Yang, Nolan Gao, Chen Liu, Panrong Tong, Chenglin Cai, Hanzhang Zhou, Jianan Zhang, Liangyu Chen, Zhidan Liu, Steven Hoi, Yue Wang |
| 2026 | SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning. | Fanqi Kong, Weiqin Zu, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng |
| 2026 | CausalGaze: Unveiling Hallucinations via Counterfactual Graph Intervention in Large Language Models. | Linggang Kong, Lei Wu, Yunlong Zhang, Xiaofeng Zhong, Zhen Wang, Yongjie Wang, Yao Pan |
| 2026 | MalURLBench: A Benchmark Evaluating Agents' Vulnerabilities When Processing Web URLs. | Dezhang Kong, Zhuxi Wu, Shiqi Liu, Zhicheng Tan, Kuichen Lu, Minghao Li, Qichen Liu, Shengyu Chu, Zhenhua Xu, Xuan Liu, Meng Han |
| 2026 | Web Fraud Attacks Against LLM-Driven Multi-Agent Systems. | Dezhang Kong, Hujin Peng, Yilun Zhang, Lele Zhao, Zhenhua Xu, Shi Lin, Changting Lin, Meng Han |