| 2026 | Agentic Rubrics as Contextual Verifiers for SWE Agents. | Mohit Raghavendra, Anisha Gunjal, Bing Liu, Yunzhong He |
| 2026 | Context-Conditioned Masked LoRA: Dynamic Rank Routing for Compute-Efficient Parameter-Efficient Fine-Tuning. | Rifat Rafiuddin, Rafae Abdullah |
| 2026 | Calibrating LLM Judges: Linear Probes for Fast and Reliable Uncertainty Estimation. | Bhaktipriya Radharapu, Eshika Saxena, Kenneth Li, Chenxi Whitehouse, Adina Williams, Nicola Cancedda |
| 2026 | Compositional Steering of Large Language Models with Steering Tokens. | Gorjan Radevski, Kiril Gashteovski, Giwon Hong, Carolin Lawrence, Goran Glavas |
| 2026 | DialDefer: A Framework for Detecting and Mitigating LLM Dialogic Deference. | Parisa Rabbani, Priyam Sahoo, Ruben Mathew, Aishee Mondal, Harshita Ketharaman, Nimet Beyza Bozdag, Dilek Hakkani-Tr |
| 2026 | LR-DWM: Efficient Watermarking for Diffusion Language Models. | Ofek Raban, Gal Chechik, Ethan Fetaya |
| 2026 | QuantumQA: Enhancing Scientific Reasoning via Physics-Consistent Dataset and Verification-Aware Reinforcement Learning. | Songxin Qu, Tai-Ping Sun, Yun-Jie Wang, Huan-Yu Liu, Cheng Xue, Xiao-Fan Xu, Han Fang, Yang Yang, Yu-Chun Wu, Guo-Ping Guo, Zhao-Yun Chen |
| 2026 | Budget-Aware Routing for Long Clinical Text. | Khizar Qureshi, Geoffrey Martin, Yifan Peng |
| 2026 | MediEval: A Unified Medical Benchmark for Patient-Contextual and Knowledge-Grounded Reasoning in LLMs. | Zhan Qu, Michael Frber |
| 2026 | One LLM Does Not Simulate All Students: Ability-Aware Student Simulation via Cognitive Diagnosis Guided LLM Assignment. | Huixing Que, Qi Liu, Weibo Gao, Zhenya Huang |
| 2026 | MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching. | Changle Qu, Sunhao Dai, Hengyi Cai, Jun Xu, Shuaiqiang Wang, Dawei Yin |
| 2026 | Multilingual and Cross-Lingual Citation Needed Detection on Wikipedia for Lower-Resource Languages. | Gerrit Quaremba, Amy Rechkemmer, Elizabeth Black, Denny Vrandecic, Elena Simperl |
| 2026 | Beyond Static Persona Consistency: Dynamic Persona Coherence in LLM Role-Playing. | Yirui Qi, Xiaoming Zhang, Ruilin Zeng, Mengyao Liu, Ziyi Zhou, Dezhuang Miao, Bingyu Yan, Zhenyu Guan |
| 2026 | Profiling-Free Mixed-Precision Quantization for MoE LLMs via Fuzzy Rule Interpolation. | Huachen Qi, Ruiyu Zhuo, Bowen Shi, Xiang Chang, Fei Chao, Changjing Shang, Qiang Shen |
| 2026 | E-ViC: Reasoning Beyond Text via Embodied Visual Chain for Spatial Intelligence. | Junbo Qi, Yi Zhang, Hanchu Ni, Che Liu, Zhimin Yao, Ruilin Yang, Xiancong Ren, Liangjian Wen, Wei Ge, Yuya Ieiri, Osamu Yoshie, Yong Dai, Xiaozhu Ju |
| 2026 | CARL: Constraint-Aware Reinforcement Learning for Planning with LLMs. | Qiuyi Qi, Jinjian Zhang, Mutian Bao, Tian Liang, Guocong Li, Dongnan Liu, Wei Zhou, Jie Liu, Ming Kong, Linjian Mo, Feng Zhang, Qiang Zhu |
| 2026 | Towards Identification and Intervention of Safety-Critical Parameters in Large Language Models. | Weiwei Qi, Zefeng Wu, Tianhang Zheng, Zikang Zhang, Xiaojun Jia, Zhan Qin, Kui Ren |
| 2026 | CARE-CR: Context-Aware Routing and Expert Fusion for Multi-Preference Cognitive Restructuring. | Hongzhi Qi, Liangcheng Wang, Yijing Yu, Jianqiang Li, Bing Xiang Yang, Qing Zhao |
| 2026 | Can VLMs Predict Future States? Bootstrapping World Models from Inverse Dynamics. | Yifu Qiu, Yftah Ziser, Anna Korhonen, Shay B. Cohen, Edoardo M. Ponti |
| 2026 | Pause or Fabricate? Training Language Models for Grounded Reasoning. | Yiwen Qiu, Linjuan Wu, Yizhou Liu, Yuchen Yan, Jin Ma, Xu Tan, Yao Hu, Daoxin Zhang, Wenqi Zhang, Weiming Lu, Jun Xiao, Yongliang Shen |
| 2026 | ChatAnime: Towards User-Centered Emotional Support in LLM-based Virtual Character Chat. | Lanlan Qiu, Sophia Xiao Pu, Yeqi Feng, Wenchang Gao, Tianxing He |
| 2026 | Tree-Notebook: A Context-Aware Agent with Tree Search and Entropy-Aware Data Shadow for Interactive Data Science. | Junkun Qiu, Min Huang, Qinghai Miao |
| 2026 | CL²GEC: A Multi-Discipline Benchmark for Continual Learning in Chinese Literature Grammatical Error Correction. | Shang Qin, Jingheng Ye, Yinghui Li, Hai-Tao Zheng, Qi Li, Jinxiao Shan, Zhixing Li, Hong-Gee Kim |
| 2026 | EntroBench: Evaluating LLM Watermarking Under Multi-Entropy Scenarios and Practical User Operations. | Pengyuan Qin, Linnan Tu, Yuhan Ke, Hefei Ling |
| 2026 | Knowing-but-Doing: Diagnosing and Defending Role-Play-Driven LLMs Jailbreaks via Moral Disengagement. | Haiming Qin, Jianxun Lian, Qimin Zhong, Mingyang Zhou, Hao Liao, Naipeng Chao |