| 2026 | d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models. | Leyi Pan, Shuchang Tao, Yunpeng Zhai, Zheyu Fu, Liancheng Fang, Minghua He, Lingzhe Zhang, Zhaoyang Liu, Bolin Ding, Aiwei Liu, Lijie Wen |
| 2026 | REST: Stress Testing Large Reasoning Models by Asking Multiple Problems at Once. | Zhuoshi Pan, Qizhi Pei, Yu Li, Zinan Tang, Qiyao Sun, H. Vicky Zhao, Conghui He, Lijun Wu |
| 2026 | Context Attribution with Multi-Armed Bandit Optimization. | Deng Pan, Keerthiram Murugesan, Ting Hua, Nuno Moniz, Nitesh V. Chawla |
| 2026 | AiraXiv: An AI-Driven Open-Access Platform for Human and AI Scientists. | Junshu Pan, Panzhong Lu, Yixuan Weng, Qiyao Sun, Fang Guo, Zijie Yang, Qiji Zhou, Yue Zhang |
| 2026 | CVRH: Cross-modal Variational Role Hypergraph Network via Semantic Enhancement for Multi-modal Event Argument Extraction. | Bangze Pan, Yang Li, Ruili Pu, Suge Wang, Jian Liao, Jianxing Zheng, Xiaoli Li, Deyu Li |
| 2026 | Explainable and Fine-Grained Safeguarding of LLM Multi-Agent Systems via Bi-Level Graph Anomaly Detection. | Junjun Pan, Yixin Liu, Rui Miao, Kaize Ding, Yu Zheng, Quoc Viet Hung Nguyen, Alan Wee-Chung Liew, Shirui Pan |
| 2026 | DART: Mitigating Harm Drift in Difference-Aware LLMs via Distill-Audit-Repair Training. | Ziwen Pan, Zihan Liang, Jad Kabbara, Ali Emami |
| 2026 | G-HiRel: Enhancing the Adaption to Knowledge Updating for Large Language Model Reasoning. | Yudai Pan, Jiajie Hong, Tianzhe Zhao, Lingyun Song, Lingling Zhang, Yixin Chen, Xuequn Shang |
| 2026 | A Syntactic and Semantic Probe into Language Evolution based on Large Language Models. | Hao Pang, Changcheng Li, Yingxue Liu |
| 2026 | HTMuon: Improving Muon via Heavy-Tailed Spectral Correction. | Tianyu Pang, Yujie Fang, Zihang Liu, Shenyang Deng, Lei Hsiung, Shuhua Yu, Yaoqing Yang |
| 2026 | User-Assistant Bias in LLMs. | Xu Pan, Jingxuan Fan, Zidi Xiong, Ely Hahami, Jorin Overwiening, Ziqian Xie |
| 2026 | Hard2Verify: A Step-Level Verification Benchmark for Open-Ended Frontier Math. | Shrey Pandit, Austin Xu, Xuan-Phi Nguyen, Yifei Ming, Caiming Xiong, Shafiq Joty |
| 2026 | Thesis Proposal: Toward a Human-Centered and Perspective-Aware Framework for Reproducible ML Evaluation and AI Alignment. | Deepak Pandita, Christopher M. Homan |
| 2026 | Arguments that Alter Minds: LLM Rationales Sway Human (and LLM) Notions of Plausibility. | Shramay Palta, Peter Rankel, Sarah Wiegreffe, Rachel Rudinger |
| 2026 | Bears, all bears, and some bears. Language Constraints on Language Models' Inductive Inferences. | Sriram Padmanabhan, Siyuan Song, Kanishka Misra |
| 2026 | LLMs are Brittle to Simple Code Transformations: Introducing CETBench - A Benchmark for Code-Equivalence Checking. | Neeva Oza, Ishaan Govil, Parul Gupta, Dinesh Khandelwal, Dinesh Garg, Parag Singla |
| 2026 | Anchoring Depends on Confidence and Post-Training in Language Models. | Hillary N. Owusu, Naomi H. Feldman |
| 2026 | FLEXITOKENS: Flexible Tokenization for Evolving Language Models. | Abraham Toluwase Owodunni, Orevaoghene Ahia, Sachin Kumar |
| 2026 | What Makes LLMs Effective Sequential Recommenders? A Study on Preference Intensity and Temporal Context. | Zhongyu Ouyang, Qianlong Wen, Chunhui Zhang, Yanfang Ye, Soroush Vosoughi |
| 2026 | PyraMathBench: Evaluating and Improving Mathematical Capability in Large Language Models. | Zetian Ouyang, Linlin Wang, Gerard de Melo, Liang He |
| 2026 | BIASEDTALES-ML: A Multilingual Dataset for Analyzing Narrative Attribute Distributions in LLM-Generated Stories. | Yuxuan Ouyang, Yingfeng Luo, JingBo Zhu, Tong Xiao |
| 2026 | Hierarchical Policy Optimization for Simultaneous Translation of Unbounded Speech. | Siqi Ouyang, Shuoyang Ding, Oleksii Hrinchuk, Vitaly Lavrukhin, Brian Yan, Boris Ginsburg, Lei Li |
| 2026 | Identifying the Periodicity of Information in Natural Language. | Yulin Ou, Yu Wang, Yang Xu, Hendrik Buschmeier |
| 2026 | BrowseConf: Confidence-Guided Test-Time Scaling for Web Agents. | Litu Ou, Kuan Li, Huifeng Yin, Liwen Zhang, Zhongwang Zhang, Xixi Wu, Rui Ye, Zile Qiao, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou |
| 2026 | PUMA: Projected Universal Multilingual ASR for Low-Resource Settings. Application to Diverse African Languages. | Ilyes Oukid, Bilal Faye, Hanane Azzag, Mustapha Lebbah, Said Yacine Boulahia |