| 2025 | SENTRA: Selected-Next-Token Transformer for LLM Text Detection. | Mitchell Plyler, Yilun Zhang, Alexander Tuzhilin, Saoud Khalifah, Sen Tian |
| 2025 | Will It Still Be True Tomorrow? Multilingual Evergreen Question Classification to Improve Trustworthy QA. | Sergey Pletenev, Maria Marina, Nikolay Ivanov, Daria Galimzianova, Nikita Krayko, Mikhail Salnikov, Vasily Konovalov, Alexander Panchenko, Viktor Moskvoretskii |
| 2025 | Coherence of Argumentative Dialogue Snippets: A New Method for Large Scale Evaluation with an Application to Inference Anchoring Theory. | Paul Piwek, Jacopo Amidei, Svetlana Stoyanchev |
| 2025 | Extraction of Information Provision Activity Requirements from EU Acquis. | Jakub Piskorski, Dominik Skotarczak |
| 2025 | CR4-NarrEmote: An Open Vocabulary Dataset of Narrative Emotions Derived Using Citizen Science. | Andrew Piper, Robert Budac |
| 2025 | Pointing to a Llama and Call it a Camel: On the Sycophancy of Multimodal Large Language Models. | Renjie Pi, Kehao Miao, Li Peihang, Runtao Liu, Jiahui Gao, Jipeng Zhang, Xiaofang Zhou |
| 2025 | Benchmarking Debiasing Methods for LLM-based Parameter Estimates. | Nicolas Audinet de Pieuchon, Adel Daoud, Connor Thomas Jerzak, Moa Johansson, Richard Johansson |
| 2025 | MR. Judge: Multimodal Reasoner as a Judge. | Renjie Pi, Haoping Bai, Qibin Chen, Xiaoming Simon Wang, Jiulong Shan, Xiaojiang Liu, Meng Cao |
| 2025 | A Unified Framework for N-ary Property Information Extraction in Materials Science. | Van-Thuy Phi, Yuji Matsumoto |
| 2025 | Think Twice, Generate Once: Safeguarding by Progressive Self-Reflection. | Hoang Phan, Victor Li, Qi Lei |
| 2025 | How to Fine-Tune Safely on a Budget: Model Adaptation Using Minimal Resources. | Anh C. Pham, Mihir Thalanki, Michael Sun, Aditya Chaloo, Ankita Gupta, Tian Xia, Aditya Mate, Ehi Nosakhare, Soundararajan Srinivasan |
| 2025 | SilVar: Speech-Driven Multimodal Model for Reasoning Visual Question Answering and Object Localization. | Tan-Hanh Pham, Hoang-Nam Le, Phu-Vinh Nguyen, Chris Ngo, Truong-Son Hy |
| 2025 | SLM-Bench: A Comprehensive Benchmark of Small Language Models on Environmental Impacts. | Nghiem Thanh Pham, Tung Kieu, Duc-Manh Nguyen, Ha Xuan Son, Nghia Duong-Trung, Danh Le Phuoc |
| 2025 | Mixed Signals: Decoding VLMs' Reasoning and Underlying Bias in Vision-Language Conflict. | Pouya Pezeshkpour, Moin Aminnaseri, Estevam Hruschka |
| 2025 | Model Calibration for Emotion Detection. | Mihaela Petre-Vlad, Cornelia Caragea, Florentina Hristea |
| 2025 | Towards Automated Error Discovery: A Study in Conversational AI. | Dominic Petrak, Thy Thy Tran, Iryna Gurevych |
| 2025 | A Comprehensive Taxonomy of Negation for NLP and Neural Retrievers. | Roxana Petcu, Samarth Bhargav, Maarten de Rijke, Evangelos Kanoulas |
| 2025 | Definition Generation for Word Meaning Modeling: Monolingual, Multilingual, and Cross-Lingual Perspectives. | Francesco Periti, Roksana Goworek, Haim Dubossarsky, Nina Tahmasebi |
| 2025 | Firewall Routing: Blocking Leads to Better Hybrid Inference for LLMs. | Runyu Peng, Yunhua Zhou, Kai Lv, Yang Gao, Qipeng Guo, Xipeng Qiu |
| 2025 | DLPO: Towards a Robust, Efficient, and Generalizable Prompt Optimization Framework from a Deep-Learning Perspective. | Dengyun Peng, Yuhang Zhou, Qiguang Chen, Jinhao Liu, Jingjing Chen, Libo Qin, Wanxiang Che |
| 2025 | SolEval: Benchmarking Large Language Models for Repository-level Solidity Smart Contract Generation. | Zhiyuan Peng, Xin Yin, Rui Qian, Peiqin Lin, Yongkang Liu, Hao Zhang, Chenhao Ying, Yuan Luo |
| 2025 | KELE: A Multi-Agent Framework for Structured Socratic Teaching with Large Language Models. | Xian Peng, Pan Yuan, Dong Li, Junlong Cheng, Qin Fang, Zhi Liu |
| 2025 | IP-Dialog: Evaluating Implicit Personalization in Dialogue Systems with Synthetic Data. | Bo Peng, Zhiheng Wang, Heyang Gong, Chaochao Lu |
| 2025 | DiplomacyAgent: Do LLMs Balance Interests and Ethical Principles in International Events? | Jianxiang Peng, Ling Shi, Xinwei Wu, Hanwen Zhang, Fujiang Liu, Haocheng Lyu, Deyi Xiong |
| 2025 | VerIF: Verification Engineering for Reinforcement Learning in Instruction Following. | Hao Peng, Yunjia Qi, Xiaozhi Wang, Bin Xu, Lei Hou, Juanzi Li |