| 2025 | PCRI: Measuring Context Robustness in Multimodal Models for Enterprise Applications. | Hitesh Laxmichand Patel, Amit Agarwal, Srikant Panda, Hansa Meghwani, Karan Dua, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth |
| 2025 | LASER: An LLM-based ASR Scoring and Evaluation Rubric. | Amruta Parulekar, Preethi Jyothi |
| 2025 | "What's Up, Doc?": Analyzing How Users Seek Health Information in Large-Scale Conversational AI Datasets. | Akshay Paruchuri, Maryam Aziz, Rohit Vartak, Ayman Ali, Best Uchehara, Xin Liu, Ishan Chatterjee, Monica Agrawal |
| 2025 | PlanGEN: A Multi-Agent Framework for Generating Planning and Reasoning Trajectories for Complex Problem Solving. | Mihir Parmar, Xin Liu, Palash Goyal, Yanfei Chen, Long T. Le, Swaroop Mishra, Hossein Mobahi, Jindong Gu, Zifeng Wang, Hootan Nakhost, Chitta Baral, Chen-Yu Lee, Tomas Pfister, Hamid Palangi |
| 2025 | PLAN-TUNING: Post-Training Language Models to Learn Step-by-Step Planning for Complex Problem Solving. | Mihir Parmar, Palash Goyal, Xin Liu, Yiwen Song, Mingyang Ling, Chitta Baral, Hamid Palangi, Tomas Pfister |
| 2025 | Avoidance Decoding for Diverse Multi-Branch Story Generation. | Kyeongman Park, Nakyeong Yang, Kyomin Jung |
| 2025 | TRUEBench: Can LLM Response Meet Real-world Constraints as Productivity Assistant? | Jiho Park, Jongyoon Song, Minjin Choi, Kyuho Heo, Taehun Huh, Ji Won Kim |
| 2025 | MemeInterpret: Towards an All-in-One Dataset for Meme Understanding. | Jeongsik Park, Khoi P. N. Nguyen, Jihyung Park, Minseok Kim, Jaeheon Lee, Jae Won Choi, Kalyani Ganta, Phalgun Ashrit Kasu, Rohan Sarakinti, Sanjana Vipperla, Sai Sathanapalli, Nishan Vaghani, Vincent Ng |
| 2025 | Leveraging Knowledge Graph-Enhanced LLMs for Context-Aware Medical Consultation. | Su-Hyeong Park, Ho-Beom Kim, Seong-Jin Park, Dinara Aliyeva, Kang-Min Kim |
| 2025 | Riemannian Optimization for LoRA on the Stiefel Manifold. | JuneYoung Park, Minjae Kang, Seongbae Lee, Haegang Lee, Seongwan Kim, Jaeho Lee |
| 2025 | Bridging the Gap Between Molecule and Textual Descriptions via Substructure-aware Alignment. | Hyuntae Park, Yeachan Kim, SangKeun Lee |
| 2025 | Decoding Dense Embeddings: Sparse Autoencoders for Interpreting and Discretizing Dense Retrieval. | Seongwan Park, Taeklim Kim, Youngjoong Ko |
| 2025 | Probability Distribution Collapse: A Critical Bottleneck to Compact Unsupervised Neural Grammar Induction. | Jinwook Park, Kangil Kim |
| 2025 | Measuring and Mitigating Media Outlet Name Bias in Large Language Models. | Seong-Jin Park, Kang-Min Kim |
| 2025 | Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning. | Chan Young Park, Jillian Fisher, Marius Memmel, Dipika Khullar, Seoho Yun, Abhishek Gupta, Yejin Choi |
| 2025 | Leveraging What's Overfixed: Post-Correction via LLM Grammatical Error Overcorrection. | Taehee Park, Heejin Do, Gary Lee |
| 2025 | FLUID QA: A Multilingual Benchmark for Figurative Language Usage in Dialogue across English, Chinese, and Korean. | Seoyoon Park, Hyeji Choi, Minseon Kim, Subin An, Xiaonan Wang, Gyuri Choi, Hansaem Kim |
| 2025 | Evaluating Automatic Speech Recognition Systems for Korean Meteorological Experts. | ChaeHun Park, Hojun Cho, Jaegul Choo |
| 2025 | DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning. | Tanmay Parekh, Kartik Mehta, Ninareh Mehrabi, Kai-Wei Chang, Nanyun Peng |
| 2025 | SNaRe: Domain-aware Data Generation for Low-Resource Event Detection. | Tanmay Parekh, Yuxuan Dong, Lucas Bandarkar, Artin Kim, I-Hung Hsu, Kai-Wei Chang, Nanyun Peng |
| 2025 | Learning Subjective Label Distributions via Sociocultural Descriptors. | Mohammed Fayiz Parappan, Ricardo Henao |
| 2025 | SQUAB: Evaluating LLM robustness to Ambiguous and Unanswerable Questions in Semantic Parsing. | Simone Papicchio, Luca Cagliero, Paolo Papotti |
| 2025 | Evaluating Large Language Models for Belief Inference: Mapping Belief Networks at Scale. | Trisevgeni Papakonstantinou, Antonina Zhiteneva, Ana Yutong Ma, Derek Powell, Zachary Horne |
| 2025 | ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval. | Yi Pan, Yujia Zhang, Michael Kampffmeyer, Xiaoguang Zhao |
| 2025 | Understanding and Mitigating Overrefusal in LLMs from an Unveiling Perspective of Safety Decision Boundary. | Licheng Pan, Yongqi Tong, Xin Zhang, Xiaolu Zhang, Jun Zhou, Zhixuan Chu |