| 2025 | LionGuard 2: Building Lightweight, Data-Efficient & Localised Multilingual Content Moderators. | Leanne Tan, Gabriel Chua, Ziyu Ge, Roy Ka-Wei Lee |
| 2025 | LangProBe: a Language Program Benchmark. | Shangyin Tan, Lakshya A. Agrawal, Arnav Singhvi, Liheng Lai, Michael J. Ryan, Daniel Klein, Omar Khattab, Koushik Sen, Matei Zaharia |
| 2025 | Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards. | Manveer Singh Tamber, Forrest Sheng Bao, Chenyu Xu, Ge Luo, Suleman Kazi, Minseok Bae, Miaoran Li, Ofer Mendelevitch, Renyi Qu, Jimmy Lin |
| 2025 | TAPS: Tool-Augmented Personalisation via Structured Tagging. | Ekaterina Taktasheva, Jeff Dalton |
| 2025 | LLMs Can Compensate for Deficiencies in Visual Representations. | Sho Takishita, Jay P. Gala, Abdelrahman Mohamed, Kentaro Inui, Yova Kementchedjhieva |
| 2025 | Randomly Removing 50% of Dimensions in Text Embeddings has Minimal Impact on Retrieval and Classification Tasks. | Sotaro Takeshita, Yurina Takeshita, Daniel Ruffinelli, Simone Paolo Ponzetto |
| 2025 | How Does Cognitive Bias Affect Large Language Models? A Case Study on the Anchoring Effect in Price Negotiation Simulations. | Yoshiki Takenami, Yin Jou Huang, Yugo Murawaki, Chenhui Chu |
| 2025 | Refining Text Generation for Realistic Conversational Recommendation via Direct Preference Optimization. | Manato Tajiri, Michimasa Inaba |
| 2025 | Languages Still Left Behind: Toward a Better Multilingual Machine Translation Benchmark. | Chihiro Taguchi, Seng Mai, Keita Kurabe, Yusuke Sakai, Georgina Agyei, Soudabeh Eslami, David Chiang |
| 2025 | Efficient Context Selection for Long-Context QA: No Tuning, No Iteration, Just Adaptive-k. | Chihiro Taguchi, Seiji Maekawa, Nikita Bhutani |
| 2025 | ImpliRet: Benchmarking the Implicit Fact Retrieval Challenge. | Zeinab Sadat Taghavi, Ali Modarressi, Yunpu Ma, Hinrich Schtze |
| 2025 | MMPlanner: Zero-Shot Multimodal Procedural Planning with Chain-of-Thought Object State Reasoning. | Afrina Tabassum, Bin Guo, Xiyao Ma, Hoda Eldardiry, Ismini Lourentzou |
| 2025 | Finding your MUSE: Mining Unexpected Solutions Engine. | Nir Sweed, Hanit Hakim, Ben Wolfson, Hila Lifshitz, Dafna Shahaf |
| 2025 | 3MDBench: Medical Multimodal Multi-agent Dialogue Benchmark. | Ivan Sviridov, Amina Miftakhova, Artemiy Tereshchenko, Galina Zubkova, Pavel Blinov, Andrey V. Savchenko |
| 2025 | Understanding How Value Neurons Shape the Generation of Specified Values in LLMs. | Yi Su, Jiayi Zhang, Shu Yang, Xinhai Wang, Lijie Hu, Di Wang |
| 2025 | A Survey of Pun Generation: Datasets, Evaluations and Methodologies. | Yuchen Su, Yonghua Zhu, Ruofan Wang, Zijian Huang, Diana Benavides-Prado, Michael J. Witbrock |
| 2025 | Castle: Causal Cascade Updates in Relational Databases with Large Language Models. | Yongye Su, Yucheng Zhang, Zeru Shi, Bruno Ribeiro, Elisa Bertino |
| 2025 | Dynamic Energy-Based Contrastive Learning with Multi-Stage Knowledge Verification for Event Causality Identification. | Ya Su, Hu Zhang, Yue Fan, Guangjun Zhang, Yujie Wang, Ru Li, Hongye Tan |
| 2025 | Personalized Question Answering with User Profile Generation and Compression. | Hang Su, Yun Yang, Tianyang Liu, Xin Liu, Peng Pu, Xuesong Lu |
| 2025 | ModelCitizens: Representing Community Voices in Online Safety. | Ashima Suvarna, Christina Chance, Karolina Naranjo, Hamid Palangi, Sophie Hao, Thomas Hartvigsen, Saadia Gabriel |
| 2025 | LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering. | Patrick Sutanto, Joan Santoso, Esther Irawati Setiawan, Aji Prasetya Wibawa |
| 2025 | Training LLMs to be Better Text Embedders through Bidirectional Reconstruction. | Chang Su, Dengliang Shi, Siyuan Huang, Jintao Du, Changhua Meng, Yu Cheng, Weiqiang Wang, Zhouhan Lin |
| 2025 | ClimateViz: A Benchmark for Statistical Reasoning and Fact Verification on Scientific Charts. | Ruiran Su, Jiasheng Si, Zhijiang Guo, Janet B. Pierrehumbert |
| 2025 | Follow the Flow: Fine-grained Flowchart Attribution with Neurosymbolic Agents. | Manan Suri, Puneet Mathur, Nedim Lipka, Franck Dernoncourt, Ryan A. Rossi, Vivek Gupta, Dinesh Manocha |
| 2025 | Enhancing Hate Speech Classifiers through a Gradient-assisted Counterfactual Text Generation Strategy. | Michael van Supranes, Shaowen Peng, Shoko Wakamiya, Eiji Aramaki |