Skip to content

North American Association for Computational Linguistics

NAACL

A

CORE rank

CORE rank (raw)

A

Acceptance rate

24.7% (2024 main conference)

Fields of research

Artificial Intelligence

Papers indexed

7,329

1989–2025

Papers per year

19891,370 peak2025

NAACL papers

7,329 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models.Hila Gonen, Terra Blevins, Alisa Liu, Luke Zettlemoyer, Noah A. Smith
2025Evaluation of Multilingual Image Captioning: How far can we get with CLIP models?Gonalo Gomes, Chrysoula Zerva, Bruno Martins
2025What Do VLMs NOTICE? A Mechanistic Interpretability Pipeline for Gaussian-Noise-free Text-Image Corruption and Evaluation.Michal Golovanevsky, William Rudman, Vedant Palit, Carsten Eickhoff, Ritambhara Singh
2025Familarity: Better Evaluation of Zero-Shot Named Entity Recognition by Quantifying Label Shifts in Synthetic Training Data.Jonas Golde, Patrick Haller, Max Ploner, Fabio Barth, Nicolaas Paul Jedema, Alan Akbik
2025TurboFuzzLLM: Turbocharging Mutation-based Fuzzing for Effectively Jailbreaking Large Language Models in Practice.Aman Goel, Xian Carrie Wu, Zhe Wang, Dmitriy Bespalov, Yanjun Qi
2025Target-Augmented Shared Fusion-based Multimodal Sarcasm Explanation Generation.Palaash Goel, Dushyant Singh Chauhan, Md. Shad Akhtar
2025Grounding Fallacies Misrepresenting Scientific Publications in Evidence.Max Glockner, Yufang Hou, Preslav Nakov, Iryna Gurevych
2025Can Unconfident LLM Annotations Be Used for Confident Conclusions?Kristina Gligoric, Tijana Zrnic, Cinoo Lee, Emmanuel J. Cands, Dan Jurafsky
2025Grammar Control in Dialogue Response Generation for Language Learning Chatbots.Dominik Glandorf, Peng Cui, Detmar Meurers, Mrinmaya Sachan
2025NeMo-Inspector: A Visualization Tool for LLM Generation Analysis.Daria Gitman, Igor Gitman, Evelina Bakhturina
2025MT-LENS: An all-in-one Toolkit for Better Machine Translation Evaluation.Javier Garca Gilabert, Carlos Escolano, Audrey Mash, Xixian Liao, Maite Melero
2025AEGIS2.0: A Diverse AI Safety Dataset and Risks Taxonomy for Alignment of LLM Guardrails.Shaona Ghosh, Prasoon Varshney, Makesh Narsimhan Sreedhar, Aishwarya Padmakumar, Traian Rebedea, Jibin Rajan Varghese, Christopher Parisien
2025ConMeC: A Dataset for Metonymy Resolution with Common Nouns.Saptarshi Ghosh, Tianyu Jiang
2025Are Language Models Agnostic to Linguistically Grounded Perturbations? A Case Study of Indic Languages.Poulami Ghosh, Raj Dabre, Pushpak Bhattacharyya
2025AlgoPuzzleVQA: Diagnosing Multimodal Reasoning Challenges of Language Models with Algorithmic Multimodal Puzzles.Deepanway Ghosal, Vernon Toh, Yew Ken Chia, Soujanya Poria
2025PromptRefine: Enhancing Few-Shot Performance on Low-Resource Indic Languages with Example Selection from related Example Banks.Soumya Suvra Ghosal, Soumyabrata Pal, Koyel Mukherjee, Dinesh Manocha
2025Fine-Grained Transfer Learning for Harmful Content Detection through Label-Specific Soft Prompt Tuning.Faeze Ghorbanpour, Viktor Hangya, Alexander Fraser
2025Intrinsic Bias is Predicted by Pretraining Data and Correlates with Downstream Performance in Vision-Language Encoders.Kshitish Ghate, Isaac Slaughter, Kyra Wilson, Mona T. Diab, Aylin Caliskan
2025CAMEL-Bench: A Comprehensive Arabic LMM Benchmark.Sara Ghaboura, Ahmed Heakl, Omkar Thawakar, Ali Husain Salem Abdulla Alharthi, Ines Riahi, Abduljalil Radman, Jorma Laaksonen, Fahad Shahbaz Khan, Salman Khan, Rao Muhammad Anwer
2025Great Memory, Shallow Reasoning: Limits of kNN-LMs.Shangyi Geng, Wenting Zhao, Alexander M. Rush
2025Are We Done with MMLU?Aryo Pradipta Gema, Joshua Ong Jun Leang, Giwon Hong, Alessio Devoto, Alberto Carlo Maria Mancino, Rohit Saxena, Xuanli He, Yu Zhao, Xiaotang Du, Mohammad Reza Ghasemi Madani, Claire Barale, Robert McHardy, Joshua Harris, Jean Kaddour, Emile van Krieken, Pasquale Minervini
2025Code-Optimise: Self-Generated Preference Data for Correctness and Efficiency.Leonidas Gee, Milan Gritta, Gerasimos Lampouras, Ignacio Iacobacci
2025MLLM-Bench: Evaluating Multimodal LLMs with Per-sample Criteria.Wentao Ge, Shunian Chen, Hardy Chen, Nuo Chen, Junying Chen, Zhihong Chen, Wenya Xie, Shuo Yan, ChenghaoZhu ChenghaoZhu, Ziyue Lin, Dingjie Song, Xidong Wang, Anningzhe Gao, Zhiyi Zhang, Jianquan Li, Xiang Wan, Benyou Wang
2025TabComp: A Dataset for Visual Table Reading Comprehension.Somraj Gautam, Abhishek Bhandari, Gaurav Harit
2025TransformerRanker: A Tool for Efficiently Finding the Best-Suited Language Models for Downstream Classification Tasks.Lukas Garbas, Max Ploner, Alan Akbik
1,0761,100 of 7,329← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.