| 2026 | ACL | Understanding LLM Performance Degradation in Multi-Instance Processing: The Roles of Instance Count and Context Length. | Jingxuan Chen, Mohammad Taher Pilehvar, Jos Camacho-Collados |
| 2026 | ACL | Synthia: Scalable Grounded Persona Generation from Social Media Data. | Vahid Rahimzadeh, Erfan Moosavi Monazzah, Mohammad Taher Pilehvar, Yadollah Yaghoobzadeh |
| 2026 | EACL | TruthTrap: A Bilingual Benchmark for Evaluating Factually Correct Yet Misleading Information in Question Answering. | Mohammadamin Shafiei, Hamidreza Saffari, Mohammad Taher Pilehvar, Alessandro Raganato |
| 2025 | COLING | FarExStance: Explainable Stance Detection for Farsi. | Majid Zarharan, Maryam Hashemi, Malika Behroozrazegh, Sauleh Eetemadi, Mohammad Taher Pilehvar, Jennifer Foster |
| 2025 | CVPR | LibraGrad: Balancing Gradient Flow for Universally Better Vision Transformer Attributions. | Faridoun Mehri, Mahdieh Soleymani Baghshah, Mohammad Taher Pilehvar |
| 2025 | EMNLP | NormXLogit: The Head-on-Top Never Lies. | Sina Abbasi, Mohammad Reza Modarres, Mohammad Taher Pilehvar |
| 2025 | EMNLP | Morables: A Benchmark for Assessing Abstract Moral Reasoning in LLMs with Fables. | Matteo Marcuzzo, Alessandro Zangari, Andrea Albarelli, Jos Camacho-Collados, Mohammad Taher Pilehvar |
| 2025 | EMNLP | Evaluating Cultural Knowledge and Reasoning in LLMs Through Persian Allusions. | Melika Nobakhtian, Yadollah Yaghoobzadeh, Mohammad Taher Pilehvar |
| 2025 | EMNLP | Blind Men and the Elephant: Diverse Perspectives on Gender Stereotypes in Benchmark Datasets. | Mahdi Zakizadeh, Mohammad Taher Pilehvar |
| 2025 | EMNLP | Pun Unintended: LLMs and the Illusion of Humor Understanding. | Alessandro Zangari, Matteo Marcuzzo, Andrea Albarelli, Mohammad Taher Pilehvar, Jos Camacho-Collados |
| 2025 | NAACL | PerCul: A Story-Driven Cultural Evaluation of LLMs in Persian. | Erfan Moosavi Monazzah, Vahid Rahimzadeh, Yadollah Yaghoobzadeh, Azadeh Shakery, Mohammad Taher Pilehvar |
| 2024 | AAAI | Spanning the Spectrum of Hatred Detection: A Persian Multi-Label Hate Speech Dataset with Annotator Rationales. | Zahra Delbari, Nafise Sadat Moosavi, Mohammad Taher Pilehvar |
| 2024 | COLING | TweetTER: A Benchmark for Target Entity Retrieval on Twitter without Knowledge Bases. | Kiamehr Rezaee, Jos Camacho-Collados, Mohammad Taher Pilehvar |
| 2024 | CVPR | SkipPLUS: Skip the First Few Layers to Better Explain Vision Transformers. | Faridoun Mehri, Mohsen Fayyaz, Mahdieh Soleymani Baghshah, Mohammad Taher Pilehvar |
| 2024 | EMNLP | Stochastic Fine-Tuning of Language Models Using Masked Gradients. | Mohammad Akbar-Tajari, Mohammad Taher Pilehvar |
| 2024 | EMNLP | RepMatch: Quantifying Cross-Instance Similarities in Representation Space. | Mohammad Modarres, Sina Abbasi, Mohammad Taher Pilehvar |
| 2023 | ACL | DecompX: Explaining Transformers Decisions by Propagating Token Decomposition. | Ali Modarressi, Mohsen Fayyaz, Ehsan Aghazadeh, Yadollah Yaghoobzadeh, Mohammad Taher Pilehvar |
| 2023 | EACL | Guide the Learner: Controlling Product of Experts Debiasing Method Based on Token Attribution Similarities. | Ali Modarressi, Hossein Amirkhani, Mohammad Taher Pilehvar |
| 2023 | EMNLP | DiFair: A Benchmark for Disentangled Assessment of Gender Knowledge and Bias. | Mahdi Zakizadeh, Kaveh Eskandari Miandoab, Mohammad Taher Pilehvar |
| 2022 | ACL | Incorporating Stock Market Signals for Twitter Stance Detection. | Costanza Conforti, Jakob Berndt, Mohammad Taher Pilehvar, Chryssi Giannitsarou, Flavio Toxvaerd, Nigel Collier |
| 2022 | ACL | On the Importance of Data Size in Probing Fine-tuned Models. | Houman Mehrafarin, Sara Rajaee, Mohammad Taher Pilehvar |
| 2022 | ACL | AdapLeR: Speeding up Inference by Adaptive Length Reduction. | Ali Modarressi, Hosein Mohebbi, Mohammad Taher Pilehvar |
| 2022 | ACL | An Isotropy Analysis in the Multilingual BERT Embedding Space. | Sara Rajaee, Mohammad Taher Pilehvar |
| 2022 | ACL | Exploiting Language Model Prompts Using Similarity Measures: A Case Study on the Word-in-Context Task. | Mohsen Tabasi, Kiamehr Rezaee, Mohammad Taher Pilehvar |
| 2022 | EMNLP | An Empirical Study on the Transferability of Transformer Modules in Parameter-efficient Fine-tuning. | Mohammad Akbar-Tajari, Sara Rajaee, Mohammad Taher Pilehvar |
| 2022 | EMNLP | Looking at the Overlooked: An Analysis on the Word-Overlap Bias in Natural Language Inference. | Sara Rajaee, Yadollah Yaghoobzadeh, Mohammad Taher Pilehvar |
| 2022 | NAACL | GlobEnc: Quantifying Global Token Attribution by Incorporating the Whole Encoder Layer in Transformers. | Ali Modarressi, Mohsen Fayyaz, Yadollah Yaghoobzadeh, Mohammad Taher Pilehvar |
| 2021 | ACL | A Cluster-based Approach for Improving Isotropy in Contextual Embedding Space. | Sara Rajaee, Mohammad Taher Pilehvar |
| 2021 | EACL | WiC-TSV: An Evaluation Benchmark for Target Sense Verification of Words in Context. | Anna Breit, Artem Revenko, Kiamehr Rezaee, Mohammad Taher Pilehvar, Jos Camacho-Collados |
| 2021 | EACL | Adversarial Training for News Stance Detection: Leveraging Signals from a Multi-Genre Corpus. | Costanza Conforti, Jakob Berndt, Marco Basaldella, Mohammad Taher Pilehvar, Chryssi Giannitsarou, Flavio Toxvaerd, Nigel Collier |
| 2021 | EMNLP | Don't Discard All the Biased Instances: Investigating a Core Assumption in Dataset Bias Mitigation Techniques. | Hossein Amirkhani, Mohammad Taher Pilehvar |
| 2021 | EMNLP | Exploring the Role of BERT Token Representations to Explain Sentence Probing Results. | Hosein Mohebbi, Ali Modarressi, Mohammad Taher Pilehvar |
| 2021 | EMNLP | How Does Fine-tuning Affect the Geometry of Embedding Space: A Case Study on Isotropy. | Sara Rajaee, Mohammad Taher Pilehvar |
| 2020 | ACL | Will-They-Won't-They: A Very Large Dataset for Stance Detection on Twitter. | Costanza Conforti, Jakob Berndt, Mohammad Taher Pilehvar, Chryssi Giannitsarou, Flavio Toxvaerd, Nigel Collier |
| 2020 | COLING | Embeddings in Natural Language Processing. | Jos Camacho-Collados, Mohammad Taher Pilehvar |
| 2020 | EMNLP | STANDER: An Expert-Annotated Dataset for News Stance Detection and Evidence Retrieval. | Costanza Conforti, Jakob Berndt, Mohammad Taher Pilehvar, Chryssi Giannitsarou, Flavio Toxvaerd, Nigel Collier |
| 2020 | EMNLP | XL-WiC: A Multilingual Benchmark for Evaluating Semantic Contextualization. | Alessandro Raganato, Tommaso Pasini, Jos Camacho-Collados, Mohammad Taher Pilehvar |
| 2019 | AAAI | Unseen Word Representation by Aligning Heterogeneous Lexical Semantic Spaces. | Victor Prokhorov, Mohammad Taher Pilehvar, Dimitri Kartsaklis, Pietro Li, Nigel Collier |
| 2019 | EMNLP | On the Importance of the Kullback-Leibler Divergence Term in Variational Autoencoders for Text Generation. | Victor Prokhorov, Ehsan Shareghi, Yingzhen Li, Mohammad Taher Pilehvar, Nigel Collier |
| 2019 | NAACL | On the Importance of Distinguishing Word Meaning Representations: A Case Study on Reverse Dictionary Mapping. | Mohammad Taher Pilehvar |
| 2019 | NAACL | WiC: the Word-in-Context Dataset for Evaluating Context-Sensitive Meaning Representations. | Mohammad Taher Pilehvar, Jos Camacho-Collados |
| 2019 | NAACL | Generating Knowledge Graph Paths from Textual Definitions using Sequence-to-Sequence Models. | Victor Prokhorov, Mohammad Taher Pilehvar, Nigel Collier |
| 2018 | ACL | Which Melbourne? Augmenting Geocoding with Maps. | Milan Gritta, Mohammad Taher Pilehvar, Nigel Collier |
| 2018 | CIKM | Modeling the Fake News Challenge as a Cross-Level Stance Detection Task. | Costanza Conforti, Mohammad Taher Pilehvar, Nigel Collier |
| 2018 | EMNLP | On the Role of Text Preprocessing in Neural Network Architectures: An Evaluation Study on Text Categorization and Sentiment Analysis. | Jos Camacho-Collados, Mohammad Taher Pilehvar |
| 2018 | EMNLP | Towards Automatic Fake News Detection: Cross-Level Stance Detection in News Articles. | Costanza Conforti, Mohammad Taher Pilehvar, Nigel Collier |
| 2018 | EMNLP | Mapping Text to Knowledge Graph Entities using Multi-Sense LSTMs. | Dimitri Kartsaklis, Mohammad Taher Pilehvar, Nigel Collier |
| 2018 | EMNLP | Large-scale Exploration of Neural Relation Classification Architectures. | Hoang-Quynh Le, Duy-Cat Can, Sinh T. Vu, Thanh Hai Dang, Mohammad Taher Pilehvar, Nigel Collier |
| 2018 | EMNLP | Card-660: A Reliable Evaluation Framework for Rare Word Representation Models. | Mohammad Taher Pilehvar, Dimitri Kartsaklis, Victor Prokhorov, Nigel Collier |
| 2018 | NAACL | The interplay between lexical resources and Natural Language Processing. | Jos Camacho-Collados, Luis Espinosa Anke, Mohammad Taher Pilehvar |
| 2017 | ACL | Vancouver Welcomes You! Minimalist Location Metonymy Resolution. | Milan Gritta, Mohammad Taher Pilehvar, Nut Limsopatham, Nigel Collier |
| 2017 | ACL | Towards a Seamless Integration of Word Senses into Downstream NLP Applications. | Mohammad Taher Pilehvar, Jos Camacho-Collados, Roberto Navigli, Nigel Collier |
| 2017 | EACL | Inducing Embeddings for Rare and Unseen Words by Leveraging Lexical Resources. | Mohammad Taher Pilehvar, Nigel Collier |
| 2016 | ACL | Embeddings for Word Sense Disambiguation: An Evaluation Study. | Ignacio Iacobacci, Mohammad Taher Pilehvar, Roberto Navigli |
| 2016 | EMNLP | De-Conflated Semantic Representations. | Mohammad Taher Pilehvar, Nigel Collier |
| 2015 | ACL | A Unified Multilingual Semantic Representation of Concepts. | Jos Camacho-Collados, Mohammad Taher Pilehvar, Roberto Navigli |
| 2015 | ACL | A Framework for the Construction of Monolingual and Cross-lingual Word Similarity Datasets. | Jos Camacho-Collados, Mohammad Taher Pilehvar, Roberto Navigli |
| 2015 | ACL | SensEmbed: Learning Sense Embeddings for Word and Relational Similarity. | Ignacio Iacobacci, Mohammad Taher Pilehvar, Roberto Navigli |
| 2015 | NAACL | NASARI: a Novel Approach to a Semantically-Aware Representation of Items. | Jos Camacho-Collados, Mohammad Taher Pilehvar, Roberto Navigli |
| 2015 | NAACL | Reserating the awesometastic: An automatic extension of the WordNet taxonomy for novel terms. | David Jurgens, Mohammad Taher Pilehvar |
| 2015 | NAACL | An Open-source Framework for Multi-level Semantic Similarity Measurement. | Mohammad Taher Pilehvar, Roberto Navigli |
| 2014 | ACL | A Robust Approach to Aligning Heterogeneous Lexical Resources. | Mohammad Taher Pilehvar, Roberto Navigli |
| 2013 | ACL | Align, Disambiguate and Walk: A Unified Approach for Measuring Semantic Similarity. | Mohammad Taher Pilehvar, David Jurgens, Roberto Navigli |
| 2013 | NAACL | Paving the Way to a Large-scale Pseudosense-annotated Dataset. | Mohammad Taher Pilehvar, Roberto Navigli |
| 2011 | CICLING | TEP: Tehran English-Persian Parallel Corpus. | Mohammad Taher Pilehvar, Heshaam Faili, Abdol Hamid Pilevar |