| 2026 | ACL | From Proof to Program: Characterizing Tool-Induced Reasoning Hallucinations in Large Language Models. | Farima Fatahi Bayat, Pouya Pezeshkpour, Estevam Hruschka |
| 2026 | ACL | Logit Arithmetic Elicits Long Reasoning Capabilities Without Training. | Yunxiang Zhang, Muhammad Khalifa, Lechen Zhang, Xin Liu, Ayoung Lee, Xinliang Frederick Zhang, Farima Fatahi Bayat, Lu Wang |
| 2025 | ACL | FactBench: A Dynamic Benchmark for In-the-Wild Language Model Factuality Evaluation. | Farima Fatahi Bayat, Lechen Zhang, Sheza Munir, Lu Wang |
| 2024 | ACL | Enhanced Language Model Truthfulness with Learnable Intervention and Uncertainty Expression. | Farima Fatahi Bayat, Xin Liu, H. V. Jagadish, Lu Wang |
| 2024 | EMNLP | Enhancing Language Model Factuality via Activation-Based Confidence Calibration and Guided Decoding. | Xin Liu, Farima Fatahi Bayat, Lu Wang |
| 2023 | EMNLP | FLEEK: Factual Error Detection and Correction with Evidence Retrieved from External Knowledge. | Farima Fatahi Bayat, Kun Qian, Benjamin Han, Yisi Sang, Anton Belyi, Samira Khorshidi, Fei Wu, Ihab F. Ilyas, Yunyao Li |
| 2022 | NAACL | CompactIE: Compact Facts in Open Information Extraction. | Farima Fatahi Bayat, Nikita Bhutani, H. V. Jagadish |