| 2025 | COLING | Finetuning LLMs for Comparative Assessment Tasks. | Vatsal Raina, Adian Liusie, Mark J. F. Gales |
| 2024 | ACL | Teacher-Student Training for Debiasing: General Permutation Debiasing for Large Language Models. | Adian Liusie, Yassir Fathullah, Mark J. F. Gales |
| 2024 | EACL | Who Needs Decoders? Efficient Estimation of Sequence-Level Attributes with Proxies. | Yassir Fathullah, Puria Radmard, Adian Liusie, Mark J. F. Gales |
| 2024 | EACL | LLM Comparative Assessment: Zero-shot NLG Evaluation through Pairwise Comparisons using Large Language Models. | Adian Liusie, Potsawee Manakul, Mark J. F. Gales |
| 2024 | EMNLP | Efficient LLM Comparative Assessment: A Product of Experts Framework for Pairwise Comparisons. | Adian Liusie, Vatsal Raina, Yassir Fathullah, Mark J. F. Gales |
| 2024 | EMNLP | Is LLM-as-a-Judge Robust? Investigating Universal Adversarial Attacks on Zero-shot LLM Assessment. | Vyas Raina, Adian Liusie, Mark J. F. Gales |
| 2024 | NAACL | Investigating the Emergent Audio Classification Ability of ASR Foundation Models. | Rao Ma, Adian Liusie, Mark J. F. Gales, Kate M. Knill |
| 2024 | NAACL | WaterJudge: Quality-Detection Trade-off when Watermarking Large Language Models. | Piotr Molenda, Adian Liusie, Mark J. F. Gales |
| 2023 | EMNLP | SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models. | Potsawee Manakul, Adian Liusie, Mark J. F. Gales |
| 2023 | IJCNLP | Mitigating Word Bias in Zero-shot Prompt-based Classifiers. | Adian Liusie, Potsawee Manakul, Mark J. F. Gales |
| 2023 | IJCNLP | MQAG: Multiple-choice Question Answering and Generation for Assessing Information Consistency in Summarization. | Potsawee Manakul, Adian Liusie, Mark J. F. Gales |
| 2022 | IJCNLP | Analyzing Biases to Spurious Correlations in Text Classification Tasks. | Adian Liusie, Vatsal Raina, Vyas Raina, Mark J. F. Gales |