| 2026 | AAAI | Mitigating Content Effects on Reasoning in Language Models Through Fine-Grained Activation Steering. | Marco Valentino, Geonhee Kim, Dhairya Dalal, Zhixue Zhao, Andr Freitas |
| 2026 | AAAI | Making Visual Dialogue More Engaging: A New Task, Method, and Metric. | Guanghui Ye, Huan Zhao, Yingxue Gao, Zhixue Zhao, Kehan Wang, Xupeng Zha, Zhihua Jiang |
| 2026 | EACL | Seeing All Sides: Multi-Perspective In-Context Learning for Subjective NLP. | Benedetta Muscato, Yue Li, Gizem Gezici, Zhixue Zhao, Fosca Giannotti |
| 2026 | EACL | KidsArtBench: Multi-Dimensional Children's Art Evaluation with Attribute-Aware MLLMs. | Mingrui Ye, Chanjin Zheng, Zengyi Yu, Chenyu Xiang, Zhixue Zhao, Zheng Yuan, Helen Yannakoudakis |
| 2026 | NLDB | Zoom In Disparities in Healthcare LLM Q&A. | Ipek Baris Schlicht, Burcu Sayin, Zhixue Zhao, Frederik Labont, Cesare Barbera, Marco Viviani, Paolo Rosso, Lucie Flek |
| 2025 | ACL | Explainable Hallucination through Natural Language Inference Mapping. | Wei-Fan Chen, Zhixue Zhao, Akbar Karimi, Lucie Flek |
| 2025 | ACL | Knowledge Image Matters: Improving Knowledge-Based Visual Reasoning with Multi-Image Large Language Models. | Guanghui Ye, Huan Zhao, Zhixue Zhao, Xupeng Zha, Yang Liu, Zhihua Jiang |
| 2025 | ECIR | Do LLMs Provide Consistent Answers to Health-Related Questions Across Languages? | Ipek Baris Schlicht, Zhixue Zhao, Burcu Sayin, Lucie Flek, Paolo Rosso |
| 2025 | EMNLP | Minimal, Local, and Robust: Embedding-Only Edits for Implicit Bias in T2I Models. | Feng He, Chao Zhang, Zhixue Zhao |
| 2025 | EMNLP | Analysing Chain of Thought Dynamics: Active Guidance or Unfaithful Post-hoc Rationalisation? | Samuel Lewis-Lim, Xingwei Tan, Zhixue Zhao, Nikolaos Aletras |
| 2025 | EMNLP | It's All About In-Context Learning! Teaching Extremely Low-Resource Languages to LLMs. | Yue Li, Zhixue Zhao, Carolina Scarton |
| 2025 | EMNLP | Label Set Optimization via Activation Distribution Kurtosis for Zero-Shot Classification with Generative Models. | Yue Li, Zhixue Zhao, Carolina Scarton |
| 2025 | EMNLP | Revisiting Pruning vs Quantization for Small Language Models. | Zihan Zhou, Simon Kurz, Zhixue Zhao |
| 2025 | ICLR | ScImage: How good are multimodal large language models at scientific text-to-image generation? | Leixin Zhang, Steffen Eger, Yinjie Cheng, Weihe Zhai, Jonas Belouadi, Fahimeh Moafian, Zhixue Zhao |
| 2025 | ICML | RULEBREAKERS: Challenging LLMs at the Crossroads between Formal Logic and Human-like Reasoning. | Jason Chan, Robert J. Gaizauskas, Zhixue Zhao |
| 2025 | ICML | Position: Editing Large Language Models Poses Serious Safety Risks. | Paul Youssef, Zhixue Zhao, Daniel Braun, Jrg Schltterer, Christin Seifert |
| 2025 | NAACL | Has this Fact been Edited? Detecting Knowledge Edits in Language Models. | Paul Youssef, Zhixue Zhao, Christin Seifert, Jrg Schltterer |
| 2025 | NAACL | How to Make LLMs Forget: On Reversing In-Context Knowledge Edits. | Paul Youssef, Zhixue Zhao, Jrg Schltterer, Christin Seifert |
| 2024 | EAMT | ExU: AI Models for Examining Multilingual Disinformation Narratives and Understanding their Spread. | Jake Vasilakes, Zhixue Zhao, Michal Gregor, Ivan Vykopal, Martin Hyben, Carolina Scarton |
| 2024 | NAACL | Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language Models. | Zhixue Zhao, Nikolaos Aletras |
| 2023 | ACL | Incorporating Attribution Importance for Improving Faithfulness Metrics. | Zhixue Zhao, Nikolaos Aletras |
| 2022 | EMNLP | On the Impact of Temporal Concept Drift on Model Explanations. | Zhixue Zhao, George Chrysostomou, Kalina Bontcheva, Nikolaos Aletras |
| 2021 | WWW | A Comparative Study of Using Pre-trained Language Models for Toxic Comment Classification. | Zhixue Zhao, Ziqi Zhang, Frank Hopfgartner |