| 2026 | ACL | DecoCal: Decoding with Calibration in Diffusion Large Language Models. | Fan Xu, Huixuan Zhang, Xiaojun Wan |
| 2026 | ACL | JointCQ: Improving Factual Hallucination Detection with Joint Claim and Query Generation. | Fan Xu, Huixuan Zhang, Zhenliang Zhang, Jiahao Wang, Xiaojun Wan |
| 2026 | ACL | Minos: A Multimodal Evaluation Model for Bidirectional Generation Between Image and Text. | Junzhe Zhang, Huixuan Zhang, Xinyu Hu, Li Lin, Mingqi Gao, Shi Qiu, Xiaojun Wan |
| 2025 | ACL | MC-MKE: A Fine-Grained Multimodal Knowledge Editing Benchmark Emphasizing Modality Consistency. | Junzhe Zhang, Huixuan Zhang, Xunjian Yin, Baizhou Huang, Xu Zhang, Xinyu Hu, Xiaojun Wan |
| 2025 | ACL | ICR Probe: Tracking Hidden State Dynamics for Reliable Hallucination Detection in LLMs. | Zhenliang Zhang, Xinyu Hu, Huixuan Zhang, Junzhe Zhang, Xiaojun Wan |
| 2025 | CIKM | Exploring Causal Effect of Social Bias on Faithfulness Hallucinations in Large Language Models. | Zhenliang Zhang, Junzhe Zhang, Xinyu Hu, Huixuan Zhang, Xiaojun Wan |
| 2025 | CIKM | C-FAITH: A Chinese Fine-Grained Benchmark for Automated Hallucination Evaluation. | Xu Zhang, Zhifei Liu, Jiahao Wang, Huixuan Zhang, Fan Xu, Junzhe Zhang, Xiaojun Wan |
| 2025 | EMNLP | Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models. | Boyu Jia, Junzhe Zhang, Huixuan Zhang, Xiaojun Wan |
| 2025 | EMNLP | R-Bind: Unified Enhancement of Attribute and Relation Binding in Text-to-Image Diffusion Models. | Huixuan Zhang, Xiaojun Wan |
| 2025 | EMNLP | DAMON: A Dialogue-Aware MCTS Framework for Jailbreaking Large Language Models. | Xu Zhang, Xunjian Yin, Dinghao Jing, Huixuan Zhang, Xinyu Hu, Xiaojun Wan |
| 2025 | EMNLP | Tracing Training Footprints: A Calibration Approach for Membership Inference Attacks Against Multimodal Large Language Models. | Xiaofan Zheng, Huixuan Zhang, Xiaojun Wan |
| 2024 | COLING | Image Matters: A New Dataset and Empirical Study for Multimodal Hyperbole Detection. | Huixuan Zhang, Xiaojun Wan |
| 2024 | EMNLP | PaCoST: Paired Confidence Significance Testing for Benchmark Contamination Detection in Large Language Models. | Huixuan Zhang, Yun Lin, Xiaojun Wan |