| 2026 | AAAI | Not All Tokens and Heads Are Equally Important: Dual-Level Attention Intervention for Hallucination Mitigation. | Lexiang Tang, Xianwei Zhuang, Bang Yang, Zhiyuan Hu, Hongxiang Li, Lu Ma, Jinghan Ru, Yuexian Zou |
| 2025 | ACL | ATRI: Mitigating Multilingual Audio Text Retrieval Inconsistencies by Reducing Data Distribution Errors. | Yuguo Yin, Yuxin Xie, Wenyuan Yang, Dongchao Yang, Jinghan Ru, Xianwei Zhuang, Liming Liang, Yuexian Zou |
| 2025 | ACL | Can We Trust AI Doctors? A Survey of Medical Hallucination in Large Language and Large Vision-Language Models. | Zhihong Zhu, Yunyan Zhang, Xianwei Zhuang, Fan Zhang, Zhongwei Wan, Yuyan Chen, Qingqing Long, Yefeng Zheng, Xian Wu |
| 2025 | CVPR | VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification. | Xianwei Zhuang, Zhihong Zhu, Yuxin Xie, Liming Liang, Yuexian Zou |
| 2025 | ICASSP | HCoTT: Hierarchical Chain-of-Thought Distillation. | Zhichang Wang, Xianwei Zhuang, Zhihong Zhu, Yuexian Zou |
| 2025 | ICLR | UniCoTT: A Unified Framework for Structural Chain-of-Thought Distillation. | Xianwei Zhuang, Zhihong Zhu, Zhichang Wang, Xuxin Cheng, Yuexian Zou |
| 2025 | Interspeech | FoleyMaster: High-Quality Video-to-Audio Synthesis via MLLM-Augmented Prompt Tuning and Joint Semantic-Temporal Adaptation. | Liming Liang, Luo Chen, Yuehan Jin, Xianwei Zhuang, Yuxin Xie, Yongkang Yin, Yuexian Zou |
| 2025 | Interspeech | SpeechSEC: A Unified Multi-Task Framework for Speech Synthesis, Editing, and Continuation. | Liming Liang, Dongchao Yang, Xianwei Zhuang, Yuxin Xie, Luo Chen, Yuehan Jin, Yuexian Zou |
| 2024 | AAAI | Towards Multi-Intent Spoken Language Understanding via Hierarchical Attention and Optimal Transport. | Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yaowei Li, Xianwei Zhuang, Yuexian Zou |
| 2024 | AAAI | Towards Explainable Joint Models via Information Theory for Multiple Intent Detection and Slot Filling. | Xianwei Zhuang, Xuxin Cheng, Yuexian Zou |
| 2024 | ACL | Cyclical Contrastive Learning Based on Geodesic for Zero-shot Cross-lingual Spoken Language Understanding. | Xuxin Cheng, Zhihong Zhu, Bang Yang, Xianwei Zhuang, Hongxiang Li, Yuexian Zou |
| 2024 | ACL | MoE-SLU: Towards ASR-Robust Spoken Language Understanding via Mixture-of-Experts. | Xuxin Cheng, Zhihong Zhu, Xianwei Zhuang, Zhanpeng Chen, Zhiqi Huang, Yuexian Zou |
| 2024 | ACL | PCAD: Towards ASR-Robust Spoken Language Understanding via Prototype Calibration and Asymmetric Decoupling. | Xianwei Zhuang, Xuxin Cheng, Liming Liang, Yuxin Xie, Zhichang Wang, Zhiqi Huang, Yuexian Zou |
| 2024 | ACL | Code-Switching Can be Better Aligners: Advancing Cross-Lingual SLU through Representation-Level and Prediction-Level Alignment. | Zhihong Zhu, Xuxin Cheng, Zhanpeng Chen, Xianwei Zhuang, Zhiqi Huang, Yuexian Zou |
| 2024 | ECCV | Uncertainty-Aware Sign Language Video Retrieval with Probability Distribution Modeling. | Xuan Wu, Hongxiang Li, Yuanjiang Luo, Xuxin Cheng, Xianwei Zhuang, Meng Cao, Keren Fu |
| 2024 | ECCV | KDProR: A Knowledge-Decoupling Probabilistic Framework for Video-Text Retrieval. | Xianwei Zhuang, Hongxiang Li, Xuxin Cheng, Zhihong Zhu, Yuxin Xie, Yuexian Zou |
| 2024 | EMNLP | Relevance Is a Guiding Light: Relevance-aware Adaptive Learning for End-to-end Task-oriented Dialogue System. | Zhanpeng Chen, Zhihong Zhu, Wanshi Xu, Xianwei Zhuang, Yuexian Zou |
| 2024 | EMNLP | Dual-oriented Disentangled Network with Counterfactual Intervention for Multimodal Intent Detection. | Zhanpeng Chen, Zhihong Zhu, Xianwei Zhuang, Zhiqi Huang, Yuexian Zou |
| 2024 | EMNLP | What are the Generator Preferences for End-to-end Task-Oriented Dialog System? | Wanshi Xu, Xianwei Zhuang, Zhanpeng Chen, Zhihong Zhu, Xuxin Cheng, Yuexian Zou |
| 2024 | EMNLP | Game on Tree: Visual Hallucination Mitigation via Coarse-to-Fine View Tree and Game Theory. | Xianwei Zhuang, Zhihong Zhu, Zhanpeng Chen, Yuxin Xie, Liming Liang, Yuexian Zou |
| 2024 | IJCAI | TFCD: Towards Multi-modal Sarcasm Detection via Training-Free Counterfactual Debiasing. | Zhihong Zhu, Xianwei Zhuang, Yunyan Zhang, Derong Xu, Guimin Hu, Xian Wu, Yefeng Zheng |
| 2024 | Interspeech | GPA: Global and Prototype Alignment for Audio-Text Retrieval. | Yuxin Xie, Zhihong Zhu, Xianwei Zhuang, Liming Liang, Zhichang Wang, Yuexian Zou |
| 2024 | NAACL | MaCSC: Towards Multimodal-augmented Pre-trained Language Models via Conceptual Prototypes and Self-balancing Calibration. | Xianwei Zhuang, Zhichang Wang, Xuxin Cheng, Yuxin Xie, Liming Liang, Yuexian Zou |
| 2022 | ICIP | Residual Swin Transformer Unet with Consistency Regularization for Automatic Breast Ultrasound Tumor Segmentation. | Xianwei Zhuang, Xiner Zhu, Haoji Hu, Jincao Yao, Wei Li, Chen Yang, Liping Wang, Na Feng, Dong Xu |