| 2026 | AAAI | Not All Tokens and Heads Are Equally Important: Dual-Level Attention Intervention for Hallucination Mitigation. | Lexiang Tang, Xianwei Zhuang, Bang Yang, Zhiyuan Hu, Hongxiang Li, Lu Ma, Jinghan Ru, Yuexian Zou |
| 2026 | AAAI | WhisperDiari: A Whisper-Based Speaker Diarization Framework in Token Space Leveraging Semantic and Speaker Information for Better Text Adaptability. | Yongkang Yin, Yuexian Zou |
| 2026 | SIGGRAPH | ViewWeaver: Geometry-Grounded Generative Rendering for 3D-Aware Image Customization. | Yaowei Li, Xiaoyu Li, Zhaoyang Zhang, Hongxiang Li, Long Chen, Ying Shan, Yuexian Zou |
| 2025 | AAAI | Image Conductor: Precision Control for Interactive Video Synthesis. | Yaowei Li, Xintao Wang, Zhaoyang Zhang, Zhouxia Wang, Ziyang Yuan, Liangbin Xie, Ying Shan, Yuexian Zou |
| 2025 | ACL | Advancing General Multimodal Capability of Vision-language Models with Pyramid-descent Visual Position Encoding. | Zhanpeng Chen, Mingxiao Li, Ziyang Chen, Nan Du, Xiaolong Li, Yuexian Zou |
| 2025 | ACL | ATRI: Mitigating Multilingual Audio Text Retrieval Inconsistencies by Reducing Data Distribution Errors. | Yuguo Yin, Yuxin Xie, Wenyuan Yang, Dongchao Yang, Jinghan Ru, Xianwei Zhuang, Liming Liang, Yuexian Zou |
| 2025 | CVPR | VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification. | Xianwei Zhuang, Zhihong Zhu, Yuxin Xie, Liming Liang, Yuexian Zou |
| 2025 | ICASSP | HCoTT: Hierarchical Chain-of-Thought Distillation. | Zhichang Wang, Xianwei Zhuang, Zhihong Zhu, Yuexian Zou |
| 2025 | ICASSP | Audio-Faces Intra-Frame Alignment with Graph Attention Networks for Active Speaker Detection. | Yongkang Yin, Xusheng Yang, Liming Liang, Xu Li, Yuexian Zou |
| 2025 | ICLR | UniCoTT: A Unified Framework for Structural Chain-of-Thought Distillation. | Xianwei Zhuang, Zhihong Zhu, Zhichang Wang, Xuxin Cheng, Yuexian Zou |
| 2025 | Interspeech | FoleyMaster: High-Quality Video-to-Audio Synthesis via MLLM-Augmented Prompt Tuning and Joint Semantic-Temporal Adaptation. | Liming Liang, Luo Chen, Yuehan Jin, Xianwei Zhuang, Yuxin Xie, Yongkang Yin, Yuexian Zou |
| 2025 | Interspeech | SpeechSEC: A Unified Multi-Task Framework for Speech Synthesis, Editing, and Continuation. | Liming Liang, Dongchao Yang, Xianwei Zhuang, Yuxin Xie, Luo Chen, Yuehan Jin, Yuexian Zou |
| 2025 | SiggraphA | BlobCtrl: Taming Controllable Blob for Element-level Image Editing. | Yaowei Li, Lingen Li, Zhaoyang Zhang, Xiaoyu Li, Guangzhi Wang, Hongxiang Li, Xiaodong Cun, Ying Shan, Yuexian Zou |
| 2024 | AAAI | Towards Multi-Intent Spoken Language Understanding via Hierarchical Attention and Optimal Transport. | Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yaowei Li, Xianwei Zhuang, Yuexian Zou |
| 2024 | AAAI | AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head. | Rongjie Huang, Mingze Li, Dongchao Yang, Jiatong Shi, Xuankai Chang, Zhenhui Ye, Yuning Wu, Zhiqing Hong, Jiawei Huang, Jinglin Liu, Yi Ren, Yuexian Zou, Zhou Zhao, Shinji Watanabe |
| 2024 | AAAI | Exploiting Auxiliary Caption for Video Grounding. | Hongxiang Li, Meng Cao, Xuxin Cheng, Yaowei Li, Zhihong Zhu, Yuexian Zou |
| 2024 | AAAI | Embracing Language Inclusivity and Diversity in CLIP through Continual Language Learning. | Bang Yang, Yong Dai, Xuxin Cheng, Yaowei Li, Asif Raza, Yuexian Zou |
| 2024 | AAAI | Towards Explainable Joint Models via Information Theory for Multiple Intent Detection and Slot Filling. | Xianwei Zhuang, Xuxin Cheng, Yuexian Zou |
| 2024 | AAAI | Aligner²: Enhancing Joint Multiple Intent Detection and Slot Filling via Adjustive and Forced Cross-Task Alignment. | Zhihong Zhu, Xuxin Cheng, Yaowei Li, Hongxiang Li, Yuexian Zou |
| 2024 | ACL | Soul-Mix: Enhancing Multimodal Machine Translation with Manifold Mixup. | Xuxin Cheng, Ziyu Yao, Yifei Xin, Hao An, Hongxiang Li, Yaowei Li, Yuexian Zou |
| 2024 | ACL | Cyclical Contrastive Learning Based on Geodesic for Zero-shot Cross-lingual Spoken Language Understanding. | Xuxin Cheng, Zhihong Zhu, Bang Yang, Xianwei Zhuang, Hongxiang Li, Yuexian Zou |
| 2024 | ACL | MoE-SLU: Towards ASR-Robust Spoken Language Understanding via Mixture-of-Experts. | Xuxin Cheng, Zhihong Zhu, Xianwei Zhuang, Zhanpeng Chen, Zhiqi Huang, Yuexian Zou |
| 2024 | ACL | PCAD: Towards ASR-Robust Spoken Language Understanding via Prototype Calibration and Asymmetric Decoupling. | Xianwei Zhuang, Xuxin Cheng, Liming Liang, Yuxin Xie, Zhichang Wang, Zhiqi Huang, Yuexian Zou |
| 2024 | ACL | Code-Switching Can be Better Aligners: Advancing Cross-Lingual SLU through Representation-Level and Prediction-Level Alignment. | Zhihong Zhu, Xuxin Cheng, Zhanpeng Chen, Xianwei Zhuang, Zhiqi Huang, Yuexian Zou |
| 2024 | CIKM | Robust Heterophily Graph Learning via Uniformity Augmentation. | Xusheng Yang, Zhengyu Chen, Yuexian Zou |
| 2024 | CIKM | SaLa: Scenario-aware Label Graph Interaction for Multi-intent Spoken Language Understanding. | Zhihong Zhu, Xuxin Cheng, Zhanpeng Chen, Zhichang Wang, Zhiqi Huang, Yuexian Zou |
| 2024 | COLING | Knowledge-enhanced Prompt Tuning for Dialogue-based Relation Extraction with Trigger and Label Semantic. | Hao An, Zhihong Zhu, Xuxin Cheng, Zhiqi Huang, Yuexian Zou |
| 2024 | COLING | Towards Multi-modal Sarcasm Detection via Disentangled Multi-grained Multi-modal Distilling. | Zhihong Zhu, Xuxin Cheng, Guimin Hu, Yaowei Li, Zhiqi Huang, Yuexian Zou |
| 2024 | ECCV | KDProR: A Knowledge-Decoupling Probabilistic Framework for Video-Text Retrieval. | Xianwei Zhuang, Hongxiang Li, Xuxin Cheng, Zhihong Zhu, Yuxin Xie, Yuexian Zou |
| 2024 | EMNLP | Relevance Is a Guiding Light: Relevance-aware Adaptive Learning for End-to-end Task-oriented Dialogue System. | Zhanpeng Chen, Zhihong Zhu, Wanshi Xu, Xianwei Zhuang, Yuexian Zou |
| 2024 | EMNLP | Dual-oriented Disentangled Network with Counterfactual Intervention for Multimodal Intent Detection. | Zhanpeng Chen, Zhihong Zhu, Xianwei Zhuang, Zhiqi Huang, Yuexian Zou |
| 2024 | EMNLP | Learning to Match Representations is Better for End-to-End Task-Oriented Dialog System. | Wanshi Xu, Xuxin Cheng, Zhihong Zhu, Zhanpeng Chen, Yuexian Zou |
| 2024 | EMNLP | What are the Generator Preferences for End-to-end Task-Oriented Dialog System? | Wanshi Xu, Xianwei Zhuang, Zhanpeng Chen, Zhihong Zhu, Xuxin Cheng, Yuexian Zou |
| 2024 | EMNLP | Game on Tree: Visual Hallucination Mitigation via Coarse-to-Fine View Tree and Game Theory. | Xianwei Zhuang, Zhihong Zhu, Zhanpeng Chen, Yuxin Xie, Liming Liang, Yuexian Zou |
| 2024 | ICLR | Retrieval is Accurate Generation. | Bowen Cao, Deng Cai, Leyang Cui, Xuxin Cheng, Wei Bi, Yuexian Zou, Shuming Shi |
| 2024 | ICONIP | Multi-scale Spatial Feature Aggregation For Efficient Super Resolution. | XinChao Wang, Hongxiang Li, Xinzhong Sun, Lihong Zhao, Liqiang Wang, Kai Zhang, Xuzhen Hu, Yong Wang, Yuexian Zou |
| 2024 | ICONIP | PoseRAC: Enhancing Repetitive Action Counting with Salient Poses. | Ziyu Yao, Yuexian Zou |
| 2024 | IJCAI | Generating More Audios for End-to-End Spoken Language Understanding. | Xuxin Cheng, Yuexian Zou |
| 2024 | Interspeech | GPA: Global and Prototype Alignment for Audio-Text Retrieval. | Yuxin Xie, Zhihong Zhu, Xianwei Zhuang, Liming Liang, Zhichang Wang, Yuexian Zou |
| 2024 | Interspeech | DiffATR: Diffusion-based Generative Modeling for Audio-Text Retrieval. | Yifei Xin, Xuxin Cheng, Zhihong Zhu, Xusheng Yang, Yuexian Zou |
| 2024 | Interspeech | Audio-text Retrieval with Transformer-based Hierarchical Alignment and Disentangled Cross-modal Representation. | Yifei Xin, Zhihong Zhu, Xuxin Cheng, Xusheng Yang, Yuexian Zou |
| 2024 | Interspeech | AFL-Net: Integrating Audio, Facial, and Lip Modalities with a Two-step Cross-attention for Robust Speaker Diarization in the Wild. | Yongkang Yin, Xu Li, Ying Shan, Yuexian Zou |
| 2024 | NAACL | MaCSC: Towards Multimodal-augmented Pre-trained Language Models via Conceptual Prototypes and Self-balancing Calibration. | Xianwei Zhuang, Zhichang Wang, Xuxin Cheng, Yuxin Xie, Liming Liang, Yuexian Zou |
| 2024 | WSDM | Dance with Labels: Dual-Heterogeneous Label Graph Interaction for Multi-intent Spoken Language Understanding. | Zhihong Zhu, Xuxin Cheng, Hongxiang Li, Yaowei Li, Yuexian Zou |
| 2023 | AAAI | FTM: A Frame-Level Timeline Modeling Method for Temporal Graph Representation Learning. | Bowen Cao, Qichen Ye, Weiyuan Xu, Yuexian Zou |
| 2023 | AAAI | FiTs: Fine-Grained Two-Stage Training for Knowledge-Aware Question Answering. | Qichen Ye, Bowen Cao, Nuo Chen, Weiyuan Xu, Yuexian Zou |
| 2023 | ACL | ML-LMCL: Mutual Learning and Large-Margin Contrastive Learning for Improving ASR Robustness in Spoken Language Understanding. | Xuxin Cheng, Bowen Cao, Qichen Ye, Zhihong Zhu, Hongxiang Li, Yuexian Zou |
| 2023 | ACL | Multimodal Prompt Learning for Product Title Generation with Extremely Limited Labels. | Bang Yang, Fenglin Liu, Zheng Li, Qingyu Yin, Chenyu You, Bing Yin, Yuexian Zou |
| 2023 | ACL | MultiCapCLIP: Auto-Encoding Prompts for Zero-Shot Multilingual Visual Captioning. | Bang Yang, Fenglin Liu, Xian Wu, Yaowei Wang, Xu Sun, Yuexian Zou |
| 2023 | ACL | Towards Unified Spoken Language Understanding Decoding via Label-aware Compact Linguistics Representations. | Zhihong Zhu, Xuxin Cheng, Zhiqi Huang, Dongsheng Chen, Yuexian Zou |
| 2023 | CIKM | Towards Spoken Language Understanding via Multi-level Multi-grained Contrastive Learning. | Xuxin Cheng, Wanshi Xu, Zhihong Zhu, Hongxiang Li, Yuexian Zou |
| 2023 | CIKM | DAS-CL: Towards Multimodal Machine Translation via Dual-Level Asymmetric Contrastive Learning. | Xuxin Cheng, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou |
| 2023 | CSCWD | TLAG: An Informative Trigger and Label-Aware Knowledge Guided Model for Dialogue-based Relation Extraction. | Hao An, Dongsheng Chen, Weiyuan Xu, Zhihong Zhu, Yuexian Zou |
| 2023 | CVPR | Iterative Proposal Refinement for Weakly-Supervised Video Grounding. | Meng Cao, Fangyun Wei, Can Xu, Xiubo Geng, Long Chen, Can Zhang, Yuexian Zou, Tao Shen, Daxin Jiang |
| 2023 | EMNLP | MRRL: Modifying the Reference via Reinforcement Learning for Non-Autoregressive Joint Multiple Intent Detection and Slot Filling. | Xuxin Cheng, Zhihong Zhu, Bowen Cao, Qichen Ye, Yuexian Zou |
| 2023 | EMNLP | Accelerating Multiple Intent Detection and Slot Filling via Targeted Knowledge Distillation. | Xuxin Cheng, Zhihong Zhu, Wanshi Xu, Yaowei Li, Hongxiang Li, Yuexian Zou |
| 2023 | EMNLP | Enhancing Code-Switching for Cross-lingual SLU: A Unified View of Semantic and Grammatical Coherence. | Zhihong Zhu, Xuxin Cheng, Zhiqi Huang, Dongsheng Chen, Yuexian Zou |
| 2023 | ICASSP | M | Xuxin Cheng, Qianqian Dong, Fengpeng Yue, Tom Ko, Mingxuan Wang, Yuexian Zou |
| 2023 | ICASSP | SSVMR: Saliency-Based Self-Training for Video-Music Retrieval. | Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yaowei Li, Yuexian Zou |
| 2023 | ICASSP | Improving Retrieval-Based Dialogue System Via Syntax-Informed Attention. | Tengtao Song, Nuo Chen, Ji Jiang, Zhihong Zhu, Yuexian Zou |
| 2023 | ICASSP | Improving Weakly Supervised Sound Event Detection with Causal Intervention. | Yifei Xin, Dongchao Yang, Fan Cui, Yujun Wang, Yuexian Zou |
| 2023 | ICASSP | Improving Text-Audio Retrieval by Text-Aware Attention Pooling and Prior Matrix Revised Loss. | Yifei Xin, Dongchao Yang, Yuexian Zou |
| 2023 | ICASSP | A Dynamic Graph Interactive Framework with Label-Semantic Injection for Spoken Language Understanding. | Zhihong Zhu, Weiyuan Xu, Xuxin Cheng, Tengtao Song, Yuexian Zou |
| 2023 | ICCV | G2L: Semantically Aligned and Uniform Video Grounding via Geodesic and Game Theory. | Hongxiang Li, Meng Cao, Xuxin Cheng, Yaowei Li, Zhihong Zhu, Yuexian Zou |
| 2023 | ICCV | Unify, Align and Refine: Multi-Level Semantic Alignment for Radiology Report Generation. | Yaowei Li, Bang Yang, Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yuexian Zou |
| 2023 | Interspeech | C²A-SLU: Cross and Contrastive Attention for Improving ASR Robustness in Spoken Language Understanding. | Xuxin Cheng, Ziyu Yao, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou |
| 2023 | Interspeech | FC-MTLF: A Fine- and Coarse-grained Multi-Task Learning Framework for Cross-Lingual Spoken Language Understanding. | Xuxin Cheng, Wanshi Xu, Ziyu Yao, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou |
| 2023 | Interspeech | GhostT5: Generate More Features with Cheap Operations to Improve Textless Spoken Question Answering. | Xuxin Cheng, Zhihong Zhu, Ziyu Yao, Hongxiang Li, Yaowei Li, Yuexian Zou |
| 2023 | Interspeech | Background-aware Modeling for Weakly Supervised Sound Event Detection. | Yifei Xin, Dongchao Yang, Yuexian Zou |
| 2023 | Interspeech | Improving Audio-Text Retrieval via Hierarchical Cross-Modal Interaction and Auxiliary Captions. | Yifei Xin, Yuexian Zou |
| 2023 | Interspeech | NoreSpeech: Knowledge Distillation based Conditional Diffusion Model for Noise-robust Expressive TTS. | Dongchao Yang, Songxiang Liu, Helin Wang, Jianwei Yu, Chao Weng, Yuexian Zou |
| 2023 | Interspeech | Mix before Align: Towards Zero-shot Cross-lingual Sentiment Analysis via Soft-Mix and Multi-View Learning. | Zhihong Zhu, Xuxin Cheng, Dongsheng Chen, Zhiqi Huang, Hongxiang Li, Yuexian Zou |
| 2022 | COLING | A Transformer-based Threshold-Free Framework for Multi-Intent NLU. | Lisung Chen, Nuo Chen, Yuexian Zou, Yong Wang, Xinzhong Sun |
| 2022 | CVPR | Unsupervised Pre-training for Temporal Action Localization Tasks. | Can Zhang, Tianyu Yang, Junwu Weng, Meng Cao, Jue Wang, Yuexian Zou |
| 2022 | ECCV | LocVTP: Video-Text Pre-training for Temporal Localization. | Meng Cao, Tianyu Yang, Junwu Weng, Can Zhang, Jue Wang, Yuexian Zou |
| 2022 | ICANN | Visual Relation-Aware Unsupervised Video Captioning. | Puzhao Ji, Meng Cao, Yuexian Zou |
| 2022 | ICASSP | Leveraging Bilinear Attention to Improve Spoken Language Understanding. | Dongsheng Chen, Zhiqi Huang, Yuexian Zou |
| 2022 | ICASSP | Joint Multiple Intent Detection and Slot Filling Via Self-Distillation. | Lisong Chen, Peilin Zhou, Yuexian Zou |
| 2022 | ICASSP | Consistent Training and Decoding for End-to-End Speech Recognition Using Lattice-Free MMI. | Jinchuan Tian, Jianwei Yu, Chao Weng, Shi-Xiong Zhang, Dan Su, Dong Yu, Yuexian Zou |
| 2022 | ICASSP | Learning Decoupling Features Through Orthogonality Regularization. | Li Wang, Rongzhi Gu, Weiji Zhuang, Peng Gao, Yujun Wang, Yuexian Zou |
| 2022 | ICASSP | Improving Dual-Microphone Speech Enhancement by Learning Cross-Channel Features with Multi-Head Attention. | Xinmeng Xu, Rongzhi Gu, Yuexian Zou |
| 2022 | ICASSP | A Mutual Learning Framework for Few-Shot Sound Event Detection. | Dongchao Yang, Helin Wang, Yuexian Zou, Zhongjie Ye, Wenwu Wang |
| 2022 | IJCAI | Towards Joint Intent Detection and Slot Filling via Higher-order Attention. | Dongsheng Chen, Zhiqi Huang, Xian Wu, Shen Ge, Yuexian Zou |
| 2022 | Interspeech | LAE: Language-Aware Encoder for Monolingual and Multilingual ASR. | Jinchuan Tian, Jianwei Yu, Chunlei Zhang, Yuexian Zou, Dong Yu |
| 2022 | Interspeech | Improving Target Sound Extraction with Timestamp Information. | Helin Wang, Dongchao Yang, Chao Weng, Jianwei Yu, Yuexian Zou |
| 2022 | Interspeech | Audio Pyramid Transformer with Domain Adaption for Weakly Supervised Sound Event Detection and Audio Classification. | Yifei Xin, Dongchao Yang, Yuexian Zou |
| 2022 | Interspeech | RaDur: A Reference-aware and Duration-robust Network for Target Sound Detection. | Dongchao Yang, Helin Wang, Zhongjie Ye, Yuexian Zou, Wenwu Wang |
| 2022 | Interspeech | Speaker-Aware Mixture of Mixtures Training for Weakly Supervised Speaker Extraction. | Zifeng Zhao, Rongzhi Gu, Dongchao Yang, Jinchuan Tian, Yuexian Zou |
| 2022 | Interspeech | Target Confusion in End-to-end Speaker Extraction: Analysis and Approaches. | Zifeng Zhao, Dongchao Yang, Rongzhi Gu, Haoran Zhang, Yuexian Zou |
| 2022 | NAACL | End-to-end Spoken Conversational Question Answering: Task, Dataset and Model. | Chenyu You, Nuo Chen, Fenglin Liu, Shen Ge, Xian Wu, Yuexian Zou |
| 2021 | AAAI | Audio-Oriented Multimodal Machine Comprehension via Dynamic Inter- and Intra-modality Attention. | Zhiqi Huang, Fenglin Liu, Xian Wu, Shen Ge, Helin Wang, Wei Fan, Yuexian Zou |
| 2021 | AAAI | Non-Autoregressive Coarse-to-Fine Video Captioning. | Bang Yang, Yuexian Zou, Fenglin Liu, Can Zhang |
| 2021 | CVPR | Exploring and Distilling Posterior and Prior Knowledge for Radiology Report Generation. | Fenglin Liu, Xian Wu, Shen Ge, Wei Fan, Yuexian Zou |
| 2021 | CVPR | CoLA: Weakly-Supervised Temporal Action Localization With Snippet Contrastive Learning. | Can Zhang, Meng Cao, Dongming Yang, Jie Chen, Yuexian Zou |
| 2021 | EMNLP | On Pursuit of Designing Multi-modal Transformer for Video Grounding. | Meng Cao, Long Chen, Mike Zheng Shou, Can Zhang, Yuexian Zou |
| 2021 | EMNLP | Self-supervised Contrastive Cross-Modality Representation Learning for Spoken Question Answering. | Chenyu You, Nuo Chen, Yuexian Zou |
| 2021 | ICASSP | Adaptive Bi-Directional Attention: Exploring Multi-Granularity Representations for Machine Reading Comprehension. | Nuo Chen, Fenglin Liu, Chenyu You, Peilin Zhou, Yuexian Zou |
| 2021 | ICASSP | Sentiment Injected Iteratively Co-Interactive Network for Spoken Language Understanding. | Zhiqi Huang, Fenglin Liu, Peilin Zhou, Yuexian Zou |
| 2021 | ICASSP | SRF-Net: Selective Receptive Field Network for Anchor-Free Temporal Action Detection. | Ranyu Ning, Can Zhang, Yuexian Zou |
| 2021 | ICASSP | FWB-Net: Front White Balance Network for Color Shift Correction in Single Image Dehazing Via Atmospheric Light Estimation. | Cong Wang, Yan Huang, Yuexian Zou, Yong Xu |
| 2021 | ICASSP | A Global-Local Attention Framework for Weakly Labelled Audio Tagging. | Helin Wang, Yuexian Zou, Wenwu Wang |
| 2021 | ICASSP | Long-Short Temporal Modeling for Efficient Action Recognition. | Liyu Wu, Yuexian Zou, Can Zhang |
| 2021 | ICASSP | Knowledge Distillation for Improved Accuracy in Spoken Question Answering. | Chenyu You, Nuo Chen, Yuexian Zou |
| 2021 | ICASSP | Contrastive Self-Supervised Learning for Text-Independent Speaker Verification. | Haoran Zhang, Yuexian Zou, Helin Wang |
| 2021 | IJCAI | RR-Net: Injecting Interactive Semantics in Human-Object Interaction Detection. | Dongming Yang, Yuexian Zou, Can Zhang, Meng Cao, Jie Chen |
| 2021 | IJCAI | MRD-Net: Multi-Modal Residual Knowledge Distillation for Spoken Question Answering. | Chenyu You, Nuo Chen, Yuexian Zou |
| 2021 | Interspeech | Self-Supervised Dialogue Learning for Spoken Conversational Question Answering. | Nuo Chen, Chenyu You, Yuexian Zou |
| 2021 | Interspeech | Text Anchor Based Metric Learning for Small-Footprint Keyword Spotting. | Li Wang, Rongzhi Gu, Nuo Chen, Yuexian Zou |
| 2021 | Interspeech | SpecAugment++: A Hidden Space Data Augmentation Method for Acoustic Scene Classification. | Helin Wang, Yuexian Zou, Wenwu Wang |
| 2021 | Interspeech | Semantic Transportation Prototypical Network for Few-Shot Intent Detection. | Weiyuan Xu, Peilin Zhou, Chenyu You, Yuexian Zou |
| 2021 | Interspeech | Unsupervised Multi-Target Domain Adaptation for Acoustic Scene Classification. | Dongchao Yang, Helin Wang, Yuexian Zou |
| 2021 | Interspeech | Contextualized Attention-Based Knowledge Transfer for Spoken Conversational Question Answering. | Chenyu You, Nuo Chen, Yuexian Zou |
| 2020 | AAAI | Federated Learning for Vision-and-Language Grounding Problems. | Fenglin Liu, Xian Wu, Shen Ge, Wei Fan, Yuexian Zou |
| 2020 | COLING | Federated Learning for Spoken Language Understanding. | Zhiqi Huang, Fenglin Liu, Yuexian Zou |
| 2020 | COLING | Rethinking Skip Connection with Layer Normalization. | Fenglin Liu, Xuancheng Ren, Zhiyuan Zhang, Xu Sun, Yuexian Zou |
| 2020 | ICASSP | All You Need is a Second Look: Towards Tighter Arbitrary Shape Text Detection. | Meng Cao, Yuexian Zou |
| 2020 | ICASSP | Enhancing End-to-End Multi-Channel Speech Separation Via Spatial Feature Learning. | Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |
| 2020 | ICASSP | Weakly Labelled Audio Tagging Via Convolutional Networks with Spatial and Channel-Wise Attention. | Sixin Hong, Yuexian Zou, Wenwu Wang, Meng Cao |
| 2020 | ICASSP | Semanticgan: Generative Adversarial Networks For Semantic Image To Photo-Realistic Image Translation. | Junling Liu, Yuexian Zou, Dongming Yang |
| 2020 | ICIP | ABC-NET: Avoiding Blocking Effect & Color Shift Network for Single Image Dehazing Via Restraining Transmission Bias. | Cong Wang, Yuexian Zou, Zehan Chen |
| 2020 | IJCAI | A Graph-based Interactive Reasoning for Human-Object Interaction Detection. | Dongming Yang, Yuexian Zou |
| 2020 | ICPR | Visual Oriented Encoder: Integrating Multimodal and Multi-Scale Contexts for Video Captioning. | Bang Yang, Yuexian Zou |
| 2020 | ICPR | PIN: A Novel Parallel Interactive Network for Spoken Language Understanding. | Peilin Zhou, Zhiqi Huang, Fenglin Liu, Yuexian Zou |
| 2020 | Interspeech | Gated Multi-Head Attention Pooling for Weakly Labelled Audio Tagging. | Sixin Hong, Yuexian Zou, Wenwu Wang |
| 2020 | Interspeech | Deep Speaker Embedding with Long Short Term Centroid Learning for Text-Independent Speaker Verification. | Junyi Peng, Rongzhi Gu, Yuexian Zou |
| 2020 | Interspeech | Environmental Sound Classification with Parallel Temporal-Spectral Attention. | Helin Wang, Yuexian Zou, Dading Chong, Wenwu Wang |
| 2019 | ACII | Speech Emotion Recognition using Spectral Normalized CycleGAN. | Wan Ding, Dong-Yan Huang, Danqing Luo, Yuexian Zou |
| 2019 | ACII | What Affects the Performance of Convolutional Neural Networks for Audio Event Classification. | Helin Wang, Dading Chong, Dongyan Huang, Yuexian Zou |
| 2019 | ASRU | Logistic Similarity Metric Learning via Affinity Matrix for Text-Independent Speaker Verification. | Junyi Peng, Rongzhi Gu, Yuexian Zou |
| 2019 | ASRU | Syllable-Dependent Discriminative Learning for Small Footprint Text-Dependent Speaker Verification. | Junyi Peng, Yuexian Zou, Na Li, Deyi Tuo, Dan Su, Meng Yu, Chunlei Zhang, Dong Yu |
| 2019 | ICANN | Discriminative Feature Learning Using Two-Stage Training Strategy for Facial Expression Recognition. | Lei Gan, Yuexian Zou, Can Zhang |
| 2019 | ICANN | Discriminative Feature Learning for Speech Emotion Recognition. | Yuying Zhang, Yuexian Zou, Junyi Peng, Danqing Luo, Dongyan Huang |
| 2019 | ICASSP | Selecting Optimal Proposal Number for Image-based Object Detection. | Wenjie Guan, Xiaoqun Zhou, Ge Li, Yuexian Zou |
| 2019 | ICASSP | Labelled Non-zero Particle Flow for SMC-PHD Filtering. | Yang Liu, Qinghua Hu, Yuexian Zou, Wenwu Wang |
| 2019 | ICASSP | Semantic Super-resolution for Extremely Low-resolution Vehicle License Plate. | Yuexian Zou, Yi Wang, Wenjie Guan, Wenwu Wang |
| 2019 | ICDM | Exploring Semantic Relationships for Image Captioning without Parallel Data. | Fenglin Liu, Meng Gao, Tianhao Zhang, Yuexian Zou |
| 2019 | Interspeech | Neural Spatial Filter: Target Speaker Speech Separation Assisted with Directional Information. | Rongzhi Gu, Lianwu Chen, Shi-Xiong Zhang, Jimeng Zheng, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |
| 2019 | MMM | STMP: Spatial Temporal Multi-level Proposal Network for Activity Detection. | Guang Chen, Yuexian Zou, Can Zhang |
| 2019 | MMM | Multi-channel Convolutional Neural Networks with Multi-level Feature Fusion for Environmental Sound Classification. | Dading Chong, Yuexian Zou, Wenwu Wang |
| 2019 | MMM | Enhancing Scene Text Detection via Fused Semantic Segmentation Network with Attention. | Chao Liu, Yuexian Zou, Dongming Yang |
| 2019 | MMM | Using Coarse Label Constraint for Fine-Grained Visual Classification. | Chaohao Lu, Yuexian Zou |
| 2019 | MMM | Hierarchical Temporal Pooling for Efficient Online Action Recognition. | Can Zhang, Yuexian Zou, Guang Chen |
| 2019 | VCIP | Scale-Informed Density Estimation for Dense Crowd Counting. | Zirui Li, Yuexian Zou, Guoshuai Wang, Jian Zhang |
| 2018 | ICASSP | Inverse Atmoshperic Scattering Modeling with Convolutional Neural Networks for Single Image Dehazing. | Zehan Chen, Yi Wang, Yuexian Zou |
| 2018 | ICASSP | Multi-Scale Object Detection with Feature Fusion and Region Objectness Network. | Wenjie Guan, Yuexian Zou, Xiaoqun Zhou |
| 2018 | ICPR | LD-CNN: A Lightweight Dilated Convolutional Neural Network for Environmental Sound Classification. | Xiaohu Zhang, Yuexian Zou, Wenwu Wang |
| 2018 | Interspeech | Investigation on Joint Representation Learning for Robust Feature Extraction in Speech Emotion Recognition. | Danqing Luo, Yuexian Zou, Dongyan Huang |
| 2018 | Interspeech | Joint Noise and Reverberation Adaptive Learning for Robust Speaker DOA Estimation with an Acoustic Vector Sensor. | Disong Wang, Yuexian Zou |
| 2017 | ICASSP | Example-based Visual Object Counting for complex background with a local low-rank constraint. | X. L. Huang, Yuexian Zou, Y. Wang |
| 2017 | ICASSP | Robust speaker DOA estimation based on the inter-sensor data ratio model and binary mask estimation in the bispectrum domain. | Yanhan Jin, Yuexian Zou, Christian H. Ritz |
| 2017 | ICIP | Accurate small object detection via density map aided saliency estimation. | X. Q. Zhou, Yuexian Zou, Y. Wang |
| 2016 | ICIP | Fast visual object counting via example-based density estimation. | Yi Wang, Yuexian Zou |
| 2016 | ICPR | Wireless capsule endoscopy video summarization: A learning approach based on Siamese neural network and support vector machine. | Jin Chen, Yuexian Zou, Yi Wang |
| 2016 | ICPR | An effective voiceprint based identity authentication system for Mandarin smartphone users. | Junhong Liu, Yuexian Zou, Yichi Huang |
| 2015 | ICASSP | A parametric modeling approach for wireless capsule endoscopy hazy image restoration. | Yi Wang, Cheng Cai, Ji Liu, Yuexian Zou |
| 2015 | ICIP | Multi-kernel collaborative representation for image classification. | Weiyang Liu, Zhiding Yu, Yandong Wen, Meng Yang, Yuexian Zou |
| 2014 | ICIP | A novel kernel collaborative representation approach for image classification. | Weiyang Liu, Lijia Lu, Hui Li, Wei Wang, Yuexian Zou |
| 2009 | HIS | Video Image Vehicle Detection System for Signaled Traffic Intersection. | Yiyan Wang, Yuexian Zou, Hang Shi, He Zhao |
| 2009 | HIS | Image Sequences Based Traffic Incident Detection for Signaled Intersections Using HMM. | Yuexian Zou, Guangyi Shi, Hang Shi, Yiyan Wang |
| 2003 | ICASSP | A piloted adaptive notch filter. | Yong Ching Lim, Yuexian Zou, N. Zheng |
| 2001 | ICASSP | A Huber recursive least squares adaptive lattice filter for impulse noise suppression. | Yuexian Zou, Shing-Chow Chan |
| 2001 | ISCAS | A robust quasi-Newton adaptive filtering algorithm for impulse noise suppression. | Yuexian Zou, Shing-Chow Chan |
| 1999 | ICASSP | A robust M-estimate adaptive filter for impulse noise suppression. | Yuexian Zou, S. C. Chan, Tung-Sang Ng |
| 1999 | ISCAS | Transform domain adaptive Volterra filter algorithm based on constrained optimization. | Yuexian Zou, Shing-Chow Chan, Tung-Sang Ng |