Skip to content

Yuexian Zou

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

164

Venues

28

Active years

1999–2026

Best venue rank

A*

Where they publish

Papers

164 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAINot All Tokens and Heads Are Equally Important: Dual-Level Attention Intervention for Hallucination Mitigation.Lexiang Tang, Xianwei Zhuang, Bang Yang, Zhiyuan Hu, Hongxiang Li, Lu Ma, Jinghan Ru, Yuexian Zou
2026AAAIWhisperDiari: A Whisper-Based Speaker Diarization Framework in Token Space Leveraging Semantic and Speaker Information for Better Text Adaptability.Yongkang Yin, Yuexian Zou
2026SIGGRAPHViewWeaver: Geometry-Grounded Generative Rendering for 3D-Aware Image Customization.Yaowei Li, Xiaoyu Li, Zhaoyang Zhang, Hongxiang Li, Long Chen, Ying Shan, Yuexian Zou
2025AAAIImage Conductor: Precision Control for Interactive Video Synthesis.Yaowei Li, Xintao Wang, Zhaoyang Zhang, Zhouxia Wang, Ziyang Yuan, Liangbin Xie, Ying Shan, Yuexian Zou
2025ACLAdvancing General Multimodal Capability of Vision-language Models with Pyramid-descent Visual Position Encoding.Zhanpeng Chen, Mingxiao Li, Ziyang Chen, Nan Du, Xiaolong Li, Yuexian Zou
2025ACLATRI: Mitigating Multilingual Audio Text Retrieval Inconsistencies by Reducing Data Distribution Errors.Yuguo Yin, Yuxin Xie, Wenyuan Yang, Dongchao Yang, Jinghan Ru, Xianwei Zhuang, Liming Liang, Yuexian Zou
2025CVPRVASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification.Xianwei Zhuang, Zhihong Zhu, Yuxin Xie, Liming Liang, Yuexian Zou
2025ICASSPHCoTT: Hierarchical Chain-of-Thought Distillation.Zhichang Wang, Xianwei Zhuang, Zhihong Zhu, Yuexian Zou
2025ICASSPAudio-Faces Intra-Frame Alignment with Graph Attention Networks for Active Speaker Detection.Yongkang Yin, Xusheng Yang, Liming Liang, Xu Li, Yuexian Zou
2025ICLRUniCoTT: A Unified Framework for Structural Chain-of-Thought Distillation.Xianwei Zhuang, Zhihong Zhu, Zhichang Wang, Xuxin Cheng, Yuexian Zou
2025InterspeechFoleyMaster: High-Quality Video-to-Audio Synthesis via MLLM-Augmented Prompt Tuning and Joint Semantic-Temporal Adaptation.Liming Liang, Luo Chen, Yuehan Jin, Xianwei Zhuang, Yuxin Xie, Yongkang Yin, Yuexian Zou
2025InterspeechSpeechSEC: A Unified Multi-Task Framework for Speech Synthesis, Editing, and Continuation.Liming Liang, Dongchao Yang, Xianwei Zhuang, Yuxin Xie, Luo Chen, Yuehan Jin, Yuexian Zou
2025SiggraphABlobCtrl: Taming Controllable Blob for Element-level Image Editing.Yaowei Li, Lingen Li, Zhaoyang Zhang, Xiaoyu Li, Guangzhi Wang, Hongxiang Li, Xiaodong Cun, Ying Shan, Yuexian Zou
2024AAAITowards Multi-Intent Spoken Language Understanding via Hierarchical Attention and Optimal Transport.Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yaowei Li, Xianwei Zhuang, Yuexian Zou
2024AAAIAudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head.Rongjie Huang, Mingze Li, Dongchao Yang, Jiatong Shi, Xuankai Chang, Zhenhui Ye, Yuning Wu, Zhiqing Hong, Jiawei Huang, Jinglin Liu, Yi Ren, Yuexian Zou, Zhou Zhao, Shinji Watanabe
2024AAAIExploiting Auxiliary Caption for Video Grounding.Hongxiang Li, Meng Cao, Xuxin Cheng, Yaowei Li, Zhihong Zhu, Yuexian Zou
2024AAAIEmbracing Language Inclusivity and Diversity in CLIP through Continual Language Learning.Bang Yang, Yong Dai, Xuxin Cheng, Yaowei Li, Asif Raza, Yuexian Zou
2024AAAITowards Explainable Joint Models via Information Theory for Multiple Intent Detection and Slot Filling.Xianwei Zhuang, Xuxin Cheng, Yuexian Zou
2024AAAIAligner²: Enhancing Joint Multiple Intent Detection and Slot Filling via Adjustive and Forced Cross-Task Alignment.Zhihong Zhu, Xuxin Cheng, Yaowei Li, Hongxiang Li, Yuexian Zou
2024ACLSoul-Mix: Enhancing Multimodal Machine Translation with Manifold Mixup.Xuxin Cheng, Ziyu Yao, Yifei Xin, Hao An, Hongxiang Li, Yaowei Li, Yuexian Zou
2024ACLCyclical Contrastive Learning Based on Geodesic for Zero-shot Cross-lingual Spoken Language Understanding.Xuxin Cheng, Zhihong Zhu, Bang Yang, Xianwei Zhuang, Hongxiang Li, Yuexian Zou
2024ACLMoE-SLU: Towards ASR-Robust Spoken Language Understanding via Mixture-of-Experts.Xuxin Cheng, Zhihong Zhu, Xianwei Zhuang, Zhanpeng Chen, Zhiqi Huang, Yuexian Zou
2024ACLPCAD: Towards ASR-Robust Spoken Language Understanding via Prototype Calibration and Asymmetric Decoupling.Xianwei Zhuang, Xuxin Cheng, Liming Liang, Yuxin Xie, Zhichang Wang, Zhiqi Huang, Yuexian Zou
2024ACLCode-Switching Can be Better Aligners: Advancing Cross-Lingual SLU through Representation-Level and Prediction-Level Alignment.Zhihong Zhu, Xuxin Cheng, Zhanpeng Chen, Xianwei Zhuang, Zhiqi Huang, Yuexian Zou
2024CIKMRobust Heterophily Graph Learning via Uniformity Augmentation.Xusheng Yang, Zhengyu Chen, Yuexian Zou
2024CIKMSaLa: Scenario-aware Label Graph Interaction for Multi-intent Spoken Language Understanding.Zhihong Zhu, Xuxin Cheng, Zhanpeng Chen, Zhichang Wang, Zhiqi Huang, Yuexian Zou
2024COLINGKnowledge-enhanced Prompt Tuning for Dialogue-based Relation Extraction with Trigger and Label Semantic.Hao An, Zhihong Zhu, Xuxin Cheng, Zhiqi Huang, Yuexian Zou
2024COLINGTowards Multi-modal Sarcasm Detection via Disentangled Multi-grained Multi-modal Distilling.Zhihong Zhu, Xuxin Cheng, Guimin Hu, Yaowei Li, Zhiqi Huang, Yuexian Zou
2024ECCVKDProR: A Knowledge-Decoupling Probabilistic Framework for Video-Text Retrieval.Xianwei Zhuang, Hongxiang Li, Xuxin Cheng, Zhihong Zhu, Yuxin Xie, Yuexian Zou
2024EMNLPRelevance Is a Guiding Light: Relevance-aware Adaptive Learning for End-to-end Task-oriented Dialogue System.Zhanpeng Chen, Zhihong Zhu, Wanshi Xu, Xianwei Zhuang, Yuexian Zou
2024EMNLPDual-oriented Disentangled Network with Counterfactual Intervention for Multimodal Intent Detection.Zhanpeng Chen, Zhihong Zhu, Xianwei Zhuang, Zhiqi Huang, Yuexian Zou
2024EMNLPLearning to Match Representations is Better for End-to-End Task-Oriented Dialog System.Wanshi Xu, Xuxin Cheng, Zhihong Zhu, Zhanpeng Chen, Yuexian Zou
2024EMNLPWhat are the Generator Preferences for End-to-end Task-Oriented Dialog System?Wanshi Xu, Xianwei Zhuang, Zhanpeng Chen, Zhihong Zhu, Xuxin Cheng, Yuexian Zou
2024EMNLPGame on Tree: Visual Hallucination Mitigation via Coarse-to-Fine View Tree and Game Theory.Xianwei Zhuang, Zhihong Zhu, Zhanpeng Chen, Yuxin Xie, Liming Liang, Yuexian Zou
2024ICLRRetrieval is Accurate Generation.Bowen Cao, Deng Cai, Leyang Cui, Xuxin Cheng, Wei Bi, Yuexian Zou, Shuming Shi
2024ICONIPMulti-scale Spatial Feature Aggregation For Efficient Super Resolution.XinChao Wang, Hongxiang Li, Xinzhong Sun, Lihong Zhao, Liqiang Wang, Kai Zhang, Xuzhen Hu, Yong Wang, Yuexian Zou
2024ICONIPPoseRAC: Enhancing Repetitive Action Counting with Salient Poses.Ziyu Yao, Yuexian Zou
2024IJCAIGenerating More Audios for End-to-End Spoken Language Understanding.Xuxin Cheng, Yuexian Zou
2024InterspeechGPA: Global and Prototype Alignment for Audio-Text Retrieval.Yuxin Xie, Zhihong Zhu, Xianwei Zhuang, Liming Liang, Zhichang Wang, Yuexian Zou
2024InterspeechDiffATR: Diffusion-based Generative Modeling for Audio-Text Retrieval.Yifei Xin, Xuxin Cheng, Zhihong Zhu, Xusheng Yang, Yuexian Zou
2024InterspeechAudio-text Retrieval with Transformer-based Hierarchical Alignment and Disentangled Cross-modal Representation.Yifei Xin, Zhihong Zhu, Xuxin Cheng, Xusheng Yang, Yuexian Zou
2024InterspeechAFL-Net: Integrating Audio, Facial, and Lip Modalities with a Two-step Cross-attention for Robust Speaker Diarization in the Wild.Yongkang Yin, Xu Li, Ying Shan, Yuexian Zou
2024NAACLMaCSC: Towards Multimodal-augmented Pre-trained Language Models via Conceptual Prototypes and Self-balancing Calibration.Xianwei Zhuang, Zhichang Wang, Xuxin Cheng, Yuxin Xie, Liming Liang, Yuexian Zou
2024WSDMDance with Labels: Dual-Heterogeneous Label Graph Interaction for Multi-intent Spoken Language Understanding.Zhihong Zhu, Xuxin Cheng, Hongxiang Li, Yaowei Li, Yuexian Zou
2023AAAIFTM: A Frame-Level Timeline Modeling Method for Temporal Graph Representation Learning.Bowen Cao, Qichen Ye, Weiyuan Xu, Yuexian Zou
2023AAAIFiTs: Fine-Grained Two-Stage Training for Knowledge-Aware Question Answering.Qichen Ye, Bowen Cao, Nuo Chen, Weiyuan Xu, Yuexian Zou
2023ACLML-LMCL: Mutual Learning and Large-Margin Contrastive Learning for Improving ASR Robustness in Spoken Language Understanding.Xuxin Cheng, Bowen Cao, Qichen Ye, Zhihong Zhu, Hongxiang Li, Yuexian Zou
2023ACLMultimodal Prompt Learning for Product Title Generation with Extremely Limited Labels.Bang Yang, Fenglin Liu, Zheng Li, Qingyu Yin, Chenyu You, Bing Yin, Yuexian Zou
2023ACLMultiCapCLIP: Auto-Encoding Prompts for Zero-Shot Multilingual Visual Captioning.Bang Yang, Fenglin Liu, Xian Wu, Yaowei Wang, Xu Sun, Yuexian Zou
2023ACLTowards Unified Spoken Language Understanding Decoding via Label-aware Compact Linguistics Representations.Zhihong Zhu, Xuxin Cheng, Zhiqi Huang, Dongsheng Chen, Yuexian Zou
2023CIKMTowards Spoken Language Understanding via Multi-level Multi-grained Contrastive Learning.Xuxin Cheng, Wanshi Xu, Zhihong Zhu, Hongxiang Li, Yuexian Zou
2023CIKMDAS-CL: Towards Multimodal Machine Translation via Dual-Level Asymmetric Contrastive Learning.Xuxin Cheng, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou
2023CSCWDTLAG: An Informative Trigger and Label-Aware Knowledge Guided Model for Dialogue-based Relation Extraction.Hao An, Dongsheng Chen, Weiyuan Xu, Zhihong Zhu, Yuexian Zou
2023CVPRIterative Proposal Refinement for Weakly-Supervised Video Grounding.Meng Cao, Fangyun Wei, Can Xu, Xiubo Geng, Long Chen, Can Zhang, Yuexian Zou, Tao Shen, Daxin Jiang
2023EMNLPMRRL: Modifying the Reference via Reinforcement Learning for Non-Autoregressive Joint Multiple Intent Detection and Slot Filling.Xuxin Cheng, Zhihong Zhu, Bowen Cao, Qichen Ye, Yuexian Zou
2023EMNLPAccelerating Multiple Intent Detection and Slot Filling via Targeted Knowledge Distillation.Xuxin Cheng, Zhihong Zhu, Wanshi Xu, Yaowei Li, Hongxiang Li, Yuexian Zou
2023EMNLPEnhancing Code-Switching for Cross-lingual SLU: A Unified View of Semantic and Grammatical Coherence.Zhihong Zhu, Xuxin Cheng, Zhiqi Huang, Dongsheng Chen, Yuexian Zou
2023ICASSPMXuxin Cheng, Qianqian Dong, Fengpeng Yue, Tom Ko, Mingxuan Wang, Yuexian Zou
2023ICASSPSSVMR: Saliency-Based Self-Training for Video-Music Retrieval.Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yaowei Li, Yuexian Zou
2023ICASSPImproving Retrieval-Based Dialogue System Via Syntax-Informed Attention.Tengtao Song, Nuo Chen, Ji Jiang, Zhihong Zhu, Yuexian Zou
2023ICASSPImproving Weakly Supervised Sound Event Detection with Causal Intervention.Yifei Xin, Dongchao Yang, Fan Cui, Yujun Wang, Yuexian Zou
2023ICASSPImproving Text-Audio Retrieval by Text-Aware Attention Pooling and Prior Matrix Revised Loss.Yifei Xin, Dongchao Yang, Yuexian Zou
2023ICASSPA Dynamic Graph Interactive Framework with Label-Semantic Injection for Spoken Language Understanding.Zhihong Zhu, Weiyuan Xu, Xuxin Cheng, Tengtao Song, Yuexian Zou
2023ICCVG2L: Semantically Aligned and Uniform Video Grounding via Geodesic and Game Theory.Hongxiang Li, Meng Cao, Xuxin Cheng, Yaowei Li, Zhihong Zhu, Yuexian Zou
2023ICCVUnify, Align and Refine: Multi-Level Semantic Alignment for Radiology Report Generation.Yaowei Li, Bang Yang, Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yuexian Zou
2023InterspeechC²A-SLU: Cross and Contrastive Attention for Improving ASR Robustness in Spoken Language Understanding.Xuxin Cheng, Ziyu Yao, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou
2023InterspeechFC-MTLF: A Fine- and Coarse-grained Multi-Task Learning Framework for Cross-Lingual Spoken Language Understanding.Xuxin Cheng, Wanshi Xu, Ziyu Yao, Zhihong Zhu, Yaowei Li, Hongxiang Li, Yuexian Zou
2023InterspeechGhostT5: Generate More Features with Cheap Operations to Improve Textless Spoken Question Answering.Xuxin Cheng, Zhihong Zhu, Ziyu Yao, Hongxiang Li, Yaowei Li, Yuexian Zou
2023InterspeechBackground-aware Modeling for Weakly Supervised Sound Event Detection.Yifei Xin, Dongchao Yang, Yuexian Zou
2023InterspeechImproving Audio-Text Retrieval via Hierarchical Cross-Modal Interaction and Auxiliary Captions.Yifei Xin, Yuexian Zou
2023InterspeechNoreSpeech: Knowledge Distillation based Conditional Diffusion Model for Noise-robust Expressive TTS.Dongchao Yang, Songxiang Liu, Helin Wang, Jianwei Yu, Chao Weng, Yuexian Zou
2023InterspeechMix before Align: Towards Zero-shot Cross-lingual Sentiment Analysis via Soft-Mix and Multi-View Learning.Zhihong Zhu, Xuxin Cheng, Dongsheng Chen, Zhiqi Huang, Hongxiang Li, Yuexian Zou
2022COLINGA Transformer-based Threshold-Free Framework for Multi-Intent NLU.Lisung Chen, Nuo Chen, Yuexian Zou, Yong Wang, Xinzhong Sun
2022CVPRUnsupervised Pre-training for Temporal Action Localization Tasks.Can Zhang, Tianyu Yang, Junwu Weng, Meng Cao, Jue Wang, Yuexian Zou
2022ECCVLocVTP: Video-Text Pre-training for Temporal Localization.Meng Cao, Tianyu Yang, Junwu Weng, Can Zhang, Jue Wang, Yuexian Zou
2022ICANNVisual Relation-Aware Unsupervised Video Captioning.Puzhao Ji, Meng Cao, Yuexian Zou
2022ICASSPLeveraging Bilinear Attention to Improve Spoken Language Understanding.Dongsheng Chen, Zhiqi Huang, Yuexian Zou
2022ICASSPJoint Multiple Intent Detection and Slot Filling Via Self-Distillation.Lisong Chen, Peilin Zhou, Yuexian Zou
2022ICASSPConsistent Training and Decoding for End-to-End Speech Recognition Using Lattice-Free MMI.Jinchuan Tian, Jianwei Yu, Chao Weng, Shi-Xiong Zhang, Dan Su, Dong Yu, Yuexian Zou
2022ICASSPLearning Decoupling Features Through Orthogonality Regularization.Li Wang, Rongzhi Gu, Weiji Zhuang, Peng Gao, Yujun Wang, Yuexian Zou
2022ICASSPImproving Dual-Microphone Speech Enhancement by Learning Cross-Channel Features with Multi-Head Attention.Xinmeng Xu, Rongzhi Gu, Yuexian Zou
2022ICASSPA Mutual Learning Framework for Few-Shot Sound Event Detection.Dongchao Yang, Helin Wang, Yuexian Zou, Zhongjie Ye, Wenwu Wang
2022IJCAITowards Joint Intent Detection and Slot Filling via Higher-order Attention.Dongsheng Chen, Zhiqi Huang, Xian Wu, Shen Ge, Yuexian Zou
2022InterspeechLAE: Language-Aware Encoder for Monolingual and Multilingual ASR.Jinchuan Tian, Jianwei Yu, Chunlei Zhang, Yuexian Zou, Dong Yu
2022InterspeechImproving Target Sound Extraction with Timestamp Information.Helin Wang, Dongchao Yang, Chao Weng, Jianwei Yu, Yuexian Zou
2022InterspeechAudio Pyramid Transformer with Domain Adaption for Weakly Supervised Sound Event Detection and Audio Classification.Yifei Xin, Dongchao Yang, Yuexian Zou
2022InterspeechRaDur: A Reference-aware and Duration-robust Network for Target Sound Detection.Dongchao Yang, Helin Wang, Zhongjie Ye, Yuexian Zou, Wenwu Wang
2022InterspeechSpeaker-Aware Mixture of Mixtures Training for Weakly Supervised Speaker Extraction.Zifeng Zhao, Rongzhi Gu, Dongchao Yang, Jinchuan Tian, Yuexian Zou
2022InterspeechTarget Confusion in End-to-end Speaker Extraction: Analysis and Approaches.Zifeng Zhao, Dongchao Yang, Rongzhi Gu, Haoran Zhang, Yuexian Zou
2022NAACLEnd-to-end Spoken Conversational Question Answering: Task, Dataset and Model.Chenyu You, Nuo Chen, Fenglin Liu, Shen Ge, Xian Wu, Yuexian Zou
2021AAAIAudio-Oriented Multimodal Machine Comprehension via Dynamic Inter- and Intra-modality Attention.Zhiqi Huang, Fenglin Liu, Xian Wu, Shen Ge, Helin Wang, Wei Fan, Yuexian Zou
2021AAAINon-Autoregressive Coarse-to-Fine Video Captioning.Bang Yang, Yuexian Zou, Fenglin Liu, Can Zhang
2021CVPRExploring and Distilling Posterior and Prior Knowledge for Radiology Report Generation.Fenglin Liu, Xian Wu, Shen Ge, Wei Fan, Yuexian Zou
2021CVPRCoLA: Weakly-Supervised Temporal Action Localization With Snippet Contrastive Learning.Can Zhang, Meng Cao, Dongming Yang, Jie Chen, Yuexian Zou
2021EMNLPOn Pursuit of Designing Multi-modal Transformer for Video Grounding.Meng Cao, Long Chen, Mike Zheng Shou, Can Zhang, Yuexian Zou
2021EMNLPSelf-supervised Contrastive Cross-Modality Representation Learning for Spoken Question Answering.Chenyu You, Nuo Chen, Yuexian Zou
2021ICASSPAdaptive Bi-Directional Attention: Exploring Multi-Granularity Representations for Machine Reading Comprehension.Nuo Chen, Fenglin Liu, Chenyu You, Peilin Zhou, Yuexian Zou
2021ICASSPSentiment Injected Iteratively Co-Interactive Network for Spoken Language Understanding.Zhiqi Huang, Fenglin Liu, Peilin Zhou, Yuexian Zou
2021ICASSPSRF-Net: Selective Receptive Field Network for Anchor-Free Temporal Action Detection.Ranyu Ning, Can Zhang, Yuexian Zou
2021ICASSPFWB-Net: Front White Balance Network for Color Shift Correction in Single Image Dehazing Via Atmospheric Light Estimation.Cong Wang, Yan Huang, Yuexian Zou, Yong Xu
2021ICASSPA Global-Local Attention Framework for Weakly Labelled Audio Tagging.Helin Wang, Yuexian Zou, Wenwu Wang
2021ICASSPLong-Short Temporal Modeling for Efficient Action Recognition.Liyu Wu, Yuexian Zou, Can Zhang
2021ICASSPKnowledge Distillation for Improved Accuracy in Spoken Question Answering.Chenyu You, Nuo Chen, Yuexian Zou
2021ICASSPContrastive Self-Supervised Learning for Text-Independent Speaker Verification.Haoran Zhang, Yuexian Zou, Helin Wang
2021IJCAIRR-Net: Injecting Interactive Semantics in Human-Object Interaction Detection.Dongming Yang, Yuexian Zou, Can Zhang, Meng Cao, Jie Chen
2021IJCAIMRD-Net: Multi-Modal Residual Knowledge Distillation for Spoken Question Answering.Chenyu You, Nuo Chen, Yuexian Zou
2021InterspeechSelf-Supervised Dialogue Learning for Spoken Conversational Question Answering.Nuo Chen, Chenyu You, Yuexian Zou
2021InterspeechText Anchor Based Metric Learning for Small-Footprint Keyword Spotting.Li Wang, Rongzhi Gu, Nuo Chen, Yuexian Zou
2021InterspeechSpecAugment++: A Hidden Space Data Augmentation Method for Acoustic Scene Classification.Helin Wang, Yuexian Zou, Wenwu Wang
2021InterspeechSemantic Transportation Prototypical Network for Few-Shot Intent Detection.Weiyuan Xu, Peilin Zhou, Chenyu You, Yuexian Zou
2021InterspeechUnsupervised Multi-Target Domain Adaptation for Acoustic Scene Classification.Dongchao Yang, Helin Wang, Yuexian Zou
2021InterspeechContextualized Attention-Based Knowledge Transfer for Spoken Conversational Question Answering.Chenyu You, Nuo Chen, Yuexian Zou
2020AAAIFederated Learning for Vision-and-Language Grounding Problems.Fenglin Liu, Xian Wu, Shen Ge, Wei Fan, Yuexian Zou
2020COLINGFederated Learning for Spoken Language Understanding.Zhiqi Huang, Fenglin Liu, Yuexian Zou
2020COLINGRethinking Skip Connection with Layer Normalization.Fenglin Liu, Xuancheng Ren, Zhiyuan Zhang, Xu Sun, Yuexian Zou
2020ICASSPAll You Need is a Second Look: Towards Tighter Arbitrary Shape Text Detection.Meng Cao, Yuexian Zou
2020ICASSPEnhancing End-to-End Multi-Channel Speech Separation Via Spatial Feature Learning.Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu
2020ICASSPWeakly Labelled Audio Tagging Via Convolutional Networks with Spatial and Channel-Wise Attention.Sixin Hong, Yuexian Zou, Wenwu Wang, Meng Cao
2020ICASSPSemanticgan: Generative Adversarial Networks For Semantic Image To Photo-Realistic Image Translation.Junling Liu, Yuexian Zou, Dongming Yang
2020ICIPABC-NET: Avoiding Blocking Effect & Color Shift Network for Single Image Dehazing Via Restraining Transmission Bias.Cong Wang, Yuexian Zou, Zehan Chen
2020IJCAIA Graph-based Interactive Reasoning for Human-Object Interaction Detection.Dongming Yang, Yuexian Zou
2020ICPRVisual Oriented Encoder: Integrating Multimodal and Multi-Scale Contexts for Video Captioning.Bang Yang, Yuexian Zou
2020ICPRPIN: A Novel Parallel Interactive Network for Spoken Language Understanding.Peilin Zhou, Zhiqi Huang, Fenglin Liu, Yuexian Zou
2020InterspeechGated Multi-Head Attention Pooling for Weakly Labelled Audio Tagging.Sixin Hong, Yuexian Zou, Wenwu Wang
2020InterspeechDeep Speaker Embedding with Long Short Term Centroid Learning for Text-Independent Speaker Verification.Junyi Peng, Rongzhi Gu, Yuexian Zou
2020InterspeechEnvironmental Sound Classification with Parallel Temporal-Spectral Attention.Helin Wang, Yuexian Zou, Dading Chong, Wenwu Wang
2019ACIISpeech Emotion Recognition using Spectral Normalized CycleGAN.Wan Ding, Dong-Yan Huang, Danqing Luo, Yuexian Zou
2019ACIIWhat Affects the Performance of Convolutional Neural Networks for Audio Event Classification.Helin Wang, Dading Chong, Dongyan Huang, Yuexian Zou
2019ASRULogistic Similarity Metric Learning via Affinity Matrix for Text-Independent Speaker Verification.Junyi Peng, Rongzhi Gu, Yuexian Zou
2019ASRUSyllable-Dependent Discriminative Learning for Small Footprint Text-Dependent Speaker Verification.Junyi Peng, Yuexian Zou, Na Li, Deyi Tuo, Dan Su, Meng Yu, Chunlei Zhang, Dong Yu
2019ICANNDiscriminative Feature Learning Using Two-Stage Training Strategy for Facial Expression Recognition.Lei Gan, Yuexian Zou, Can Zhang
2019ICANNDiscriminative Feature Learning for Speech Emotion Recognition.Yuying Zhang, Yuexian Zou, Junyi Peng, Danqing Luo, Dongyan Huang
2019ICASSPSelecting Optimal Proposal Number for Image-based Object Detection.Wenjie Guan, Xiaoqun Zhou, Ge Li, Yuexian Zou
2019ICASSPLabelled Non-zero Particle Flow for SMC-PHD Filtering.Yang Liu, Qinghua Hu, Yuexian Zou, Wenwu Wang
2019ICASSPSemantic Super-resolution for Extremely Low-resolution Vehicle License Plate.Yuexian Zou, Yi Wang, Wenjie Guan, Wenwu Wang
2019ICDMExploring Semantic Relationships for Image Captioning without Parallel Data.Fenglin Liu, Meng Gao, Tianhao Zhang, Yuexian Zou
2019InterspeechNeural Spatial Filter: Target Speaker Speech Separation Assisted with Directional Information.Rongzhi Gu, Lianwu Chen, Shi-Xiong Zhang, Jimeng Zheng, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu
2019MMMSTMP: Spatial Temporal Multi-level Proposal Network for Activity Detection.Guang Chen, Yuexian Zou, Can Zhang
2019MMMMulti-channel Convolutional Neural Networks with Multi-level Feature Fusion for Environmental Sound Classification.Dading Chong, Yuexian Zou, Wenwu Wang
2019MMMEnhancing Scene Text Detection via Fused Semantic Segmentation Network with Attention.Chao Liu, Yuexian Zou, Dongming Yang
2019MMMUsing Coarse Label Constraint for Fine-Grained Visual Classification.Chaohao Lu, Yuexian Zou
2019MMMHierarchical Temporal Pooling for Efficient Online Action Recognition.Can Zhang, Yuexian Zou, Guang Chen
2019VCIPScale-Informed Density Estimation for Dense Crowd Counting.Zirui Li, Yuexian Zou, Guoshuai Wang, Jian Zhang
2018ICASSPInverse Atmoshperic Scattering Modeling with Convolutional Neural Networks for Single Image Dehazing.Zehan Chen, Yi Wang, Yuexian Zou
2018ICASSPMulti-Scale Object Detection with Feature Fusion and Region Objectness Network.Wenjie Guan, Yuexian Zou, Xiaoqun Zhou
2018ICPRLD-CNN: A Lightweight Dilated Convolutional Neural Network for Environmental Sound Classification.Xiaohu Zhang, Yuexian Zou, Wenwu Wang
2018InterspeechInvestigation on Joint Representation Learning for Robust Feature Extraction in Speech Emotion Recognition.Danqing Luo, Yuexian Zou, Dongyan Huang
2018InterspeechJoint Noise and Reverberation Adaptive Learning for Robust Speaker DOA Estimation with an Acoustic Vector Sensor.Disong Wang, Yuexian Zou
2017ICASSPExample-based Visual Object Counting for complex background with a local low-rank constraint.X. L. Huang, Yuexian Zou, Y. Wang
2017ICASSPRobust speaker DOA estimation based on the inter-sensor data ratio model and binary mask estimation in the bispectrum domain.Yanhan Jin, Yuexian Zou, Christian H. Ritz
2017ICIPAccurate small object detection via density map aided saliency estimation.X. Q. Zhou, Yuexian Zou, Y. Wang
2016ICIPFast visual object counting via example-based density estimation.Yi Wang, Yuexian Zou
2016ICPRWireless capsule endoscopy video summarization: A learning approach based on Siamese neural network and support vector machine.Jin Chen, Yuexian Zou, Yi Wang
2016ICPRAn effective voiceprint based identity authentication system for Mandarin smartphone users.Junhong Liu, Yuexian Zou, Yichi Huang
2015ICASSPA parametric modeling approach for wireless capsule endoscopy hazy image restoration.Yi Wang, Cheng Cai, Ji Liu, Yuexian Zou
2015ICIPMulti-kernel collaborative representation for image classification.Weiyang Liu, Zhiding Yu, Yandong Wen, Meng Yang, Yuexian Zou
2014ICIPA novel kernel collaborative representation approach for image classification.Weiyang Liu, Lijia Lu, Hui Li, Wei Wang, Yuexian Zou
2009HISVideo Image Vehicle Detection System for Signaled Traffic Intersection.Yiyan Wang, Yuexian Zou, Hang Shi, He Zhao
2009HISImage Sequences Based Traffic Incident Detection for Signaled Intersections Using HMM.Yuexian Zou, Guangyi Shi, Hang Shi, Yiyan Wang
2003ICASSPA piloted adaptive notch filter.Yong Ching Lim, Yuexian Zou, N. Zheng
2001ICASSPA Huber recursive least squares adaptive lattice filter for impulse noise suppression.Yuexian Zou, Shing-Chow Chan
2001ISCASA robust quasi-Newton adaptive filtering algorithm for impulse noise suppression.Yuexian Zou, Shing-Chow Chan
1999ICASSPA robust M-estimate adaptive filter for impulse noise suppression.Yuexian Zou, S. C. Chan, Tung-Sang Ng
1999ISCASTransform domain adaptive Volterra filter algorithm based on constrained optimization.Yuexian Zou, Shing-Chow Chan, Tung-Sang Ng