| 2026 | ACL | S2ST-Omni: Hierarchical Language-Aware SpeechLLM Adaptation for Multilingual Speech-to-Speech Translation. | Yu Pan, Xiongfei Wu, Yuguang Yang, Jixun Yao, Maxime Cordy, Lei Ma, Jianjun Zhao |
| 2025 | AAAI | StableVC: Style Controllable Zero-Shot Voice Conversion with Conditional Flow Matching. | Jixun Yao, Yuguang Yang, Yu Pan, Ziqian Ning, Jianhao Ye, Hongbin Zhou, Lei Xie |
| 2025 | ACL | Takin-VC: Expressive Zero-Shot Voice Conversion via Adaptive Hybrid Content Encoding and Enhanced Timbre Modeling. | Yuguang Yang, Yu Pan, Jixun Yao, Xiang Zhang, Jianhao Ye, Hongbin Zhou, Lei Xie, Lei Ma, Jianjun Zhao |
| 2025 | CVPR | DFM: Differentiable Feature Matching for Anomaly Detection. | Sheng Wu, Yimi Wang, Xudong Liu, Yuguang Yang, Runqi Wang, Guodong Guo, David S. Doermann, Baochang Zhang |
| 2025 | DICTA | Causally Guided Gaussian Perturbations for Out-of-Distribution Generalization in Medical Imaging. | Haoran Pei, Yuguang Yang, Kexin Liu, Baochang Zhang |
| 2025 | ICCV | WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection. | Haodong Zhu, Wenhao Dong, Linlin Yang, Hong Li, Yuguang Yang, Yangyang Ren, Qingcheng Zhu, Zichao Feng, Changbai Li, Shaohui Lin, Runqi Wang, Xiaoyan Luo, Baochang Zhang |
| 2025 | ICLR | Prompt as Knowledge Bank: Boost Vision-language model via Structural Representation for zero-shot medical detection. | Yuguang Yang, Tongfei Chen, Haoyu Huang, Linlin Yang, Chunyu Xie, Dawei Leng, Xianbin Cao, Baochang Zhang |
| 2025 | Interspeech | ClapFM-EVC: High-Fidelity and Flexible Emotional Voice Conversion with Dual Control from Natural Language and Speech. | Yu Pan, Yanni Hu, Yuguang Yang, Jixun Yao, Jianhao Ye, Hongbin Zhou, Lei Ma, Jianjun Zhao |
| 2024 | ICASSP | GEmo-CLAP: Gender-Attribute-Enhanced Contrastive Language-Audio Pretraining for Accurate Speech Emotion Recognition. | Yu Pan, Yanni Hu, Yuguang Yang, Wen Fei, Jixun Yao, Heng Lu, Lei Ma, Jianjun Zhao |
| 2024 | ICASSP | Promptvc: Flexible Stylistic Voice Conversion in Latent Space Driven by Natural Language Prompts. | Jixun Yao, Yuguang Yang, Yi Lei, Ziqian Ning, Yanni Hu, Yu Pan, Jingjing Yin, Hongbin Zhou, Heng Lu, Lei Xie |
| 2023 | ASRU | PP-MET: A Real-World Personalized Prompt Based Meeting Transcription System. | Xiang Lyu, Yuhang Cao, Qing Wang, Jingjing Yin, Yuguang Yang, Pengpeng Zou, Yanni Hu, Heng Lu |
| 2023 | ICASSP | Hybridformer: Improving Squeezeformer with Hybrid Attention and NSR Mechanism. | Yuguang Yang, Yu Pan, Jingjing Yin, Jiangyu Han, Lei Ma, Heng Lu |
| 2022 | ICASSP | Self-Supervised Speaker Recognition Training using Human-Machine Dialogues. | Metehan Cekic, Ruirui Li, Zeya Chen, Yuguang Yang, Andreas Stolcke, Upamanyu Madhow |
| 2022 | ICASSP | ASR-Aware End-to-End Neural Diarization. | Aparna Khare, Eunjung Han, Yuguang Yang, Andreas Stolcke |
| 2022 | ICASSP | Improving Fairness in Speaker Verification via Group-Adapted Fusion Network. | Hua Shen, Yuguang Yang, Guoli Sun, Ryan Langman, Eunjung Han, Jasha Droppo, Andreas Stolcke |
| 2021 | ASRU | Improving Speaker Identification for Shared Devices by Adapting Embeddings to Speaker Subsets. | Zhenning Tan, Yuguang Yang, Eunjung Han, Andreas Stolcke |
| 2021 | Interspeech | Scaling Effect of Self-Supervised Speech Models. | Jie Pu, Yuguang Yang, Ruirui Li, Oguz Elibol, Jasha Droppo |