Skip to content

Dan Su

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

104

Venues

19

Active years

2007–2025

Best venue rank

A*

Where they publish

Papers

104 indexed papers, newest first.

YearVenueTitleAuthors
2025ACLNemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset.Dan Su, Kezhi Kong, Ying Lin, Joseph Jennings, Brandon Norick, Markus Kliegl, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2024ACLMM-LLMs: Recent Advances in MultiModal Large Language Models.Duzhen Zhang, Yahan Yu, Jiahua Dong, Chenxing Li, Dan Su, Chenhui Chu, Dong Yu
2024ACLGenerative Pre-trained Speech Language Model with Efficient Hierarchical Transformer.Yongxin Zhu, Dan Su, Liqiang He, Linli Xu, Dong Yu
2024ICASSPDurIAN-E 2: Duration Informed Attention Network with Adaptive Variational Autoencoder and Adversarial Learning for Expressive Text-to-Speech Synthesis.Yu Gu, Qiushi Zhu, Guangzhi Lei, Chao Weng, Dan Su
2024ICASSPOpine: Leveraging a Optimization-Inspired Deep Unfolding Method for Multi-Channel Speech Enhancement.Andong Li, Rilin Chen, Yu Gu, Chao Weng, Dan Su
2024ICMLPrompt-guided Precise Audio Editing with Diffusion Models.Manjie Xu, Chenxing Li, Duzhen Zhang, Dan Su, Wei Liang, Dong Yu
2024MICCAIORCGT: Ollivier-Ricci Curvature-Based Graph Model for Lung STAS Prediction.Min Cen, Zheng Wang, Zhenfeng Zhuang, Hong Zhang, Dan Su, Zhen Bao, Weiwei Wei, Baptiste Magnier, Lequan Yu, Liansheng Wang
2023AAAIUniSyn: An End-to-End Unified Model for Text-to-Speech and Singing Voice Synthesis.Yi Lei, Shan Yang, Xinsheng Wang, Qicong Xie, Jixun Yao, Lei Xie, Dan Su
2023ACLNusaCrowd: Open Source Initiative for Indonesian NLP Resources.Samuel Cahyawijaya, Holy Lovenia, Alham Fikri Aji, Genta Indra Winata, Bryan Wilie, Fajri Koto, Rahmad Mahendra, Christian Wibisono, Ade Romadhony, Karissa Vincentio, Jennifer Santoso, David Moeljadi, Cahya Wirawan, Frederikus Hudi, Muhammad Satrio Wicaksono, Ivan Halim Parmonangan, Ika Alfina, Ilham Firdausi Putra, Samsul Rahmadani, Yulianti Oenang, Ali Akbar Septiandri, James Jaya, Kaustubh D. Dhole, Arie Ardiyanti Suryani, Rifki Afina Putri, Dan Su, Keith Stevens, Made Nindyatama Nityasya, Muhammad Farid Adilazuarda, Ryan Hadiwijaya, Ryandito Diandaru, Tiezheng Yu, Vito Ghifari, Wenliang Dai, Yan Xu, Dyah Damapuspita, Haryo Akbarianto Wibowo, Cuk Tho, Ichwanul Muslim Karo Karo, Tirana Fatyanosa, Ziwei Ji, Graham Neubig, Timothy Baldwin, Sebastian Ruder, Pascale Fung, Herry Sujaini, Sakriani Sakti, Ayu Purwarianti
2023AIESModel Debiasing via Gradient-based Explanation on Representation.Jindi Zhang, Luning Wang, Dan Su, Yongxiang Huang, Caleb Chen Cao, Lei Chen
2023EACLPlausible May Not Be Faithful: Probing Object Hallucination in Vision-Language Pre-training.Wenliang Dai, Zihan Liu, Ziwei Ji, Dan Su, Pascale Fung
2023EACLContext Generation Improves Open Domain Question Answering.Dan Su, Mostofa Patwary, Shrimai Prabhumoye, Peng Xu, Ryan Prenger, Mohammad Shoeybi, Pascale Fung, Anima Anandkumar, Bryan Catanzaro
2023ICASSPTrinet: Stabilizing Self-Supervised Learning From Complete or Slow Collapse.Lixin Cao, Jun Wang, Ben Yang, Dan Su, Dong Yu
2023IJCNLPA Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity.Yejin Bang, Samuel Cahyawijaya, Nayeon Lee, Wenliang Dai, Dan Su, Bryan Wilie, Holy Lovenia, Ziwei Ji, Tiezheng Yu, Willy Chung, Quyet V. Do, Yan Xu, Pascale Fung
2023InterspeechMulti-mode Neural Speech Coding Based on Deep Generative Networks.Wei Xiao, Wenzhe Liu, Meng Wang, Shan Yang, Yupeng Shi, Yuyong Kang, Dan Su, Shidong Shang, Dong Yu
2023InterspeechCompressed MoE ASR Model Based on Knowledge Distillation and Quantization.Yuping Yuan, Zhao You, Shulin Feng, Dan Su, Yanchun Liang, Xiaohu Shi, Dong Yu
2023InterspeechText-Only Domain Adaptation for End-to-End Speech Recognition through Down-Sampling Acoustic Representation.Jiaxu Zhu, Weinan Tong, Yaoxun Xu, Changhe Song, Zhiyong Wu, Zhao You, Dan Su, Dong Yu, Helen Meng
2022ACLRead before Generate! Faithful Long Form Question Answering with Machine Reading.Dan Su, Xiaoguang Li, Jindi Zhang, Lifeng Shang, Xin Jiang, Qun Liu, Pascale Fung
2022ICASSPEnhancing Speaking Styles in Conversational Text-to-Speech Synthesis with Graph-Based Multi-Modal Context Modeling.Jingbei Li, Yi Meng, Chenyi Li, Zhiyong Wu, Helen Meng, Chao Weng, Dan Su
2022ICASSPReferee: Towards Reference-Free Cross-Speaker Style Transfer with Low-Quality Data for Expressive Speech Synthesis.Songxiang Liu, Shan Yang, Dan Su, Dong Yu
2022ICASSPDP-DWA: Dual-Path Dynamic Weight Attention Network With Streaming Dfsmn-San For Automatic Speech Recognition.Dongpeng Ma, Yiwen Wang, Liqiang He, Mingjie Jin, Dan Su, Dong Yu
2022ICASSPSimple Attention Module Based Speaker Verification with Iterative Noisy Label Detection.Xiaoyi Qin, Na Li, Chao Weng, Dan Su, Ming Li
2022ICASSPQA4QG: Using Question Answering to Constrain Multi-Hop Question Generation.Dan Su, Peng Xu, Pascale Fung
2022ICASSPConsistent Training and Decoding for End-to-End Speech Recognition Using Lattice-Free MMI.Jinchuan Tian, Jianwei Yu, Chao Weng, Shi-Xiong Zhang, Dan Su, Dong Yu, Yuexian Zou
2022ICASSPVCVTS: Multi-Speaker Video-to-Speech Synthesis Via Cross-Modal Knowledge Transfer from Voice Conversion.Disong Wang, Shan Yang, Dan Su, Xunying Liu, Dong Yu, Helen Meng
2022ICASSPSpeechmoe2: Mixture-of-Experts Model with Improved Routing.Zhao You, Shulin Feng, Dan Su, Dong Yu
2022ICASSPThe CUHK-Tencent Speaker Diarization System for the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Challenge.Naijun Zheng, Na Li, Xixin Wu, Lingwei Meng, Jiawen Kang, Haibin Wu, Chao Weng, Dan Su, Helen Meng
2022ICASSPMulti-Channel Speaker Diarization Using Spatial Features for Meetings.Naijun Zheng, Na Li, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng
2022ICLRBDDM: Bilateral Denoising Diffusion Models for Fast and High-Quality Speech Synthesis.Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu
2022IJCAIFastDiff: A Fast Conditional Diffusion Model for High-Quality Speech Synthesis.Rongjie Huang, Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu, Yi Ren, Zhou Zhao
2022InterspeechGlow-WaveGAN 2: High-quality Zero-shot Text-to-speech Synthesis and Any-to-any Voice Conversion.Yi Lei, Shan Yang, Jian Cong, Lei Xie, Dan Su
2022InterspeechCross-Age Speaker Verification: Learning Age-Invariant Speaker Embeddings.Xiaoyi Qin, Na Li, Chao Weng, Dan Su, Ming Li
2022InterspeechLearning Noise-independent Speech Representation for High-quality Voice Conversion for Noisy Target Speakers.Liumeng Xue, Shan Yang, Na Hu, Dan Su, Lei Xie
2022InterspeechEnhancing Word-Level Semantic Representation via Dependency Structure for Expressive Text-to-Speech Synthesis.Yixuan Zhou, Changhe Song, Jingbei Li, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng
2022InterspeechContent-Dependent Fine-Grained Speaker Embedding for Zero-Shot Speaker Adaptation in Text-to-Speech Synthesis.Yixuan Zhou, Changhe Song, Xiang Li, Luwen Zhang, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng
2021AAAITune-In: Training Under Negative Environments with Interference for Attention Networks Simulating Cocktail Party Effect.Jun Wang, Max W. Y. Lam, Dan Su, Dong Yu
2021ACLImprove Query Focused Abstractive Summarization by Incorporating Answer Relevance.Dan Su, Tiezheng Yu, Pascale Fung
2021ASRULatency-Controlled Neural Architecture Search for Streaming Speech Recognition.Liqiang He, Shulin Feng, Dan Su, Dong Yu
2021ASRUDiffSVC: A Diffusion Probabilistic Model for Singing Voice Conversion.Songxiang Liu, Yuewen Cao, Dan Su, Helen Meng
2021ICASSPLearned Transferable Architectures Can Surpass Hand-Designed Architectures for Large Scale Speech Recognition.Liqiang He, Dan Su, Dong Yu
2021ICASSPSandglasset: A Light Multi-Granularity Self-Attentive Network for Time-Domain Speech Separation.Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu
2021ICASSPReplay and Synthetic Speech Detection with Res2Net Architecture.Xu Li, Na Li, Chao Weng, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2021ICASSPNon-Autoregressive Transformer ASR with CTC-Enhanced Decoder Input.Xingchen Song, Zhiyong Wu, Yiheng Huang, Chao Weng, Dan Su, Helen M. Meng
2021ICASSPContrastive Separative Coding for Self-Supervised Representation Learning.Jun Wang, Max W. Y. Lam, Dan Su, Dong Yu
2021ICASSPA Joint Training Framework of Multi-Look Separator and Speaker Embedding Extractor for Overlapped Speech.Naijun Zheng, Na Li, Bo Wu, Meng Yu, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng
2021ICMITeNC: Low Bit-Rate Speech Coding with VQ-VAE and GAN.Yi Chen, Shan Yang, Na Hu, Lei Xie, Dan Su
2021InterspeechGigaSpeech: An Evolving, Multi-Domain ASR Corpus with 10, 000 Hours of Transcribed Audio.Guoguo Chen, Shuzhou Chai, Guan-Bo Wang, Jiayu Du, Wei-Qiang Zhang, Chao Weng, Dan Su, Daniel Povey, Jan Trmal, Junbo Zhang, Mingjie Jin, Sanjeev Khudanpur, Shinji Watanabe, Shuaijiang Zhao, Wei Zou, Xiangang Li, Xuchen Yao, Yongqing Wang, Zhao You, Zhiyong Yan
2021InterspeechControllable Context-Aware Conversational Speech Synthesis.Jian Cong, Shan Yang, Na Hu, Guangzhi Li, Lei Xie, Dan Su
2021InterspeechGlow-WaveGAN: Learning Speech Representations from GAN-Based Variational Auto-Encoder for High Fidelity Flow-Based Speech Synthesis.Jian Cong, Shan Yang, Lei Xie, Dan Su
2021InterspeechRaw Waveform Encoder with Multi-Scale Globally Attentive Locally Recurrent Networks for End-to-End Speech Recognition.Max W. Y. Lam, Jun Wang, Chao Weng, Dan Su, Dong Yu
2021InterspeechTeCANet: Temporal-Contextual Attention Network for Environment-Aware Speech Dereverberation.Helin Wang, Bo Wu, Lianwu Chen, Meng Yu, Jianwei Yu, Yong Xu, Shi-Xiong Zhang, Chao Weng, Dan Su, Dong Yu
2021InterspeechSpeechMoE: Scaling to Large Acoustic Models with Dynamic Routing Mixture of Experts.Zhao You, Shulin Feng, Dan Su, Dong Yu
2020EMNLPMulti-hop Question Generation with Graph Convolutional Network.Dan Su, Yan Xu, Wenliang Dai, Ziwei Ji, Tiezheng Yu, Pascale Fung
2020EMNLPCAiRE-COVID: A Question Answering and Query-focused Multi-Document Summarization System for COVID-19 Scholarly Information Management.Dan Su, Yan Xu, Tiezheng Yu, Farhad Bin Siddique, Elham J. Barezi, Pascale Fung
2020EMNLPDimsum @LaySumm 20.Tiezheng Yu, Dan Su, Wenliang Dai, Pascale Fung
2020ICASSPCode-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora.Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020ICASSPEnhancing End-to-End Multi-Channel Speech Separation Via Spatial Feature Learning.Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu
2020ICASSPA Random Gossip BMUF Process for Neural Language Modeling.Yiheng Huang, Jinchuan Tian, Lei Han, Guangsen Wang, Xingcheng Song, Dan Su, Dong Yu
2020ICASSPIntegration of Multi-Look Beamformers for Multi-Channel Keyword Spotting.Xuan Ji, Meng Yu, Jie Chen, Jimeng Zheng, Dan Su, Dong Yu
2020ICASSPSpeaker-Aware Target Speaker Enhancement by Jointly Learning with Speaker Embedding Extraction.Xuan Ji, Meng Yu, Chunlei Zhang, Dan Su, Tao Yu, Xiaoyu Liu, Dong Yu
2020ICASSPMixup-breakdown: A Consistency Training Method for Improving Generalization of Speech Separation Models.Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu
2020ICASSPMulti-Level Deep Neural Network Adaptation for Speaker Verification Using MMD and Consistency Regularization.Weiwei Lin, Man-Wai Mak, Na Li, Dan Su, Dong Yu
2020ICASSPEnd-To-End Accent Conversion Without Using Native Utterances.Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020ICASSPImproving Spoken Question Answering Using Contextualized Word Representation.Dan Su, Pascale Fung
2020ICASSPDfsmn-San with Persistent Memory Model for Automatic Speech Recognition.Zhao You, Dan Su, Jie Chen, Chao Weng, Dong Yu
2020InterspeechEnd-to-End Multi-Look Keyword Spotting.Meng Yu, Xuan Ji, Bo Wu, Dan Su, Dong Yu
2020InterspeechInvestigating Robustness of Adversarial Samples Detection for Automatic Speaker Verification.Xu Li, Na Li, Jinghua Zhong, Xixin Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020InterspeechTransferring Source Style in Non-Parallel Voice Conversion.Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020InterspeechSpecSwap: A Simple Data Augmentation Method for End-to-End Speech Recognition.Xingcheng Song, Zhiyong Wu, Yiheng Huang, Dan Su, Helen Meng
2020InterspeechSpeech-XLNet: Unsupervised Acoustic Model Pretraining for Self-Attention Networks.Xingchen Song, Guangsen Wang, Yiheng Huang, Zhiyong Wu, Dan Su, Helen Meng
2020InterspeechDurIAN: Duration Informed Attention Network for Speech Synthesis.Chengzhu Yu, Heng Lu, Na Hu, Meng Yu, Chao Weng, Kun Xu, Peng Liu, Deyi Tuo, Shiyin Kang, Guangzhi Lei, Dan Su, Dong Yu
2020InterspeechAudio-Visual Multi-Channel Recognition of Overlapped Speech.Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng
2019ASRUSyllable-Dependent Discriminative Learning for Small Footprint Text-Dependent Speaker Verification.Junyi Peng, Yuexian Zou, Na Li, Deyi Tuo, Dan Su, Meng Yu, Chunlei Zhang, Dong Yu
2019ASRUImproving Speech Enhancement with Phonetic Embedding Features.Bo Wu, Meng Yu, Lianwu Chen, Mingjie Jin, Dan Su, Dong Yu
2019ICASSPMulti-band PIT and Model Integration for Improved Multi-channel Speech Separation.Lianwu Chen, Meng Yu, Dan Su, Dong Yu
2019ICASSPBoundary Discriminative Large Margin Cosine Loss for Text-independent Speaker Verification.Rongjin Li, Na Li, Deyi Tuo, Meng Yu, Dan Su, Dong Yu
2019ICASSPComponent Fusion: Learning Replaceable Language Model Component for End-to-end Speech Recognition System.Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie
2019ICASSPInvestigating End-to-end Speech Recognition for Mandarin-english Code-switching.Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie
2019ICASSPLearning Discriminative Features in Sequence Training without Requiring Framewise Labelled Data.Jun Wang, Dan Su, Jie Chen, Shulin Feng, Dongpeng Ma, Na Li, Dong Yu
2019ICASSPQuasi-fully Convolutional Neural Network with Variational Inference for Speech Synthesis.Mu Wang, Xixin Wu, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Guangzhi Li, Dan Su, Dong Yu, Helen Meng
2019ICASSPJoint Training of Complex Ratio Mask Based Beamformer and Acoustic Model for Noise Robust Asr.Yong Xu, Chao Weng, Like Hui, Jianming Liu, Meng Yu, Dan Su, Dong Yu
2019ICASSPTeach an All-rounder with Experts in Different Domains.Zhao You, Dan Su, Dong Yu
2019InterspeechDisambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-Trained BERT.Dongyang Dai, Zhiyong Wu, Shiyin Kang, Xixin Wu, Jia Jia, Dan Su, Dong Yu, Helen Meng
2019InterspeechNeural Spatial Filter: Target Speaker Speech Separation Assisted with Directional Information.Rongzhi Gu, Lianwu Chen, Shi-Xiong Zhang, Jimeng Zheng, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu
2019InterspeechExtract, Adapt and Recognize: An End-to-End Neural Network for Corrupted Monaural Speech Recognition.Max W. Y. Lam, Jun Wang, Xunying Liu, Helen Meng, Dan Su, Dong Yu
2019IROSDISR: Deep Infrared Spectral Restoration Algorithm for Robot Sensing and Intelligent Visual Tracking Systems.Hai Liu, Youfu Li, Dan Su, Zhaoli Zhang, Sannyuya Liu, Tingting Liu
2019IROSRegion-wise Polynomial Regression for 3D Mobile Gaze Estimation.Dan Su, Youfu Li, Hao Chen
2018InterspeechPermutation Invariant Training of Generative Adversarial Network for Monaural Speech Separation.Lianwu Chen, Meng Yu, Yanmin Qian, Dan Su, Dong Yu
2018InterspeechDeep Discriminative Embeddings for Duration Robust Speaker Verification.Na Li, Deyi Tuo, Dan Su, Zhifeng Li, Dong Yu
2018InterspeechDeep Extractor Network for Target Speaker Recovery from Single Channel Speech Mixtures.Jun Wang, Jie Chen, Dan Su, Lianwu Chen, Meng Yu, Yanmin Qian, Dong Yu
2018InterspeechImproving Attention Based Sequence-to-Sequence Models for End-to-End English Conversational Speech Recognition.Chao Weng, Jia Cui, Guangsen Wang, Jun Wang, Chengzhu Yu, Dan Su, Dong Yu
2018InterspeechRapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis.Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2018InterspeechText-Dependent Speech Enhancement for Small-Footprint Robust Keyword Detection.Meng Yu, Xuan Ji, Yi Gao, Lianwu Chen, Jie Chen, Jimeng Zheng, Dan Su, Dong Yu
2018IROSAttention-Aware Cross-Modal Cross-Level Fusion Network for RGB-D Salient Object Detection.Hao Chen, Youfu Li, Dan Su
2017IROSMHao Chen, You-Fu Li, Dan Su
2017ICRADevelopment of precise mobile gaze tracking system based on online sparse Gaussian process regression and smooth-pursuit identification.Dan Su, Youfu Li
2017ICVSRGB-D Saliency Detection by Multi-stream Late Fusion Network.Hao Chen, Youfu Li, Dan Su
2016TrustComAnomadroid: Profiling Android Applications' Behaviors for Identifying Unknown Malapps.Dan Su, Wei Wang, Xing Wang, Jiqiang Liu
2013HPCCA New Algorithm for Repairing Non-manifold Surfaces.Yaoping Fei, Songqiao Chen, Dan Su, Jianping Luo, Min Li
2013ICASSPMultimodal music emotion classification using AdaBoost with decision stumps.Dan Su, Pascale Fung, Nicolas Auguin
2012InterspeechProbabilistic Speaker-Class based Acoustic Modeling for Large Vocabulary Continuous Speech Recognition.Xiangang Li, Dan Su, Zaihu Pang, Xihong Wu
2010ICASSPGMM-HMM acoustic model training by a two level procedure with Gaussian components determined by automatic model selection.Dan Su, Xihong Wu, Lei Xu
2008InterspeechProbabilistic latent speaker training for large vocabulary speech recognition.Dan Su, Xihong Wu, Huisheng Chi
2007InterspeechProbabilistic latent speaker analysis for large vocabulary speech recognition.Dan Su, Xihong Wu, Huisheng Chi