| 2021 | Enabling Zero-Shot Multilingual Spoken Language Translation with Language-Specific Encoders and Decoders. | Carlos Escolano, Marta R. Costa-juss, Jos A. R. Fonollosa, Carlos Segura |
| 2021 | Colombian Dialect Recognition Based on Information Extracted from Speech and Text Signals. | Daniel Escobar-Grisales, Cristian D. Ros-Urrego, Diego Alexander Lopez-Santander, Jeferson David Gallo-Aristizbal, Juan Camilo Vsquez-Correa, Elmar Nth, Juan Rafael Orozco-Arroyave |
| 2021 | Expressive Voice Conversion: A Joint Framework for Speaker Identity and Emotional Style Transfer. | Zongyang Du, Berrak Sisman, Kun Zhou, Haizhou Li |
| 2021 | Textual Echo Cancellation. | Shaojin Ding, Ye Jia, Ke Hu, Quan Wang |
| 2021 | Using Self Attention DNNs to Discover Phonemic Features for Audio Deep Fake Detection. | Hira Dhamyal, Ayesha Ali, Ihsan Ayyub Qazi, Agha Ali Raza |
| 2021 | Improving Hybrid CTC/Attention End-to-End Speech Recognition with Pretrained Acoustic and Language Models. | Keqi Deng, Songjun Cao, Yike Zhang, Long Ma |
| 2021 | Two-Pass End-to-End ASR Model Compression. | Nauman Dawalatabad, Tushar Vatsal, Ashutosh Gupta, Sungsoo Kim, Shatrughan Singh, Dhananjaya Gowda, Chanwoo Kim |
| 2021 | Overlap-Aware Low-Latency Online Speaker Diarization Based on End-to-End Local Segmentation. | Juan Manuel Coria, Herv Bredin, Sahar Ghannay, Sophie Rosset |
| 2021 | w2v-BERT: Combining Contrastive Learning and Masked Language Modeling for Self-Supervised Speech Pre-Training. | Yu-An Chung, Yu Zhang, Wei Han, Chung-Cheng Chiu, James Qin, Ruoming Pang, Yonghui Wu |
| 2021 | On-The-Fly Data Augmentation for Text-to-Speech Style Transfer. | Raymond Chung, Brian Mak |
| 2021 | Non-Autoregressive Mandarin-English Code-Switching Speech Recognition. | Shun-Po Chuang, Heng-Jui Chang, Sung-Feng Huang, Hung-yi Lee |
| 2021 | Short-Utterance Embedding Enhancement Method Based on Time Series Forecasting Technique for Text-Independent Speaker Verification. | Jeong-Hwan Choi, Joon-Young Yang, Joon-Hyuk Chang |
| 2021 | Variational Sequential Modeling, Learning and Understanding. | Jen-Tzung Chien, Chih-Jung Tsai |
| 2021 | HASA-Net: A Non-Intrusive Hearing-Aid Speech Assessment Network. | Hsin-Tien Chiang, Yi-Chiao Wu, Cheng Yu, Tomoki Toda, Hsin-Min Wang, Yih-Chun Hu, Yu Tsao |
| 2021 | Injecting Text in Self-Supervised Speech Pretraining. | Zhehuai Chen, Yu Zhang, Andrew Rosenberg, Bhuvana Ramabhadran, Gary Wang, Pedro J. Moreno |
| 2021 | Scenario Aware Speech Recognition: Advancements for Apollo Fearless Steps & CHiME-4 Corpora. | Szu-Jui Chen, Wei Xia, John H. L. Hansen |
| 2021 | Human-Agent Collaboration Strategies for Vision-Grounded Instruction Following. | Guan-Lin Chao, Ian R. Lane |
| 2021 | TENET: A Time-Reversal Enhancement Network for Noise-Robust ASR. | Fu-An Chao, Shao-Wei Fan-Jiang, Bi-Cheng Yan, Jeih-weih Hung, Berlin Chen |
| 2021 | An Exploration of Self-Supervised Pretrained Representations for End-to-End Speech Recognition. | Xuankai Chang, Takashi Maekaku, Pengcheng Guo, Jing Shi, Yen-Ju Lu, Aswin Shanmugam Subramanian, Tianzi Wang, Shu-Wen Yang, Yu Tsao, Hung-yi Lee, Shinji Watanabe |
| 2021 | Context-Aware Transformer Transducer for Speech Recognition. | Feng-Ju Chang, Jing Liu, Martin Radfar, Athanasios Mouchtaris, Maurizio Omologo, Ariya Rastrow, Siegfried Kunzmann |
| 2021 | On the Invertibility of a Voice Privacy System Using Embedding Alignment. | Pierre Champion, Thomas Thebaud, Gal Le Lan, Anthony Larcher, Denis Jouvet |
| 2021 | Learning Language and Speaker Information for Code-Switch Speech Synthesis with Limited Data. | Mengxin Chai, Shaotong Guo, Cheng Gong, Longbiao Wang, Jianwu Dang, Ju Zhang |
| 2021 | Leveraging Linguistic Knowledge for Accent Robustness of End-to-End Models. | Andrea Carmantini, Steve Renals, Peter Bell |
| 2021 | Efficient Conformer: Progressive Downsampling and Grouped Attention for Automatic Speech Recognition. | Maxime Burchi, Valentin Vielzeuf |
| 2021 | A Study on Cross-Corpus Speech Emotion Recognition and Data Augmentation. | Norbert Braunschweiler, Rama Doddipatla, Simon Keizer, Svetlana Stoyanchev |