| 2023 | Transferring Speech-Generic and Depression-Specific Knowledge for Alzheimer's Disease Detection. | Ziyun Cui, Wen Wu, Wei-Qiang Zhang, Ji Wu, Chao Zhang |
| 2023 | End-to-End Multichannel Speaker-Attributed ASR: Speaker Guided Decoder and Input Feature Analysis. | Can Cui, Imran A. Sheikh, Mostafa Sadeghi, Emmanuel Vincent |
| 2023 | The Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains. | Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2023 | Improving Audiovisual Active Speaker Detection in Egocentric Recordings with the Data-Efficient Image Transformer. | Jason Clarke, Yoshihiko Gotoh, Stefan Goetze |
| 2023 | Evaluating Self-Supervised Speech Models on a Taiwanese Hokkien Corpus. | Yi-Hui Chou, Kalvin Chang, Meng-Ju Wu, Winston Ou, Alice Wen-Hsin Bi, Carol Yang, Bryan Y. Chen, Rong-Wei Pai, Po-Yen Yeh, Jo-Peng Chiang, Iu-Tshian Phoann, Winnie Chang, Chenxuan Cui, Noel Chen, Jiatong Shi |
| 2023 | Extending Self-Distilled Self-Supervised Learning For Semi-Supervised Speaker Verification. | Jeong-Hwan Choi, Jehyun Kyung, Ju-Seok Seong, Ye-Rin Jeoung, Joon-Hyuk Chang |
| 2023 | Few-Shot Spoken Language Understanding Via Joint Speech-Text Models. | Chung-Ming Chien, Mingjiamei Zhang, Ju-Chieh Chou, Karen Livescu |
| 2023 | Adversarial Augmentation For Adapter Learning. | Jen-Tzung Chien, Wei-Yu Sun |
| 2023 | Study on the Correlation Between Objective Evaluations and Subjective Speech Quality and Intelligibility. | Hsin-Tien Chiang, Kuo-Hsuan Hung, Szu-Wei Fu, Heng-Cheng Kuo, Ming-Hsueh Tsai, Yu Tsao |
| 2023 | BA-MoE: Boundary-Aware Mixture-of-Experts Adapter for Code-Switching Speech Recognition. | Peikun Chen, Fan Yu, Yuhao Liang, Hongfei Xue, Xucheng Wan, Naijun Zheng, Huan Zhou, Lei Xie |
| 2023 | Improving Stability in Simultaneous Speech Translation: A Revision-Controllable Decoding Approach. | Jun-Kun Chen, Jian Xue, Peidong Wang, Jing Pan, Jinyu Li |
| 2023 | Joint Prediction and Denoising for Large-Scale Multilingual Self-Supervised Learning. | William Chen, Jiatong Shi, Brian Yan, Dan Berrebbi, Wangyou Zhang, Yifan Peng, Xuankai Chang, Soumi Maiti, Shinji Watanabe |
| 2023 | Efficient Text-Only Domain Adaptation For CTC-Based ASR. | Chang Chen, Xun Gong, Yanmin Qian |
| 2023 | Meta-Learning Framework for End-to-End Imposter Identification in Unseen Speaker Recognition. | Ashutosh Chaubey, Sparsh Sinha, Susmita Ghose |
| 2023 | Prompting and Adapter Tuning For Self-Supervised Encoder-Decoder Speech Model. | Kai-Wei Chang, Ming-Hsin Chen, Yun-Ping Lin, Jing Neng Hsu, Paul Kuo-Ming Huang, Chien-Yu Huang, Shang-Wen Li, Hung-Yi Lee |
| 2023 | Efficient Cascaded Streaming ASR System Via Frame Rate Reduction. | Xingyu Cai, David Qiu, Shaojin Ding, Dongseong Hwang, Weiran Wang, Antoine Bruguier, Rohit Prabhavalkar, Tara N. Sainath, Yanzhang He |
| 2023 | Ending the Blind Flight: Analyzing the Impact of Acoustic and Lexical Factors on WAV2VEC 2.0 in Air-Traffic Control. | Alexander Blatt, Badr M. Abdullah, Dietrich Klakow |
| 2023 | Pareto Efficiency of Learning-Forgetting Trade-Off in Neural Language Model Adaptation. | Jerome R. Bellegarda |
| 2023 | Detection of Vowel Errors in Children's Speech using Synthetic Phonetic Transcripts. | Ilja Baumann, Dominik Wagner, Korbinian Riedhammer, Elmar Nth, Tobias Bocklet |
| 2023 | Enabling Noisy Label Usage for Out-of-Airspace Data in Read-Back Error Detection. | Lakshmi Rajendram Bashyam, Alexander Blatt, Dietrich Klakow |
| 2023 | Importance of Smoothness Induced by Optimizers in Fl4Asr: Towards Understanding Federated Learning for End-To-End ASR. | Sheikh Shams Azam, Tatiana Likhomanenko, Martin Pelikan, Jan Honza Silovsky |
| 2023 | Improved Long-Form Speech Recognition By Jointly Modeling The Primary And Non-Primary Speakers. | Guru Prakash Arumugam, Shuo-Yiin Chang, Tara N. Sainath, Rohit Prabhavalkar, Quan Wang, Shaan Bijwadia |
| 2023 | Wiki-En-ASR-Adapt: Large-Scale Synthetic Dataset for English ASR Customization. | Alexandra Antonova |
| 2023 | Dialect Adaptation and Data Augmentation for Low-Resource ASR: Taltech Systems for the Madasr 2023 Challenge. | Tanel Alume, Jiaming Kong, Daniil Robnikov |
| 2021 | Speech Emotion Recognition Using Semi-Supervised Learning with Efficient Labeling Strategies. | Zhi Zhu, Yoshinao Sato |