Skip to content

IEEE Automatic Speech Recognition and Understanding Workshop

ASRU

C

CORE rank

CORE rank (raw)

C

Fields of research

Artificial Intelligence

Papers indexed

1,323

2007–2025

Papers per year

2007209 peak2025

ASRU papers

1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2023Transformer Attractors for Robust and Efficient End-To-End Neural Diarization.Lahiru Samarakoon, Samuel J. Broughton, Marc Hrknen, Ivan Fung
2023Leveraging the Multilingual Indonesian Ethnic Languages Dataset In Self-Supervised Models for Low-Resource ASR Task.Sakriani Sakti, Benita Angela Titalim
2023A Single Speech Enhancement Model Unifying Dereverberation, Denoising, Speaker Counting, Separation, And Extraction.Kohei Saijo, Wangyou Zhang, Zhong-Qiu Wang, Shinji Watanabe, Tetsunori Kobayashi, Tetsuji Ogawa
2023Rescuespeech: A German Corpus for Speech Recognition in Search and Rescue Domain.Sangeet Sagar, Mirco Ravanelli, Bernd Kiefer, Ivana Kruijff-Korbayov, Josef van Genabith
2023Robust Logarithmic Champernowne Algorithm for Feedback Cancellation in Hearing aids.Vanitha Devi R, Vasundhara
2023On the Relevance of Phoneme Duration Variability of Synthesized Training Data for Automatic Speech Recognition.Nick Rossenbach, Benedikt Hilmes, Ralf Schlter
2023Fast Conformer With Linearly Scalable Attention For Efficient Speech Recognition.Dima Rekesh, Nithin Rao Koluguri, Samuel Kriman, Somshubra Majumdar, Vahid Noroozi, He Huang, Oleksii Hrinchuk, Krishna C. Puvvada, Ankur Kumar, Jagadeesh Balam, Boris Ginsburg
2023On Time Domain Conformer Models for Monaural Speech Separation in Noisy Reverberant Acoustic Environments.William Ravenscroft, Stefan Goetze, Thomas Hain
2023Two-Pass Endpoint Detection for Speech Recognition.Anirudh Raju, Aparna Khare, Di He, Ilya Sklyar, Long Chen, Sam Alptekin, Viet Anh Trinh, Zhe Zhang, Colin Vaz, Venkatesh Ravichandran, Roland Maas, Ariya Rastrow
2023MASR: Multi-Label Aware Speech Representation.Anjali Raj, Shikhar Bharadwaj, Sriram Ganapathy, Min Ma, Shikhar Vashishth
2023Paraconsistent Feature Analysis for the Competency Evaluation of Voice Impersonation.Rajeev Rajan, Noumida Abdul Kareem, Sreelakshmi S
2023Can We Use Speaker Embeddings On Spontaneous Speech Obtained From Medical Conversations To Predict Intelligibility?Sebastio Quintas, Mathieu Balaguer, Julie Mauclair, Virginie Woisard, Julien Pinquier
2023Improving Large-Scale Deep Biasing With Phoneme Features and Text-Only Data in Streaming Transducer.Jin Qiu, Lu Huang, Boyu Li, Jun Zhang, Lu Lu, Zejun Ma
2023The Role of Feature Correlation on Quantized Neural Networks.David Qiu, Shaojin Ding, Yanzhang He
2023LE-SSL-MOS: Self-Supervised Learning MOS Prediction with Listener Enhancement.Zili Qi, Xinhui Hu, Wangjin Zhou, Sheng Li, Hao Wu, Jian Lu, Xinkang Xu
2023Towards Developing State-of-The-Art TTS Synthesisers for 13 Indian Languages with Signal Processing Aided Alignments.Anusha Prakash, Srinivasan Umesh, Hema A. Murthy
2023Reproducing Whisper-Style Training Using An Open-Source Toolkit And Publicly Available Data.Yifan Peng, Jinchuan Tian, Brian Yan, Dan Berrebbi, Xuankai Chang, Xinjian Li, Jiatong Shi, Siddhant Arora, William Chen, Roshan S. Sharma, Wangyou Zhang, Yui Sudo, Muhammad Shakeel, Jee-Weon Jung, Soumi Maiti, Shinji Watanabe
2023Multitask Learning Model with Text and Speech Representation for Fine-Grained Speech Scoring.Seongjin Park, Rutuja Ubale
2023Token-Level Serialized Output Training for Joint Streaming ASR and ST Leveraging Textual Alignments.Sara Papi, Peidong Wang, Jun-Kun Chen, Jian Xue, Jinyu Li, Yashesh Gaur
2023Scenario-Aware Audio-Visual TF-Gridnet for Target Speech Extraction.Zexu Pan, Gordon Wichern, Yoshiki Masuyama, Franois G. Germain, Sameer Khurana, Chiori Hori, Jonathan Le Roux
2023WaveNeXt: ConvNeXt-Based Fast Neural Vocoder Without ISTFT layer.Takuma Okamoto, Haruki Yamashita, Yamato Ohtani, Tomoki Toda, Hisashi Kawai
2023Vits-Based Singing Voice Conversion Leveraging Whisper and Multi-Scale F0 Modeling.Ziqian Ning, Yuepeng Jiang, Zhichao Wang, Bin Zhang, Lei Xie
2023Audio-Adapterfusion: A Task-Id-Free Approach for Efficient and Non-Destructive Multi-Task Speech Recognition.Hillary Ngai, Rohan Agrawal, Neeraj Gaur, W. Ronny Huang, Parisa Haghani, Pedro Moreno Mengibar
2023Permod: Perceptually Grounded Voice Modification With Latent Diffusion Models.Robin Netzorg, Ajil Jalal, Luna McNulty, Gopala Krishna Anumanchipalli
2023Combining Relative and Absolute Learning Formulations to Predict Emotional Attributes From Speech.Abinay Reddy Naini, Shruthi Subramanium, Seong-Gyun Leem, Carlos Busso
276300 of 1,323← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.