Skip to content

IEEE Automatic Speech Recognition and Understanding Workshop

ASRU

C

CORE rank

CORE rank (raw)

C

Fields of research

Artificial Intelligence

Papers indexed

1,323

2007–2025

Papers per year

2007209 peak2025

ASRU papers

1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2023SLM: Bridge the Thin Gap Between Speech and Text Foundation Models.Mingqiu Wang, Wei Han, Izhak Shafran, Zelin Wu, Chung-Cheng Chiu, Yuan Cao, Nanxin Chen, Yu Zhang, Hagen Soltau, Paul K. Rubenstein, Lukas Zilka, Dian Yu, Golan Pundak, Nikhil Siddhartha, Johan Schalkwyk, Yonghui Wu
2023Minisuperb: Lightweight Benchmark for Self-Supervised Speech Models.Yu-Hsiang Wang, Huang-Yu Chen, Kai-Wei Chang, Winston H. Hsu, Hung-Yi Lee
2023Speaker Adaptation for End-to-End Speech Recognition Systems in Noisy Environments.Dominik Wagner, Ilja Baumann, Sebastian P. Bayerl, Korbinian Riedhammer, Tobias Bocklet
2023Parameter-Efficient Tuning with Adaptive Bottlenecks for Automatic Speech Recognition.Geoffroy Vanderreydt, Amrutha Prasad, Driss Khalil, Srikanth R. Madikeri, Kris Demuynck, Petr Motlcek
2023Gated Multi Encoders and Multitask Objectives for Dialectal Speech Recognition in Indian Languages.Sathvik Udupa, Jesuraja Bandekar, Deekshitha G, Saurabh Kumar, Prasanta Kumar Ghosh, Sandhya Badiger, Abhayjeet Singh, Savitha Murthy, Priyanka Pai, Srinivasa Raghavan K. M., Raoul Nanavati
2023Hierarchical Attention-Based Contextual Biasing For Personalized Speech Recognition Using Neural Transducers.Sibo Tong, Philip Harding, Simon Wiesler
2023Diffusion-Based Mel-Spectrogram Enhancement for Personalized Speech Synthesis with Found Data.Yusheng Tian, Wei Liu, Tan Lee
2023ECAPA2: A Hybrid Neural Network Architecture and Training Strategy for Robust Speaker Embeddings.Jenthe Thienpondt, Kris Demuynck
2023Clustering Unsupervised Representations as Defense Against Poisoning Attacks on Speech Commands Classification System.Thomas Thebaud, Sonal Joshi, Henry Li, Martin Sustek, Jess Villalba, Sanjeev Khudanpur, Najim Dehak
2023Thai-Dialect: Low Resource Thai Dialectal Speech to Text Corpora.Artit Suwanbandit, Jaturong Chitiyaphol, Sutthinan Chuenchom, Kanyarat Kwiecien, Husen Sawal, Ruslan Uthai, Orathai Sangpetch, Ekapol Chuangsuwanich
2023Joint Energy-Based Model for Robust Speech Classification System Against Dirty-Label Backdoor Poisoning Attacks.Martin Sustek, Sonal Joshi, Henry Li, Thomas Thebaud, Jess Villalba, Sanjeev Khudanpur, Najim Dehak
2023Building High-Accuracy Multilingual ASR With Gated Language Experts and Curriculum Training.Eric Sun, Jinyu Li, Yuxuan Hu, Yimeng Zhu, Long Zhou, Jian Xue, Peidong Wang, Linquan Liu, Shujie Liu, Edward Lin, Yifan Gong
2023Enhancing Task-Oriented Dialogues With Chitchat: A Comparative Study Based on Lexical Diversity And Divergence.Armand Stricker, Patrick Paroubek
2023Contextual Spelling Correction with Large Language Models.Gan Song, Zelin Wu, Golan Pundak, Angad Chandorkar, Kandarp Joshi, Xavier Velez, Diamantino Caseiro, Ben Haynor, Weiran Wang, Nikhil Siddhartha, Pat Rondon, Khe Chai Sim
2023Segment-Level Vectorized Beam Search Based on Partially Autoregressive Inference.Masao Someki, Nicholas Eng, Yosuke Higuchi, Shinji Watanabe
2023Detecting Speech Abnormalities With a Perceiver-Based Sequence Classifier that Leverages a Universal Speech Model.Hagen Soltau, Izhak Shafran, Alex Ottenwess, Joseph R. Duffy, Rene L. Utianski, Leland R. Barnard, John L. Stricker, Daniela A. Wiepert, David T. Jones, Hugo Botha
2023Discriminative Speech Recognition Rescoring With Pre-Trained Language Models.Prashanth Gurunath Shivakumar, Jari Kolehmainen, Yile Gu, Ankur Gandhe, Ariya Rastrow, Ivan Bulyko
2023Domain Adaptation by Data Distribution Matching Via Submodularity For Speech Recognition.Yusuke Shinohara, Shinji Watanabe
2023Findings of the 2023 ML-Superb Challenge: Pre-Training And Evaluation Over More Languages And Beyond.Jiatong Shi, William Chen, Dan Berrebbi, Hsiu-Hsuan Wang, Wei-Ping Huang, En-Pei Hu, Ho-Lam Chuang, Xuankai Chang, Yuxun Tang, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Shinji Watanabe
2023SQAT-LD: SPeech Quality Assessment Transformer Utilizing Listener Dependent Modeling for Zero-Shot Out-of-Domain MOS Prediction.Kailai Shen, Diqun Yan, Li Dong, Ying Ren, Xiaoxun Wu, Jing Hu
2023Generative Linguistic Representation for Spoken Language Identification.Peng Shen, Xuguang Lu, Hisashi Kawai
2023Espnet-Summ: Introducing a Novel Large Dataset, Toolkit, and a Cross-Corpora Evaluation of Speech Summarization Systems.Roshan S. Sharma, William Chen, Takatomo Kano, Ruchira Sharma, Siddhant Arora, Shinji Watanabe, Atsunori Ogawa, Marc Delcroix, Rita Singh, Bhiksha Raj
2023Spectral Tilt May Have a Smaller Impact on the Intelligibility of Speech in Noise.Yoshiki Sato, Julin Villegas
2023HEVAL: A New Hybrid Evaluation Metric for Automatic Speech Recognition Tasks.Zitha Sasindran, Harsha Yelchuri, T. V. Prabhakar, Supreeth Rao
2023Invert-Classify: Recovering Discrete Prosody Inputs for Text-To-Speech.Nicholas Sanders, Korin Richmond
251275 of 1,323← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.