Skip to content

IEEE Automatic Speech Recognition and Understanding Workshop

ASRU

C

CORE rank

CORE rank (raw)

C

Fields of research

Artificial Intelligence

Papers indexed

1,323

2007–2025

Papers per year

2007209 peak2025

ASRU papers

1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025Hybrid Decoding: Rapid Pass and Selective Detailed Correction for Sequence Models.Yunkyu Lim, Jihwan Park, Hyung Yong Kim, Hanbin Lee, Byeong-Yeol Kim
2025Improving Noise Robust Audio-Visual Speech Recognition via Router-Gated Cross-Modal Feature Fusion.DongHoon Lim, YoungChae Kim, Dong-Hyun Kim, Da-Hee Yang, Joon-Hyuk Chang
2025ChipChat: Low-Latency Cascaded Conversational Agent in MLX.Tatiana Likhomanenko, Luke Carlson, Richard He Bai, Zijin Gu, Han Tran, Zakaria Aldeneh, Yizhe Zhang, Ruixiang Zhang, Huangjie Zheng, Navdeep Jaitly
2025Selection of Layers from Self-supervised Learning Models for Predicting Mean-Opinion-Score of Speech.Xinyu Liang, Fredrik Cumlin, Victor Ungureanu, Chandan K. A. Reddy, Christian Schldt, Saikat Chatterjee
2025Robust Speech Emotion Recognition via Classifier Retraining on Mixup-Augmented Representations.Shi-Wook Lee
2025Competitive Audio-Language Models with Data-Efficient Single-Stage Training on Public Data.Gokul Karthik Kumar, Rishabh Saraf, Ludovick Lepauloux, Abdul Muneer, Billel Mokeddem, Hakim Hacid
2025MADASR 2.0: Multi-Lingual Multi-Dialect ASR Challenge in 8 Indian Languages.Saurabh Kumar, Sumit Sharma, Deekshitha G, Abhayjeet Singh, Amartyaveer, Sathvik Udupa, Sandhya Badiger, Sanjeev Khudanpur, Sunayana Sitaram, Srinivasan Umesh, Bhuvana Ramabhadran, Brian Kingsbury, Hema A. Murthy, Srikanth S. Narayanan, Howard Lakougna, Prasanta Kumar Ghosh
2025TokenVerse++: Towards Flexible Multitask Learning with Dynamic Task Activation.Shashi Kumar, Srikanth R. Madikeri, Esa Villatoro-Tello, Sergio Burdisso, Pradeep Rangappa, Roberto Carofilis, Petr Motlcek, Karthik Pandia, Shankar Venkatesan, Kadri Hacioglu, Andreas Stolcke
2025Token-based Attractors and Cross-attention in Spoof Diarization.Kyo-Won Koo, Chan-yeong Lim, Jee-Weon Jung, Hye-Jin Shim, Ha-Jin Yu
2025Efficient ASR Domain Adaptation with Long Noun Phrases: Harnessing the Linguistic Characteristics of Japanese.Shusuke Komatsu, Kazuyo Onishi, Koki Tanaka, Dohyun Kim, Koichiro Yoshino
2025Do Self-Supervised Speech Models Exhibit the Critical Period Effects in Language Acquisition?Yurie Koga, Shunsuke Kando, Yusuke Miyao
2025A Momentum-Based Framework with Contrastive Data Generation for Robust Sound Source Localization.Hyun-Soo Kim, Da-Hee Yang, Joon-Hyuk Chang
2025Expressive Speech Retrieval using Natural Language Descriptions of Speaking Style.Wonjune Kang, Deb Roy
2025REF-VC: Robust, Expressive and Fast Zero-Shot Voice Conversion with Diffusion Transformers.Yuepeng Jiang, Ziqian Ning, Shuai Wang, Chengjia Wang, Mengxiao Bi, Pengcheng Zhu, Zhonghua Fu, Lei Xie
2025A Study of the Scale Invariant Signal to Distortion Ratio in Speech Separation with Noisy ReferencesSimon Dahl Jepsen, Mads Grsbll Christensen, Jesper Rindom Jensen
2025Few-shot Personalization via In-Context Learning for Speech Emotion Recognition based on Speech-Language Model.Mana Ihori, Taiga Yamane, Naotaka Kawata, Naoki Makishima, Tomohiro Tanaka, Satoshi Suzuki, Shota Orihashi, Ryo Masumura
2025SLM-S2ST: A multimodal language model for direct speech-to-speech translation.Yuxuan Hu, Haibin Wu, Ruchao Fan, Xiaofei Wang, Heng Lu, Yao Qian, Jinyu Li
2025Identifying and Calibrating Overconfidence in Noisy Speech Recognition.Mingyue Huo, Yuheng Zhang, Yan Tang
2025Long-Form Fuzzy Speech-to-Text Alignment for 1000+ Languages.Ruizhe Huang, Xiaohui Zhang, Zhaoheng Ni, Moto Hira, Jeff Hwang, Vineel Pratap, Ju Lin, Ming Sun, Florian Metze
2025The AudioMOS Challenge 2025.Wen-Chin Huang, Hui Wang, Cheng Liu, Yi-Chiao Wu, Andros Tjandra, Wei-Ning Hsu, Erica Cooper, Yong Qin, Tomoki Toda
2025A Neural Model for Contextual Biasing Score Learning and Filtering.Wanting Huang, Weiran Wang
2025SUTA-LM: Bridging Test-Time Adaptation and Language Model Rescoring for Robust ASR.Wei-Ping Huang, Guan-Ting Lin, Hung-Yi Lee
2025Revealing the Role of Audio Channels in ASR Performance Degradation.Kuan-Tang Huang, Li-Wei Chen, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang
2025Reducing Object Hallucination in Large Audio-Language Models via Audio-Aware Decoding.Tzu-Wen Hsu, Ke-Han Lu, Cheng-Han Chiang, Hung-Yi Lee
2025SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition.Ming-Hao Hsu, Hung-Yi Lee
126150 of 1,323← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.