IEEE Automatic Speech Recognition and Understanding Workshop
ASRU
C
CORE rank
CORE rank (raw)
C
Fields of research
Artificial Intelligence
Papers indexed
1,323
2007–2025
Papers per year
2007209 peak2025
Most published authors
ASRU papers
1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.
| Year | Title | Authors |
|---|---|---|
| 2025 | Hybrid Decoding: Rapid Pass and Selective Detailed Correction for Sequence Models. | Yunkyu Lim, Jihwan Park, Hyung Yong Kim, Hanbin Lee, Byeong-Yeol Kim |
| 2025 | Improving Noise Robust Audio-Visual Speech Recognition via Router-Gated Cross-Modal Feature Fusion. | DongHoon Lim, YoungChae Kim, Dong-Hyun Kim, Da-Hee Yang, Joon-Hyuk Chang |
| 2025 | ChipChat: Low-Latency Cascaded Conversational Agent in MLX. | Tatiana Likhomanenko, Luke Carlson, Richard He Bai, Zijin Gu, Han Tran, Zakaria Aldeneh, Yizhe Zhang, Ruixiang Zhang, Huangjie Zheng, Navdeep Jaitly |
| 2025 | Selection of Layers from Self-supervised Learning Models for Predicting Mean-Opinion-Score of Speech. | Xinyu Liang, Fredrik Cumlin, Victor Ungureanu, Chandan K. A. Reddy, Christian Schldt, Saikat Chatterjee |
| 2025 | Robust Speech Emotion Recognition via Classifier Retraining on Mixup-Augmented Representations. | Shi-Wook Lee |
| 2025 | Competitive Audio-Language Models with Data-Efficient Single-Stage Training on Public Data. | Gokul Karthik Kumar, Rishabh Saraf, Ludovick Lepauloux, Abdul Muneer, Billel Mokeddem, Hakim Hacid |
| 2025 | MADASR 2.0: Multi-Lingual Multi-Dialect ASR Challenge in 8 Indian Languages. | Saurabh Kumar, Sumit Sharma, Deekshitha G, Abhayjeet Singh, Amartyaveer, Sathvik Udupa, Sandhya Badiger, Sanjeev Khudanpur, Sunayana Sitaram, Srinivasan Umesh, Bhuvana Ramabhadran, Brian Kingsbury, Hema A. Murthy, Srikanth S. Narayanan, Howard Lakougna, Prasanta Kumar Ghosh |
| 2025 | TokenVerse++: Towards Flexible Multitask Learning with Dynamic Task Activation. | Shashi Kumar, Srikanth R. Madikeri, Esa Villatoro-Tello, Sergio Burdisso, Pradeep Rangappa, Roberto Carofilis, Petr Motlcek, Karthik Pandia, Shankar Venkatesan, Kadri Hacioglu, Andreas Stolcke |
| 2025 | Token-based Attractors and Cross-attention in Spoof Diarization. | Kyo-Won Koo, Chan-yeong Lim, Jee-Weon Jung, Hye-Jin Shim, Ha-Jin Yu |
| 2025 | Efficient ASR Domain Adaptation with Long Noun Phrases: Harnessing the Linguistic Characteristics of Japanese. | Shusuke Komatsu, Kazuyo Onishi, Koki Tanaka, Dohyun Kim, Koichiro Yoshino |
| 2025 | Do Self-Supervised Speech Models Exhibit the Critical Period Effects in Language Acquisition? | Yurie Koga, Shunsuke Kando, Yusuke Miyao |
| 2025 | A Momentum-Based Framework with Contrastive Data Generation for Robust Sound Source Localization. | Hyun-Soo Kim, Da-Hee Yang, Joon-Hyuk Chang |
| 2025 | Expressive Speech Retrieval using Natural Language Descriptions of Speaking Style. | Wonjune Kang, Deb Roy |
| 2025 | REF-VC: Robust, Expressive and Fast Zero-Shot Voice Conversion with Diffusion Transformers. | Yuepeng Jiang, Ziqian Ning, Shuai Wang, Chengjia Wang, Mengxiao Bi, Pengcheng Zhu, Zhonghua Fu, Lei Xie |
| 2025 | A Study of the Scale Invariant Signal to Distortion Ratio in Speech Separation with Noisy References | Simon Dahl Jepsen, Mads Grsbll Christensen, Jesper Rindom Jensen |
| 2025 | Few-shot Personalization via In-Context Learning for Speech Emotion Recognition based on Speech-Language Model. | Mana Ihori, Taiga Yamane, Naotaka Kawata, Naoki Makishima, Tomohiro Tanaka, Satoshi Suzuki, Shota Orihashi, Ryo Masumura |
| 2025 | SLM-S2ST: A multimodal language model for direct speech-to-speech translation. | Yuxuan Hu, Haibin Wu, Ruchao Fan, Xiaofei Wang, Heng Lu, Yao Qian, Jinyu Li |
| 2025 | Identifying and Calibrating Overconfidence in Noisy Speech Recognition. | Mingyue Huo, Yuheng Zhang, Yan Tang |
| 2025 | Long-Form Fuzzy Speech-to-Text Alignment for 1000+ Languages. | Ruizhe Huang, Xiaohui Zhang, Zhaoheng Ni, Moto Hira, Jeff Hwang, Vineel Pratap, Ju Lin, Ming Sun, Florian Metze |
| 2025 | The AudioMOS Challenge 2025. | Wen-Chin Huang, Hui Wang, Cheng Liu, Yi-Chiao Wu, Andros Tjandra, Wei-Ning Hsu, Erica Cooper, Yong Qin, Tomoki Toda |
| 2025 | A Neural Model for Contextual Biasing Score Learning and Filtering. | Wanting Huang, Weiran Wang |
| 2025 | SUTA-LM: Bridging Test-Time Adaptation and Language Model Rescoring for Robust ASR. | Wei-Ping Huang, Guan-Ting Lin, Hung-Yi Lee |
| 2025 | Revealing the Role of Audio Channels in ASR Performance Degradation. | Kuan-Tang Huang, Li-Wei Chen, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang |
| 2025 | Reducing Object Hallucination in Large Audio-Language Models via Audio-Aware Decoding. | Tzu-Wen Hsu, Ke-Han Lu, Cheng-Han Chiang, Hung-Yi Lee |
| 2025 | SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition. | Ming-Hao Hsu, Hung-Yi Lee |
126–150 of 1,323← PreviousNext →
Comparable venues
Other A*/A conferences filed under the same field of research.
- A*AAAINational Conference of the American Association for Artificial Intelligence
- A*ICRAIEEE International Conference on Robotics and Automation
- AInterspeechInterspeech (combined EuroSpeech and ICSLP in 2000)
- AIROSIEEE/RSJ International Conference on Intelligent Robots and Systems
- A*ACLAssociation for Computational Linguistics
- A*IJCAIInternational Joint Conference on Artificial Intelligence
- A*EMNLPEmpirical Methods in Natural Language Processing
- AGECCOGenetic and Evolutionary Computations