Skip to content

IEEE Automatic Speech Recognition and Understanding Workshop

ASRU

C

CORE rank

CORE rank (raw)

C

Fields of research

Artificial Intelligence

Papers indexed

1,323

2007–2025

Papers per year

2007209 peak2025

ASRU papers

1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025All-in-One ASR: Unifying Encoder-Decoder Models of CTC, Attention, and Transducer in Dual-Mode ASR.Takafumi Moriya, Masato Mimura, Tomohiro Tanaka, Hiroshi Sato, Ryo Masumura, Atsunori Ogawa
2025Evaluating Japanese Dialect Robustness Across Speech and Text-based Large Language Models.Tomoya Mizumoto, Yusuke Fujita, Hao Shi, Lianbo Liu, Atsushi Kojima, Yui Sudo
2025SENSE models: an open source solution for multilingual and multimodal semantic-based tasks.Salima Mdhaffar, Haroun Elleuch, Chaimae Chellaf, Ha Nguyen, Yannick Estve
2025Phoneme Overlapping-Aware Pre-Training with External Text Resources for Multi-Talker ASR.Ryo Masumura, Tomohiro Tanaka, Naoki Makishima, Mana Ihori, Shota Orihashi, Naotaka Kawata, Taiga Yamane, Satoshi Suzuki, Takafumi Moriya
2025ProtoCLAP - Prototypical Contrastive Language-Audio Pretraining.Adria Mallol-Ragolta, Bjrn W. Schuller
2025Evaluating Self-Supervised Speech Models Via Text-Based LLMs.Takashi Maekaku, Keita Goto, Jinchuan Tian, Yusuke Shinohara, Shinji Watanabe
2025Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model.Ziyang Ma, Zhuo Chen, Yuping Wang, Eng Siong Chng, Xie Chen
2025AURA: Agent for Understanding, Reasoning, and Automated Tool Use in Voice-Driven Tasks.Leander Melroy Maben, Gayathri Ganesh Lakshmy, Srijith Radhakrishnan, Siddhant Arora, Shinji Watanabe
2025StellarTTS: Sparse Temporal Embedding for Low-Latency and Robust Speech Synthesis.Kaicheng Luo, Xuefei Gong, Yutao Sun, Jinling He, Yujie Hou, Xiaoyang Xing, Huiyan Li, Bing Han, Yanmin Qian
2025An Effective Strategy for Modeling Score Ordinality and Non-uniform Intervals in Automated Speaking Assessment.Tien-Hong Lo, Szu-Yu Chen, Yao-Ting Sung, Berlin Chen
2025Less is More: Data Curation Matters in Scaling Speech Enhancement.Chenda Li, Wangyou Zhang, Wei Wang, Robin Scheibler, Kohei Saijo, Samuele Cornell, Yihui Fu, Marvin Sach, Zhaoheng Ni, Anurag Kumar, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian
2025Intermediate-Selective Feature Enhancement for Speech Emotion Recognition.Yangbiao Li, Xiaofen Xing, Jialong Mai, Jingyuan Xing, Xiangmin Xu
2025MMW: Side Talk Rejection Multi-Microphone Whisper On Smart Glasses.Yang Liu, Li Wan, Yiteng Huang, Yong Xu, Yangyang Shi, Saurabh Adya, Ming Sun, Florian Metze
2025Pitch-Assistant Harmonic Recovery for Efficient Speech Enhancement.Biao Liu, Zengqiang Shang, Haoyuan Xie, Mou Wang, Xin Liu, Pengyuan Zhang
2025PRIME: Novel Prompting Strategies for Effective Biasing Word Recognition in Contextualized ASR.Yu-Chun Liu, Li-Ting Pai, Yi-Cheng Wang, Bi-Cheng Yan, Hsin-Wei Wang, Chi-Han Lin, Juan-Wei Xu, Berlin Chen
2025EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Spoken Dialogue Systems.Jingwen Liu, Kan Jen Cheng, Jiachen Lian, Akshay Anand, Rishi Jain, Faith Qiao, Robin Netzorg, Huang-Cheng Chou, Tingle Li, Guan-Ting Lin, Gopala Anumanchipalli
2025Emotional Styles Hide in Deep Speaker Embeddings: Disentangle Deep Speaker Embeddings for Speaker Clustering.Chaohao Lin, Xu Zheng, Kaida Wu, Peihao Xiang, Ou Bai
2025Is Smaller Always Faster? Tradeoffs in Compressing Self-Supervised Speech Transformers.Tzu-Quan Lin, Tsung-Huan Yang, Chun-Yao Chang, Kuang-Ming Chen, Tzu-hsun Feng, Hung-Yi Lee, Hao Tang
2025Full-Duplex-Bench: A Benchmark to Evaluate Full-Duplex Spoken Dialogue Models on Turn-taking Capabilities.Guan-Ting Lin, Jiachen Lian, Tingle Li, Qirui Wang, Gopala Anumanchipalli, Alexander H. Liu, Hung-Yi Lee
2025AsyncVoice Agent: Real-Time Explanation for LLM Planning and Reasoning.Yueqian Lin, Zhengmian Hu, Jayakumar Subramanian, Qinsi Wang, Nikos Vlassis, Hai Li, Yiran Chen
2025Customizing Speech Recognition Model with Large Language Model Feedback.Shaoshi Ling, Guoli Ye
2025Iterative Feedback in the Online Active Learning Paradigm.Mark Lindsey, Francis Kubala, Richard M. Stern
2025Towards Generalized Source Tracing for Codec-Based Deepfake Speech.I-Ming Lin, Xuanjun Chen, Lin Zhang, Haibin Wu, Hung-yi Lee, Jyh-Shing Roger Jang
2025EMO-Debias: Benchmarking Gender Debiasing Techniques in Multi-Label Speech Emotion Recognition.Yi-Cheng Lin, Huang-Cheng Chou, Yu-Hsuan Li Liang, Hung-Yi Lee
2025MMMOS: Multi-domain Multi-axis Audio Quality Assessment.Yi-Cheng Lin, Jia-Hung Chen, Hung-Yi Lee
101125 of 1,323← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.