IEEE Automatic Speech Recognition and Understanding Workshop
ASRU
C
CORE rank
CORE rank (raw)
C
Fields of research
Artificial Intelligence
Papers indexed
1,323
2007–2025
Papers per year
2007209 peak2025
Most published authors
ASRU papers
1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.
| Year | Title | Authors |
|---|---|---|
| 2025 | All-in-One ASR: Unifying Encoder-Decoder Models of CTC, Attention, and Transducer in Dual-Mode ASR. | Takafumi Moriya, Masato Mimura, Tomohiro Tanaka, Hiroshi Sato, Ryo Masumura, Atsunori Ogawa |
| 2025 | Evaluating Japanese Dialect Robustness Across Speech and Text-based Large Language Models. | Tomoya Mizumoto, Yusuke Fujita, Hao Shi, Lianbo Liu, Atsushi Kojima, Yui Sudo |
| 2025 | SENSE models: an open source solution for multilingual and multimodal semantic-based tasks. | Salima Mdhaffar, Haroun Elleuch, Chaimae Chellaf, Ha Nguyen, Yannick Estve |
| 2025 | Phoneme Overlapping-Aware Pre-Training with External Text Resources for Multi-Talker ASR. | Ryo Masumura, Tomohiro Tanaka, Naoki Makishima, Mana Ihori, Shota Orihashi, Naotaka Kawata, Taiga Yamane, Satoshi Suzuki, Takafumi Moriya |
| 2025 | ProtoCLAP - Prototypical Contrastive Language-Audio Pretraining. | Adria Mallol-Ragolta, Bjrn W. Schuller |
| 2025 | Evaluating Self-Supervised Speech Models Via Text-Based LLMs. | Takashi Maekaku, Keita Goto, Jinchuan Tian, Yusuke Shinohara, Shinji Watanabe |
| 2025 | Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model. | Ziyang Ma, Zhuo Chen, Yuping Wang, Eng Siong Chng, Xie Chen |
| 2025 | AURA: Agent for Understanding, Reasoning, and Automated Tool Use in Voice-Driven Tasks. | Leander Melroy Maben, Gayathri Ganesh Lakshmy, Srijith Radhakrishnan, Siddhant Arora, Shinji Watanabe |
| 2025 | StellarTTS: Sparse Temporal Embedding for Low-Latency and Robust Speech Synthesis. | Kaicheng Luo, Xuefei Gong, Yutao Sun, Jinling He, Yujie Hou, Xiaoyang Xing, Huiyan Li, Bing Han, Yanmin Qian |
| 2025 | An Effective Strategy for Modeling Score Ordinality and Non-uniform Intervals in Automated Speaking Assessment. | Tien-Hong Lo, Szu-Yu Chen, Yao-Ting Sung, Berlin Chen |
| 2025 | Less is More: Data Curation Matters in Scaling Speech Enhancement. | Chenda Li, Wangyou Zhang, Wei Wang, Robin Scheibler, Kohei Saijo, Samuele Cornell, Yihui Fu, Marvin Sach, Zhaoheng Ni, Anurag Kumar, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian |
| 2025 | Intermediate-Selective Feature Enhancement for Speech Emotion Recognition. | Yangbiao Li, Xiaofen Xing, Jialong Mai, Jingyuan Xing, Xiangmin Xu |
| 2025 | MMW: Side Talk Rejection Multi-Microphone Whisper On Smart Glasses. | Yang Liu, Li Wan, Yiteng Huang, Yong Xu, Yangyang Shi, Saurabh Adya, Ming Sun, Florian Metze |
| 2025 | Pitch-Assistant Harmonic Recovery for Efficient Speech Enhancement. | Biao Liu, Zengqiang Shang, Haoyuan Xie, Mou Wang, Xin Liu, Pengyuan Zhang |
| 2025 | PRIME: Novel Prompting Strategies for Effective Biasing Word Recognition in Contextualized ASR. | Yu-Chun Liu, Li-Ting Pai, Yi-Cheng Wang, Bi-Cheng Yan, Hsin-Wei Wang, Chi-Han Lin, Juan-Wei Xu, Berlin Chen |
| 2025 | EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Spoken Dialogue Systems. | Jingwen Liu, Kan Jen Cheng, Jiachen Lian, Akshay Anand, Rishi Jain, Faith Qiao, Robin Netzorg, Huang-Cheng Chou, Tingle Li, Guan-Ting Lin, Gopala Anumanchipalli |
| 2025 | Emotional Styles Hide in Deep Speaker Embeddings: Disentangle Deep Speaker Embeddings for Speaker Clustering. | Chaohao Lin, Xu Zheng, Kaida Wu, Peihao Xiang, Ou Bai |
| 2025 | Is Smaller Always Faster? Tradeoffs in Compressing Self-Supervised Speech Transformers. | Tzu-Quan Lin, Tsung-Huan Yang, Chun-Yao Chang, Kuang-Ming Chen, Tzu-hsun Feng, Hung-Yi Lee, Hao Tang |
| 2025 | Full-Duplex-Bench: A Benchmark to Evaluate Full-Duplex Spoken Dialogue Models on Turn-taking Capabilities. | Guan-Ting Lin, Jiachen Lian, Tingle Li, Qirui Wang, Gopala Anumanchipalli, Alexander H. Liu, Hung-Yi Lee |
| 2025 | AsyncVoice Agent: Real-Time Explanation for LLM Planning and Reasoning. | Yueqian Lin, Zhengmian Hu, Jayakumar Subramanian, Qinsi Wang, Nikos Vlassis, Hai Li, Yiran Chen |
| 2025 | Customizing Speech Recognition Model with Large Language Model Feedback. | Shaoshi Ling, Guoli Ye |
| 2025 | Iterative Feedback in the Online Active Learning Paradigm. | Mark Lindsey, Francis Kubala, Richard M. Stern |
| 2025 | Towards Generalized Source Tracing for Codec-Based Deepfake Speech. | I-Ming Lin, Xuanjun Chen, Lin Zhang, Haibin Wu, Hung-yi Lee, Jyh-Shing Roger Jang |
| 2025 | EMO-Debias: Benchmarking Gender Debiasing Techniques in Multi-Label Speech Emotion Recognition. | Yi-Cheng Lin, Huang-Cheng Chou, Yu-Hsuan Li Liang, Hung-Yi Lee |
| 2025 | MMMOS: Multi-domain Multi-axis Audio Quality Assessment. | Yi-Cheng Lin, Jia-Hung Chen, Hung-Yi Lee |
101–125 of 1,323← PreviousNext →
Comparable venues
Other A*/A conferences filed under the same field of research.
- A*AAAINational Conference of the American Association for Artificial Intelligence
- A*ICRAIEEE International Conference on Robotics and Automation
- AInterspeechInterspeech (combined EuroSpeech and ICSLP in 2000)
- AIROSIEEE/RSJ International Conference on Intelligent Robots and Systems
- A*ACLAssociation for Computational Linguistics
- A*IJCAIInternational Joint Conference on Artificial Intelligence
- A*EMNLPEmpirical Methods in Natural Language Processing
- AGECCOGenetic and Evolutionary Computations