Skip to content

IEEE Automatic Speech Recognition and Understanding Workshop

ASRU

C

CORE rank

CORE rank (raw)

C

Fields of research

Artificial Intelligence

Papers indexed

1,323

2007–2025

Papers per year

2007209 peak2025

ASRU papers

1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2025Masked Self-distilled Transducer-based Keyword Spotting with Semi-autoregressive Decoding.Yu Xi, Xiaoyu Gu, Haoyu Li, Jun Song, Bo Zheng, Kai Yu
2025CASPER: A Large Scale Spontaneous Speech Dataset.Cihan Xiao, Ruixing Liang, Xiangyu Zhang, Mehmet Emre Tiryaki, Veronica Bae, Lavanya Shankar, Rong Yang, Ethan Poon, Emmanuel Dupoux, Sanjeev Khudanpur, Leibny Paola Garca-Perera
2025Learning Marmoset Vocal Patterns with a Masked Autoencoder for Robust Call Segmentation, Classification, and Caller Identification.Bin Wu, Shinnosuke Takamichi, Sakriani Sakti, Satoshi Nakamura
2025DyMEvalNet: Dynamic Text-Audio-Personalization Fusion for Multimodal Music Quality Assessment.Xiaoxun Wu, Kailai Shen, Yuheng Huang, Naiyuan Li, Diqun Yan
2025ASR for Affective Speech: Investigating Impact of Emotion and Speech Generative Strategy.Ya-Tse Wu, Chi-Chun Lee
2025Towards Efficient Speech-Text Jointly Decoding within One Speech Language Model.Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Ken'ichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Jinyu Li
2025CLAIRA: Leveraging Large Language Models to Judge Audio Captions.Tsung-Han Wu, Joseph E. Gonzalez, Trevor Darrell, David M. Chan
2025Diversity and complementarity of speech encoders across diverse tasks in a multi-modal large language model.Jeremy H. M. Wong, Muhammad Huzaifah, Hardik B. Sailor, Shuo Sun, Kye Min Tan, Bin Wang, Qiongqiong Wang, Wenyu Zhang, Xunlong Zou, Nancy F. Chen, Ai Ti Aw
2025Speech in-context learning of paralinguistic tasks.Jeremy H. M. Wong, Muhammad Huzaifah, Nancy F. Chen, Ai Ti Aw
2025Obtaining objective labels and analysing annotator subjectivity by using a Rasch model for ordinal speech processing.Jeremy H. M. Wong, Nancy F. Chen
2025Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings.Dyah A. M. G. Wisnu, Ryandhimas E. Zezario, Stefano Rini, Hsin-Min Wang, Yu Tsao
2025Multi-Distillation from Speech and Music Representation Models.Jui-Chiang Wei, Yi-Cheng Lin, Fabian Ritter-Gutierrez, Hung-Yi Lee
2025MNSC: Advancing Singlish Speech Understanding with Carefully Curated Corpora.Bin Wang, Xunlong Zou, Shuo Sun, Wenyu Zhang, Yingxu He, Zhuohan Liu, Chengwei Wei, Nancy F. Chen, AiTi Aw
2025Improving Speech Enhancement with Multi-Metric Supervision from Learned Quality Assessment.Wei Wang, Wangyou Zhang, Chenda Li, Jaitong Shi, Shinji Watanabe, Yanmin Qian
2025SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization.Chien-Chun Wang, En-Lun Yu, Jeih-Weih Hung, Shih-Chieh Huang, Berlin Chen
2025SSVD: Structured SVD for Parameter-Efficient Fine-Tuning and Benchmarking under Domain Shift in ASR.Pu Wang, Shinji Watanabe, Hugo Van hamme
2025Incorporating Contextual Paralinguistic Understanding in Large Speech-Language Models.Qiongqiong Wang, Hardik Bhupendra Sailor, Jeremy H. M. Wong, Tianchi Liu, Shuo Sun, Wenyu Zhang, Muhammad Huzaifah, Nancy F. Chen, Ai Ti Aw
2025Geolocation-Aware Robust Spoken Language Identification.Qingzheng Wang, Hye-Jin Shim, Jiancheng Sun, Shinji Watanabe
2025URGENT-PK: Perceptually-Aligned Ranking Model Designed for Speech Enhancement Competition.Jiahe Wang, Chenda Li, Wei Wang, Wangyou Zhang, Samuele Cornell, Marvin Sach, Robin Scheibler, Kohei Saijo, Yihui Fu, Zhaoheng Ni, Anurag Kumar, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian
2025OOQ: Outlier-Oriented Quantization for Efficient Large Language Models.Haoyu Wang, Bei Liu, Hang Shao, Bo Xiao, Ke Zeng, Guanglu Wan, Yanmin Qian
2025QAMRO: Quality-aware Adaptive Margin Ranking Optimization for Human-aligned Assessment of Audio Generation Systems.Chien-Chun Wang, Kuan-Tang Huang, Cheng-Yeh Yang, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen
2025Towards General Discrete Speech Codec for Complex Acoustic Environments: A Study of Reconstruction and Downstream Task Consistency.Haoran Wang, Guanyu Chen, Bohan Li, Hankun Wang, Yiwei Guo, Zhihan Li, Xie Chen, Kai Yu
2025Recognizing Dementia from Neuropsychological Tests with State Space Models.Liming Wang, Saurabhchand Bhati, Cody Karjadi, Rhoda Au, James R. Glass
2025Can self-supervised speech models predict the perceived acceptability of prosodic variation?Sarenne Wallbridge, Adaeze Adigwe, Peter Bell
2025Joint ASR and Speech Attribute Prediction for Conversational Dysarthric Speech Analysis with Multimodal Language Models.Dominik Wagner, Ilja Baumann, Natalie Engert, Elmar Nth, Korbinian Riedhammer, Tobias Bocklet
2650 of 1,323← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.