Skip to content

IEEE Automatic Speech Recognition and Understanding Workshop

ASRU

C

CORE rank

CORE rank (raw)

C

Fields of research

Artificial Intelligence

Papers indexed

1,323

2007–2025

Papers per year

2007209 peak2025

ASRU papers

1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2023The Second Multi-Channel Multi-Party Meeting Transcription Challenge (M2MeT 2.0): A Benchmark for Speaker-Attributed ASR.Yuhao Liang, Mohan Shi, Fan Yu, Yangze Li, Shiliang Zhang, Zhihao Du, Qian Chen, Lei Xie, Yanmin Qian, Jian Wu, Zhuo Chen, Kong Aik Lee, Zhijie Yan, Hui Bu
2023Unconstrained Dysfluency Modeling for Dysfluent Speech Transcription and Detection.Jiachen Lian, Carly Feng, Naasir Farooqi, Steve Li, Anshul Kashyap, Cheol Jun Cho, Peter Wu, Robbie Netzorg, Tingle Li, Gopala Krishna Anumanchipalli
2023Av-Data2Vec: Self-Supervised Learning of Audio-Visual Speech Representations with Contextualized Target Representations.Jiachen Lian, Alexei Baevski, Wei-Ning Hsu, Michael Auli
2023Acoustic Model Fusion For End-to-End Speech Recognition.Zhihong Lei, Mingbin Xu, Shiyi Han, Leo Liu, Zhen Huang, Tim Ng, Yuanyuan Zhang, Ernest Pusateri, Mirko Hannemann, Yaqiao Deng, Man-Hung Siu
2023Optimizing Two-Pass Cross-Lingual Transfer Learning: Phoneme Recognition And Phoneme To Grapheme Translation.Wonjun Lee, Gary Geunbae Lee, Yunsu Kim
2023Cross-Modal Learning for CTC-Based ASR: Leveraging CTC-Bertscore and Sequence-Level Training.Mun-Hak Lee, Sang-Eon Lee, Ji-Eun Choi, Joon-Hyuk Chang
2023AWMC: Online Test-Time Adaptation Without Mode Collapse for Continual Adaptation.Jae-Hong Lee, Do-Hee Kim, Joon-Hyuk Chang
2023Exploring the Viability of Synthetic Audio Data for Audio-Based Dialogue State Tracking.Jihyun Lee, Yejin Jeon, Wonjun Lee, Yunsu Kim, Gary Geunbae Lee
2023LC4SV: A Denoising Framework Learning to Compensate for Unseen Speaker Verification Models.Chi-Chang Lee, Hong-Wei Chen, Chu-Song Chen, Hsin-Min Wang, Tsung-Te Liu, Yu Tsao
2023Brouhaha: Multi-Task Training for Voice Activity Detection, Speech-to-Noise Ratio, and C50 Room Acoustics Estimation.Marvin Lavechin, Marianne Mtais, Hadrien Titeux, Alodie Boissonnet, Jade Copet, Morgane Rivire, Elika Bergelson, Alejandrina Cristi, Emmanuel Dupoux, Herv Bredin
2023Audio-Visual Neural Syntax Acquisition.Cheng-I Jeff Lai, Freda Shi, Puyuan Peng, Yoon Kim, Kevin Gimpel, Shiyu Chang, Yung-Sung Chuang, Saurabhchand Bhati, David D. Cox, David Harwath, Yang Zhang, Karen Livescu, James R. Glass
2023Towards General-Purpose Text-Instruction-Guided Voice Conversion.Chun-Yi Kuan, Chen-An Li, Tsu-Yuan Hsu, Tse-Yang Lin, Ho-Lam Chung, Kai-Wei Chang, Shuo-Yiin Chang, Hung-Yi Lee
2023Pseudo-Label Based Supervised Contrastive Loss for Robust Speech Representations.Varun Krishna, Sriram Ganapathy
2023Transduce and Speak: Neural Transducer for Text-To-Speech with Semantic Token Prediction.Minchan Kim, Myeonghun Jeong, Byoung Jin Choi, Dongjune Lee, Nam Soo Kim
2023A Token-Wise Beam Search Algorithm for RNN-T.Gil Keren
2023Summarize While Translating: Universal Model With Parallel Decoding for Summarization and Translation.Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Kohei Matsuura, Takanori Ashihara, William Chen, Shinji Watanabe
2023Joint Federated Learning and Personalization for on-Device ASR.Junteng Jia, Ke Li, Mani Malek, Kshitiz Malik, Jay Mahadeokar, Ozlem Kalinli, Frank Seide
2023Locality Enhanced Dynamic Biasing and Sampling Strategies For Contextual ASR.Md Asif Jalal, Pablo Peso Parada, George Pavlidis, Vasileios Moschopoulos, Karthikeyan Saravanan, Chrysovalantis-Giorgos Kontoulis, Jisi Zhang, Anastasios Drosou, Gil Ho Lee, Jungin Lee, Seokyeong Jung
2023Model-Based Fairness Metric for Speaker Verification.Maliha Jahan, Laureano Moro-Velzquez, Thomas Thebaud, Najim Dehak, Jess Villalba
2023Simulation of Teacher-Learner Interaction in English Language Pronunciation Learning.Elaf Islam, Thomas Hain, Protima Nomo Sudro
2023TorchAudio 2.1: Advancing Speech Recognition, Self-Supervised Learning, and Audio Processing Components for Pytorch.Jeff Hwang, Moto Hira, Caroline Chen, Xiaohui Zhang, Zhaoheng Ni, Guangzhi Sun, Pingchuan Ma, Ruizhe Huang, Vineel Pratap, Yuekai Zhang, Anurag Kumar, Chin-Yun Yu, Chuang Zhu, Chunxi Liu, Jacob Kahn, Mirco Ravanelli, Peng Sun, Shinji Watanabe, Yangyang Shi, Yumeng Tao
2023Improving Multilingual and Code-Switching ASR Using Large Language Model Generated Text.Ke Hu, Tara N. Sainath, Bo Li, Yu Zhang, Yong Cheng, Tao Wang, Yujing Zhang, Frederick Liu
2023Spike-Triggered Contextual Biasing for End-to-End Mandarin Speech Recognition.Kaixun Huang, Ao Zhang, Binbin Zhang, Tianyi Xu, Xingchen Song, Lei Xie
2023The Singing Voice Conversion Challenge 2023.Wen-Chin Huang, Lester Phillip Violeta, Songxiang Liu, Jiatong Shi, Tomoki Toda
2023Maximizing Data Efficiency for Cross-Lingual TTS Adaptation by Self-Supervised Representation Mixing and Embedding Initialization.Wei-Ping Huang, Sung-Feng Huang, Hung-Yi Lee
326350 of 1,323← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.