IEEE Automatic Speech Recognition and Understanding Workshop
ASRU
C
CORE rank
CORE rank (raw)
C
Fields of research
Artificial Intelligence
Papers indexed
1,323
2007–2025
Papers per year
2007209 peak2025
Most published authors
ASRU papers
1,323 records sourced from DBLP. Search titles, filter by year, sort by recency.
| Year | Title | Authors |
|---|---|---|
| 2023 | The Second Multi-Channel Multi-Party Meeting Transcription Challenge (M2MeT 2.0): A Benchmark for Speaker-Attributed ASR. | Yuhao Liang, Mohan Shi, Fan Yu, Yangze Li, Shiliang Zhang, Zhihao Du, Qian Chen, Lei Xie, Yanmin Qian, Jian Wu, Zhuo Chen, Kong Aik Lee, Zhijie Yan, Hui Bu |
| 2023 | Unconstrained Dysfluency Modeling for Dysfluent Speech Transcription and Detection. | Jiachen Lian, Carly Feng, Naasir Farooqi, Steve Li, Anshul Kashyap, Cheol Jun Cho, Peter Wu, Robbie Netzorg, Tingle Li, Gopala Krishna Anumanchipalli |
| 2023 | Av-Data2Vec: Self-Supervised Learning of Audio-Visual Speech Representations with Contextualized Target Representations. | Jiachen Lian, Alexei Baevski, Wei-Ning Hsu, Michael Auli |
| 2023 | Acoustic Model Fusion For End-to-End Speech Recognition. | Zhihong Lei, Mingbin Xu, Shiyi Han, Leo Liu, Zhen Huang, Tim Ng, Yuanyuan Zhang, Ernest Pusateri, Mirko Hannemann, Yaqiao Deng, Man-Hung Siu |
| 2023 | Optimizing Two-Pass Cross-Lingual Transfer Learning: Phoneme Recognition And Phoneme To Grapheme Translation. | Wonjun Lee, Gary Geunbae Lee, Yunsu Kim |
| 2023 | Cross-Modal Learning for CTC-Based ASR: Leveraging CTC-Bertscore and Sequence-Level Training. | Mun-Hak Lee, Sang-Eon Lee, Ji-Eun Choi, Joon-Hyuk Chang |
| 2023 | AWMC: Online Test-Time Adaptation Without Mode Collapse for Continual Adaptation. | Jae-Hong Lee, Do-Hee Kim, Joon-Hyuk Chang |
| 2023 | Exploring the Viability of Synthetic Audio Data for Audio-Based Dialogue State Tracking. | Jihyun Lee, Yejin Jeon, Wonjun Lee, Yunsu Kim, Gary Geunbae Lee |
| 2023 | LC4SV: A Denoising Framework Learning to Compensate for Unseen Speaker Verification Models. | Chi-Chang Lee, Hong-Wei Chen, Chu-Song Chen, Hsin-Min Wang, Tsung-Te Liu, Yu Tsao |
| 2023 | Brouhaha: Multi-Task Training for Voice Activity Detection, Speech-to-Noise Ratio, and C50 Room Acoustics Estimation. | Marvin Lavechin, Marianne Mtais, Hadrien Titeux, Alodie Boissonnet, Jade Copet, Morgane Rivire, Elika Bergelson, Alejandrina Cristi, Emmanuel Dupoux, Herv Bredin |
| 2023 | Audio-Visual Neural Syntax Acquisition. | Cheng-I Jeff Lai, Freda Shi, Puyuan Peng, Yoon Kim, Kevin Gimpel, Shiyu Chang, Yung-Sung Chuang, Saurabhchand Bhati, David D. Cox, David Harwath, Yang Zhang, Karen Livescu, James R. Glass |
| 2023 | Towards General-Purpose Text-Instruction-Guided Voice Conversion. | Chun-Yi Kuan, Chen-An Li, Tsu-Yuan Hsu, Tse-Yang Lin, Ho-Lam Chung, Kai-Wei Chang, Shuo-Yiin Chang, Hung-Yi Lee |
| 2023 | Pseudo-Label Based Supervised Contrastive Loss for Robust Speech Representations. | Varun Krishna, Sriram Ganapathy |
| 2023 | Transduce and Speak: Neural Transducer for Text-To-Speech with Semantic Token Prediction. | Minchan Kim, Myeonghun Jeong, Byoung Jin Choi, Dongjune Lee, Nam Soo Kim |
| 2023 | A Token-Wise Beam Search Algorithm for RNN-T. | Gil Keren |
| 2023 | Summarize While Translating: Universal Model With Parallel Decoding for Summarization and Translation. | Takatomo Kano, Atsunori Ogawa, Marc Delcroix, Kohei Matsuura, Takanori Ashihara, William Chen, Shinji Watanabe |
| 2023 | Joint Federated Learning and Personalization for on-Device ASR. | Junteng Jia, Ke Li, Mani Malek, Kshitiz Malik, Jay Mahadeokar, Ozlem Kalinli, Frank Seide |
| 2023 | Locality Enhanced Dynamic Biasing and Sampling Strategies For Contextual ASR. | Md Asif Jalal, Pablo Peso Parada, George Pavlidis, Vasileios Moschopoulos, Karthikeyan Saravanan, Chrysovalantis-Giorgos Kontoulis, Jisi Zhang, Anastasios Drosou, Gil Ho Lee, Jungin Lee, Seokyeong Jung |
| 2023 | Model-Based Fairness Metric for Speaker Verification. | Maliha Jahan, Laureano Moro-Velzquez, Thomas Thebaud, Najim Dehak, Jess Villalba |
| 2023 | Simulation of Teacher-Learner Interaction in English Language Pronunciation Learning. | Elaf Islam, Thomas Hain, Protima Nomo Sudro |
| 2023 | TorchAudio 2.1: Advancing Speech Recognition, Self-Supervised Learning, and Audio Processing Components for Pytorch. | Jeff Hwang, Moto Hira, Caroline Chen, Xiaohui Zhang, Zhaoheng Ni, Guangzhi Sun, Pingchuan Ma, Ruizhe Huang, Vineel Pratap, Yuekai Zhang, Anurag Kumar, Chin-Yun Yu, Chuang Zhu, Chunxi Liu, Jacob Kahn, Mirco Ravanelli, Peng Sun, Shinji Watanabe, Yangyang Shi, Yumeng Tao |
| 2023 | Improving Multilingual and Code-Switching ASR Using Large Language Model Generated Text. | Ke Hu, Tara N. Sainath, Bo Li, Yu Zhang, Yong Cheng, Tao Wang, Yujing Zhang, Frederick Liu |
| 2023 | Spike-Triggered Contextual Biasing for End-to-End Mandarin Speech Recognition. | Kaixun Huang, Ao Zhang, Binbin Zhang, Tianyi Xu, Xingchen Song, Lei Xie |
| 2023 | The Singing Voice Conversion Challenge 2023. | Wen-Chin Huang, Lester Phillip Violeta, Songxiang Liu, Jiatong Shi, Tomoki Toda |
| 2023 | Maximizing Data Efficiency for Cross-Lingual TTS Adaptation by Self-Supervised Representation Mixing and Embedding Initialization. | Wei-Ping Huang, Sung-Feng Huang, Hung-Yi Lee |
326–350 of 1,323← PreviousNext →
Comparable venues
Other A*/A conferences filed under the same field of research.
- A*AAAINational Conference of the American Association for Artificial Intelligence
- A*ICRAIEEE International Conference on Robotics and Automation
- AInterspeechInterspeech (combined EuroSpeech and ICSLP in 2000)
- AIROSIEEE/RSJ International Conference on Intelligent Robots and Systems
- A*ACLAssociation for Computational Linguistics
- A*IJCAIInternational Joint Conference on Artificial Intelligence
- A*EMNLPEmpirical Methods in Natural Language Processing
- AGECCOGenetic and Evolutionary Computations