Skip to content

Kwangyoun Kim

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

22

Venues

4

Active years

2011–2024

Best venue rank

Multiconference

Where they publish

Papers

22 indexed papers, newest first.

YearVenueTitleAuthors
2024ICASSPGenerative Context-Aware Fine-Tuning of Self-Supervised Speech Models.Suwon Shon, Kwangyoun Kim, Prashant Sridhar, Yi-Te Hsu, Shinji Watanabe, Karen Livescu
2024ICASSPImproving ASR Contextual Biasing with Guided Attention.Jiyang Tang, Kwangyoun Kim, Suwon Shon, Felix Wu, Prashant Sridhar
2024InterspeechConvolution-Augmented Parameter-Efficient Fine-Tuning for Speech Recognition.Kwangyoun Kim, Suwon Shon, Yi-Te Hsu, Prashant Sridhar, Karen Livescu, Shinji Watanabe
2024InterspeechSample-Efficient Diffusion for Text-To-Speech Synthesis.Justin Lovelace, Soham Ray, Kwangyoun Kim, Kilian Q. Weinberger, Felix Wu
2024InterspeechDiscreteSLU: A Large Language Model with Self-Supervised Discrete Speech Units for Spoken Language Understanding.Suwon Shon, Kwangyoun Kim, Yi-Te Hsu, Prashant Sridhar, Shinji Watanabe, Karen Livescu
2023ICASSPStructured Pruning of Self-Supervised Pre-Trained Models for Speech Recognition and Understanding.Yifan Peng, Kwangyoun Kim, Felix Wu, Prashant Sridhar, Shinji Watanabe
2023ICASSPContext-Aware Fine-Tuning of Self-Supervised Speech Models.Suwon Shon, Felix Wu, Kwangyoun Kim, Prashant Sridhar, Karen Livescu, Shinji Watanabe
2023ICASSPWav2Seq: Pre-Training Speech-to-Text Encoder-Decoder Models Using Pseudo Languages.Felix Wu, Kwangyoun Kim, Shinji Watanabe, Kyu Jeong Han, Ryan McDonald, Kilian Q. Weinberger, Yoav Artzi
2023InterspeechA Comparative Study on E-Branchformer vs Conformer in Speech Recognition, Translation, and Understanding Tasks.Yifan Peng, Kwangyoun Kim, Felix Wu, Brian Yan, Siddhant Arora, William Chen, Jiyang Tang, Suwon Shon, Prashant Sridhar, Shinji Watanabe
2022ICASSPSRU++: Pioneering Fast Recurrence with Attention for Speech Recognition.Jing Pan, Tao Lei, Kwangyoun Kim, Kyu Jeong Han, Shinji Watanabe
2022ICASSPPerformance-Efficiency Trade-Offs in Unsupervised Pre-Training for Speech Recognition.Felix Wu, Kwangyoun Kim, Jing Pan, Kyu Jeong Han, Kilian Q. Weinberger, Yoav Artzi
2021ICASSPNeural Utterance Confidence Measure for RNN-Transducers and Two Pass Models.Ashutosh Gupta, Ankur Kumar, Dhananjaya Gowda, Kwangyoun Kim, Sachin Singh, Shatrughan Singh, Chanwoo Kim
2021InterspeechMulti-Mode Transformer Transducer with Stochastic Future Context.Kwangyoun Kim, Felix Wu, Prashant Sridhar, Kyu Jeong Han, Shinji Watanabe
2020ICASSPSmall Energy Masking for Improved Neural Network Training for End-To-End Speech Recognition.Chanwoo Kim, Kwangyoun Kim, Sathish Reddy Indurthi
2020InterspeechStreaming On-Device End-to-End ASR System for Privacy-Sensitive Voice-Typing.Abhinav Garg, Gowtham P. Vadisetti, Dhananjaya Gowda, Sichen Jin, Aditya Jayasimha, Youngho Han, Jiyeon Kim, Junmo Park, Kwangyoun Kim, Sooyeon Kim, Young-Yoon Lee, Kyungbo Min, Chanwoo Kim
2020InterspeechUtterance Invariant Training for Hybrid Two-Pass End-to-End Speech Recognition.Dhananjaya Gowda, Ankur Kumar, Kwangyoun Kim, Hejung Yang, Abhinav Garg, Sachin Singh, Jiyeon Kim, Mehul Kumar, Sichen Jin, Shatrughan Singh, Chanwoo Kim
2019ASRUImproved Multi-Stage Training of Online Attention-Based Encoder-Decoder Models.Abhinav Garg, Dhananjaya Gowda, Ankur Kumar, Kwangyoun Kim, Mehul Kumar, Chanwoo Kim
2019ASRUAttention Based On-Device Streaming Speech Recognition with Large Speech Corpus.Kwangyoun Kim, Seokyeong Jung, Jungin Lee, Myoungji Han, Chanwoo Kim, Kyungmin Lee, Dhananjaya Gowda, Junmo Park, Sungsoo Kim, Sichen Jin, Young-Yoon Lee, Jinsu Yeo, Daehyun Kim
2019ASRUPower-Law Nonlinearity with Maximally Uniform Distribution Criterion for Improved Neural Network Training in Automatic Speech Recognition.Chanwoo Kim, Mehul Kumar, Kwangyoun Kim, Dhananjaya Gowda
2019ASRUEnd-to-End Training of a Large Vocabulary End-to-End Speech Recognition System.Chanwoo Kim, Minkyoo Shin, Shatrughan Singh, Larry Heck, Dhananjaya Gowda, Sungsoo Kim, Kwangyoun Kim, Mehul Kumar, Jiyeon Kim, Kyungmin Lee, Changwoo Han, Abhinav Garg, Eunhyang Kim
2019InterspeechMulti-Task Multi-Resolution Char-to-BPE Cross-Attention Decoder for End-to-End Speech Recognition.Dhananjaya Gowda, Abhinav Garg, Kwangyoun Kim, Mehul Kumar, Chanwoo Kim
2011AVSSHierarchical approach for abnormal acoustic event classification in an elevator.Kwangyoun Kim, Hanseok Ko