Kwangyoun Kim
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
22
Venues
4
Active years
2011–2024
Best venue rank
Multiconference
Where they publish
Papers
22 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | ICASSP | Generative Context-Aware Fine-Tuning of Self-Supervised Speech Models. | Suwon Shon, Kwangyoun Kim, Prashant Sridhar, Yi-Te Hsu, Shinji Watanabe, Karen Livescu |
| 2024 | ICASSP | Improving ASR Contextual Biasing with Guided Attention. | Jiyang Tang, Kwangyoun Kim, Suwon Shon, Felix Wu, Prashant Sridhar |
| 2024 | Interspeech | Convolution-Augmented Parameter-Efficient Fine-Tuning for Speech Recognition. | Kwangyoun Kim, Suwon Shon, Yi-Te Hsu, Prashant Sridhar, Karen Livescu, Shinji Watanabe |
| 2024 | Interspeech | Sample-Efficient Diffusion for Text-To-Speech Synthesis. | Justin Lovelace, Soham Ray, Kwangyoun Kim, Kilian Q. Weinberger, Felix Wu |
| 2024 | Interspeech | DiscreteSLU: A Large Language Model with Self-Supervised Discrete Speech Units for Spoken Language Understanding. | Suwon Shon, Kwangyoun Kim, Yi-Te Hsu, Prashant Sridhar, Shinji Watanabe, Karen Livescu |
| 2023 | ICASSP | Structured Pruning of Self-Supervised Pre-Trained Models for Speech Recognition and Understanding. | Yifan Peng, Kwangyoun Kim, Felix Wu, Prashant Sridhar, Shinji Watanabe |
| 2023 | ICASSP | Context-Aware Fine-Tuning of Self-Supervised Speech Models. | Suwon Shon, Felix Wu, Kwangyoun Kim, Prashant Sridhar, Karen Livescu, Shinji Watanabe |
| 2023 | ICASSP | Wav2Seq: Pre-Training Speech-to-Text Encoder-Decoder Models Using Pseudo Languages. | Felix Wu, Kwangyoun Kim, Shinji Watanabe, Kyu Jeong Han, Ryan McDonald, Kilian Q. Weinberger, Yoav Artzi |
| 2023 | Interspeech | A Comparative Study on E-Branchformer vs Conformer in Speech Recognition, Translation, and Understanding Tasks. | Yifan Peng, Kwangyoun Kim, Felix Wu, Brian Yan, Siddhant Arora, William Chen, Jiyang Tang, Suwon Shon, Prashant Sridhar, Shinji Watanabe |
| 2022 | ICASSP | SRU++: Pioneering Fast Recurrence with Attention for Speech Recognition. | Jing Pan, Tao Lei, Kwangyoun Kim, Kyu Jeong Han, Shinji Watanabe |
| 2022 | ICASSP | Performance-Efficiency Trade-Offs in Unsupervised Pre-Training for Speech Recognition. | Felix Wu, Kwangyoun Kim, Jing Pan, Kyu Jeong Han, Kilian Q. Weinberger, Yoav Artzi |
| 2021 | ICASSP | Neural Utterance Confidence Measure for RNN-Transducers and Two Pass Models. | Ashutosh Gupta, Ankur Kumar, Dhananjaya Gowda, Kwangyoun Kim, Sachin Singh, Shatrughan Singh, Chanwoo Kim |
| 2021 | Interspeech | Multi-Mode Transformer Transducer with Stochastic Future Context. | Kwangyoun Kim, Felix Wu, Prashant Sridhar, Kyu Jeong Han, Shinji Watanabe |
| 2020 | ICASSP | Small Energy Masking for Improved Neural Network Training for End-To-End Speech Recognition. | Chanwoo Kim, Kwangyoun Kim, Sathish Reddy Indurthi |
| 2020 | Interspeech | Streaming On-Device End-to-End ASR System for Privacy-Sensitive Voice-Typing. | Abhinav Garg, Gowtham P. Vadisetti, Dhananjaya Gowda, Sichen Jin, Aditya Jayasimha, Youngho Han, Jiyeon Kim, Junmo Park, Kwangyoun Kim, Sooyeon Kim, Young-Yoon Lee, Kyungbo Min, Chanwoo Kim |
| 2020 | Interspeech | Utterance Invariant Training for Hybrid Two-Pass End-to-End Speech Recognition. | Dhananjaya Gowda, Ankur Kumar, Kwangyoun Kim, Hejung Yang, Abhinav Garg, Sachin Singh, Jiyeon Kim, Mehul Kumar, Sichen Jin, Shatrughan Singh, Chanwoo Kim |
| 2019 | ASRU | Improved Multi-Stage Training of Online Attention-Based Encoder-Decoder Models. | Abhinav Garg, Dhananjaya Gowda, Ankur Kumar, Kwangyoun Kim, Mehul Kumar, Chanwoo Kim |
| 2019 | ASRU | Attention Based On-Device Streaming Speech Recognition with Large Speech Corpus. | Kwangyoun Kim, Seokyeong Jung, Jungin Lee, Myoungji Han, Chanwoo Kim, Kyungmin Lee, Dhananjaya Gowda, Junmo Park, Sungsoo Kim, Sichen Jin, Young-Yoon Lee, Jinsu Yeo, Daehyun Kim |
| 2019 | ASRU | Power-Law Nonlinearity with Maximally Uniform Distribution Criterion for Improved Neural Network Training in Automatic Speech Recognition. | Chanwoo Kim, Mehul Kumar, Kwangyoun Kim, Dhananjaya Gowda |
| 2019 | ASRU | End-to-End Training of a Large Vocabulary End-to-End Speech Recognition System. | Chanwoo Kim, Minkyoo Shin, Shatrughan Singh, Larry Heck, Dhananjaya Gowda, Sungsoo Kim, Kwangyoun Kim, Mehul Kumar, Jiyeon Kim, Kyungmin Lee, Changwoo Han, Abhinav Garg, Eunhyang Kim |
| 2019 | Interspeech | Multi-Task Multi-Resolution Char-to-BPE Cross-Attention Decoder for End-to-End Speech Recognition. | Dhananjaya Gowda, Abhinav Garg, Kwangyoun Kim, Mehul Kumar, Chanwoo Kim |
| 2011 | AVSS | Hierarchical approach for abnormal acoustic event classification in an elevator. | Kwangyoun Kim, Hanseok Ko |