| 2024 | ACL | Speech vs. Transcript: Does It Matter for Human Annotators in Speech Summarization? | Roshan Sharma, Suwon Shon, Mark Lindsey, Hira Dhamyal, Bhiksha Raj |
| 2024 | ACL | On the Evaluation of Speech Foundation Models for Spoken Language Understanding. | Siddhant Arora, Ankita Pasad, Chung-Ming Chien, Jionghao Han, Roshan S. Sharma, Jee-weon Jung, Hira Dhamyal, William Chen, Suwon Shon, Hung-yi Lee, Karen Livescu, Shinji Watanabe |
| 2024 | ICASSP | Generative Context-Aware Fine-Tuning of Self-Supervised Speech Models. | Suwon Shon, Kwangyoun Kim, Prashant Sridhar, Yi-Te Hsu, Shinji Watanabe, Karen Livescu |
| 2024 | ICASSP | Improving ASR Contextual Biasing with Guided Attention. | Jiyang Tang, Kwangyoun Kim, Suwon Shon, Felix Wu, Prashant Sridhar |
| 2024 | Interspeech | Convolution-Augmented Parameter-Efficient Fine-Tuning for Speech Recognition. | Kwangyoun Kim, Suwon Shon, Yi-Te Hsu, Prashant Sridhar, Karen Livescu, Shinji Watanabe |
| 2024 | Interspeech | DiscreteSLU: A Large Language Model with Self-Supervised Discrete Speech Units for Spoken Language Understanding. | Suwon Shon, Kwangyoun Kim, Yi-Te Hsu, Prashant Sridhar, Shinji Watanabe, Karen Livescu |
| 2023 | ACL | SLUE Phase-2: A Benchmark Suite of Diverse Spoken Language Understanding Tasks. | Suwon Shon, Siddhant Arora, Chyi-Jiunn Lin, Ankita Pasad, Felix Wu, Roshan S. Sharma, Wei-Lun Wu, Hung-yi Lee, Karen Livescu, Shinji Watanabe |
| 2023 | ICASSP | Context-Aware Fine-Tuning of Self-Supervised Speech Models. | Suwon Shon, Felix Wu, Kwangyoun Kim, Prashant Sridhar, Karen Livescu, Shinji Watanabe |
| 2023 | Interspeech | A Comparative Study on E-Branchformer vs Conformer in Speech Recognition, Translation, and Understanding Tasks. | Yifan Peng, Kwangyoun Kim, Felix Wu, Brian Yan, Siddhant Arora, William Chen, Jiyang Tang, Suwon Shon, Prashant Sridhar, Shinji Watanabe |
| 2022 | ICASSP | SLUE: New Benchmark Tasks For Spoken Language Understanding Evaluation on Natural Speech. | Suwon Shon, Ankita Pasad, Felix Wu, Pablo Brusco, Yoav Artzi, Karen Livescu, Kyu Jeong Han |
| 2022 | NAACL | On the Use of External Data for Spoken Named Entity Recognition. | Ankita Pasad, Felix Wu, Suwon Shon, Karen Livescu, Kyu Jeong Han |
| 2021 | Interspeech | Leveraging Pre-Trained Language Model for Speech Sentiment Analysis. | Suwon Shon, Pablo Brusco, Jing Pan, Kyu Jeong Han, Shinji Watanabe |
| 2020 | ICASSP | ADI17: A Fine-Grained Arabic Dialect Identification Dataset. | Suwon Shon, Ahmed Ali, Younes Samih, Hamdy Mubarak, James R. Glass |
| 2020 | Interspeech | What Does an End-to-End Dialect Identification Model Learn About Non-Dialectal Information? | Shammur A. Chowdhury, Ahmed Ali, Suwon Shon, James R. Glass |
| 2020 | Interspeech | Multimodal Association for Speaker Verification. | Suwon Shon, James R. Glass |
| 2019 | ASRU | The MGB-5 Challenge: Recognition and Dialect Identification of Dialectal Arabic Speech. | Ahmed Ali, Suwon Shon, Younes Samih, Hamdy Mubarak, Ahmed Abdelali, James R. Glass, Steve Renals, Khalid Choukri |
| 2019 | ICASSP | Domain Mismatch Robust Acoustic Scene Classification Using Channel Information Conversion. | Seongkyu Mun, Suwon Shon |
| 2019 | ICASSP | Domain Attentive Fusion for End-to-end Dialect Identification with Unknown Target Domain. | Suwon Shon, Ahmed Ali, James R. Glass |
| 2019 | ICASSP | Noise-tolerant Audio-visual Online Person Verification Using an Attention-based Neural Network Fusion. | Suwon Shon, Tae-Hyun Oh, James R. Glass |
| 2019 | Interspeech | MCE 2018: The 1st Multi-Target Speaker Detection and Identification Challenge Evaluation. | Suwon Shon, Najim Dehak, Douglas A. Reynolds, James R. Glass |
| 2019 | Interspeech | Large-Scale Speaker Retrieval on Random Speaker Variability Subspace. | Suwon Shon, Younggun Lee, Taesu Kim |
| 2019 | Interspeech | VoiceID Loss: Speech Enhancement for Speaker Verification. | Suwon Shon, Hao Tang, James R. Glass |
| 2019 | Interspeech | State-of-the-Art Speaker Recognition for Telephone and Video Speech: The JHU-MIT Submission for NIST SRE18. | Jess Villalba, Nanxin Chen, David Snyder, Daniel Garcia-Romero, Alan McCree, Gregory Sell, Jonas Borgstrom, Fred Richardson, Suwon Shon, Franois Grondin, Rda Dehak, Leibny Paola Garca-Perera, Daniel Povey, Pedro A. Torres-Carrasquillo, Sanjeev Khudanpur, Najim Dehak |
| 2018 | ICASSP | Exploiting Convolutional Neural Networks for Phonotactic Based Dialect Identification. | Maryam Najafian, Sameer Khurana, Suwon Shon, Ahmed Ali, James R. Glass |
| 2017 | ASRU | MIT-QCRI Arabic dialect identification system for the 2017 multi-genre broadcast challenge. | Suwon Shon, Ahmed Ali, James R. Glass |
| 2017 | ICASSP | Deep Neural Network based learning and transferring mid-level audio features for acoustic scene classification. | Seongkyu Mun, Suwon Shon, Wooil Kim, David K. Han, Hanseok Ko |
| 2017 | Interspeech | Recursive Whitening Transformation for Speaker Recognition on Language Mismatched Condition. | Suwon Shon, Seongkyu Mun, Hanseok Ko |
| 2017 | Interspeech | Autoencoder Based Domain Adaptation for Speaker Recognition Under Insufficient Channel Information. | Suwon Shon, Seongkyu Mun, Wooil Kim, Hanseok Ko |
| 2016 | Interspeech | Deep Neural Network Bottleneck Features for Acoustic Event Recognition. | Seongkyu Mun, Suwon Shon, Wooil Kim, Hanseok Ko |
| 2015 | AVSS | Maximum likelihood Linear Dimension Reduction of heteroscedastic feature for robust Speaker Recognition. | Suwon Shon, Seongkyu Mun, David K. Han, Hanseok Ko |
| 2014 | AVSS | Generalized cross-correlation based noise robust abnormal acoustic event localization utilizing non-negative matrix factorization. | Sungkyu Moon, Suwon Shon, Wooil Kim, David K. Han |
| 2013 | AVSS | Abnormal acoustic event localization based on selective frequency bin in high noise environment for audio surveillance. | Suwon Shon, David K. Han, Hanseok Ko |