| 2023 | EMNLP | K-HATERS: A Hate Speech Detection Corpus in Korean with Target-Specific Ratings. | Chaewon Park, Soohwan Kim, Kyubyong Park, Kunwoo Park |
| 2020 | EMNLP | KorNLI and KorSTS: New Benchmark Datasets for Korean Natural Language Understanding. | Jiyeon Ham, Yo Joong Choe, Kyubyong Park, Ilji Choi, Hyungjoon Soh |
| 2020 | IJCNLP | An Empirical Study of Tokenization Strategies for Various Korean NLP Tasks. | Kyubyong Park, Joohong Lee, Seongbo Jang, Dawoon Jung |
| 2020 | Interspeech | g2pM: A Neural Grapheme-to-Phoneme Conversion Package for Mandarin Chinese Based on a New Open Benchmark Dataset. | Kyubyong Park, Seanie Lee |
| 2020 | LREC | word2word: A Collection of Bilingual Lexicons for 3, 564 Language Pairs. | Yo Joong Choe, Kyubyong Park, Dongwoo Kim |
| 2020 | LREC | Jejueo Datasets for Machine Translation and Speech Synthesis. | Kyubyong Park, Yo Joong Choe, Jiyeon Ham |
| 2019 | Interspeech | CSS10: A Collection of Single Speaker Speech Datasets for 10 Languages. | Kyubyong Park, Thomas Mulc |
| 2018 | ICASSP | Convolutional Sequence to Sequence Model with Non-Sequential Greedy Decoding for Grapheme to Phoneme Conversion. | Moon-Jung Chae, Kyubyong Park, Linhyun Bang, Soobin Suh, Longhyuk Park, Namju Kim, Jonghun Park |
| 2018 | Interspeech | Training Utterance-level Embedding Networks for Speaker Identification and Verification. | Heewoong Park, Sukhyun Cho, Kyubyong Park, Namju Kim, Jonghun Park |