| 2026 | LREC | Universal NER v2: Towards a Massively Multilingual Named Entity Recognition Benchmark. | Terra Blevins, Stephen Mayhew, Marek Suppa, Hila Gonen, Shachar Mirkin, Vasile Pais, Kaja Dobrovoljc Zor, Voula Giouli, Jun Kevin, Eugene Jang, Eungseo Kim, Jeongyeon Seo, Xenophon Gialis, Yuval Pinter |
| 2025 | EMNLP | Improbable Bigrams Expose Vulnerabilities of Incomplete Tokens in Byte-Level Tokenizers. | Eugene Jang, Kimin Lee, Jin-Woo Chung, Keuntae Park, Seungwon Shin |
| 2025 | KDD | Covering Cracks in Content Moderation: Delexicalized Distant Supervision for Illicit Drug Jargon Detection. | Minkyoo Song, Eugene Jang, Jaehan Kim, Seungwon Shin |
| 2025 | NDSS | Tweezers: A Framework for Security Event Detection via Event Attribution-centric Tweet Embedding. | Jian Cui, Hanna Kim, Eugene Jang, Dayeon Yim, Kicheol Kim, Yongjae Lee, Jin-Woo Chung, Seungwon Shin, Xiaojing Liao |
| 2024 | NAACL | Ignore Me But Don't Replace Me: Utilizing Non-Linguistic Elements for Pretraining on the Cybersecurity Domain. | Eugene Jang, Jian Cui, Dayeon Yim, Youngjin Jin, Jin-Woo Chung, Seungwon Shin, Yongjae Lee |
| 2024 | NDSS | DRAINCLoG: Detecting Rogue Accounts with Illegally-obtained NFTs using Classifiers Learned on Graphs. | Hanna Kim, Jian Cui, Eugene Jang, Chanhee Lee, Yongjae Lee, Jin-Woo Chung, Seungwon Shin |
| 2023 | ACL | WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models. | Virginia K. Felkner, Ho-Chun Herbert Chang, Eugene Jang, Jonathan May |
| 2023 | ACL | DarkBERT: A Language Model for the Dark Side of the Internet. | Youngjin Jin, Eugene Jang, Jian Cui, Jin-Woo Chung, Yongjae Lee, Seungwon Shin |
| 2022 | NAACL | Shedding New Light on the Language of the Dark Web. | Youngjin Jin, Eugene Jang, Yongjae Lee, Seungwon Shin, Jin-Woo Chung |
| 2021 | NAACL | Generating Negative Samples by Manipulating Golden Responses for Unsupervised Learning of a Response Evaluation Model. | ChaeHun Park, Eugene Jang, Wonsuk Yang, Jong Park |
| 2021 | PACLIC | Optimizing Domain Specificity of Transformer-based Language Models for Extractive Summarization of Financial News Articles in Korean. | Huije Lee, Wonsuk Yang, Chaehun Park, Hoyun Song, Eugene Jang, Jong C. Park |