| 2026 | ACL | Exploring Coding Spot: Understanding Parametric Contributions to LLM Coding Performance. | Dongjun Kim, Minhyuk Kim, Yongchan Chun, Chanjun Park, Heuiseok Lim |
| 2026 | ACL | LangSAE Editing: Improving Multilingual Information Retrieval via Post-hoc Language Identity Removal. | Dongjun Kim, Jeongho Yoon, Chanjun Park, Heuiseok Lim |
| 2025 | ACL | From Ambiguity to Accuracy: The Transformative Effect of Coreference Resolution on Retrieval-Augmented Generation systems. | Youngjoon Jang, Seongtae Hong, Junyoung Son, Sungjin Park, Chanjun Park, Heuiseok Lim |
| 2025 | ACL | Enhancing Automatic Term Extraction with Large Language Models via Syntactic Retrieval. | Yongchan Chun, Minhyuk Kim, Dongjun Kim, Chanjun Park, Heuiseok Lim |
| 2025 | ACL | Rethinking KenLM: Good and Bad Model Ensembles for Efficient Text Quality Filtering in Large Web Corpora. | Yungi Kim, Hyunsoo Ha, Sukyung Lee, Jihoo Kim, Seonghoon Yang, Chanjun Park |
| 2025 | CIKM | AGENTiGraph: A Multi-Agent Knowledge Graph Framework for Interactive, Domain-Specific LLM Chatbots. | Xinjie Zhao, Moritz Blum, Fan Gao, Yingjian Chen, Boming Yang, Luis Marquez-Carpintero, Monica Pina-Navarro, Yanran Fu, So Morikawa, Yusuke Iwasawa, Yutaka Matsuo, Chanjun Park, Irene Li |
| 2025 | CIKM | Untitled record | Fan Gao, Xinjie Zhao, Ding Xia, Zhongyi Zhou, Rui Yang, Jinghui Lu, Hang Jiang, Chanjun Park, Irene Li |
| 2025 | COLING | sDPO: Don't Use Your Data All at Once. | Dahyun Kim, Yungi Kim, Wonho Song, Hyeonwoo Kim, Yunsu Kim, Sanghoon Kim, Chanjun Park |
| 2025 | COLING | Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language Models. | Dahyun Kim, Sukyung Lee, Yungi Kim, Attapol Rutherford, Chanjun Park |
| 2025 | EMNLP | Mixture-of-Clustered-Experts: Advancing Expert Specialization and Generalization in Instruction Tuning. | Sugyeong Eo, Jung Jun Lee, Chanjun Park, Heuiseok Lim |
| 2025 | EMNLP | ZEBRA: Leveraging Model-Behavioral Knowledge for Zero-Annotation Preference Dataset Construction. | Jeesu Jung, Chanjun Park, Sangkeun Jung |
| 2025 | EMNLP | LP Data Pipeline: Lightweight, Purpose-driven Data Pipeline for Large Language Models. | Yungi Kim, Hyunsoo Ha, Seonghoon Yang, Sukyung Lee, Jihoo Kim, Chanjun Park |
| 2025 | EMNLP | Can Code-Switched Texts Activate a Knowledge Switch in LLMs? A Case Study on English-Korean Code-Switching. | Seoyeon Kim, Huiseo Kim, Chanjun Park, Jinyoung Yeo, Dongha Lee |
| 2025 | EMNLP | Benchmark Profiling: Mechanistic Diagnosis of LLM Benchmarks. | Dongjun Kim, Gyuho Shim, Yongchan Chun, Minhyuk Kim, Chanjun Park, Heuiseok Lim |
| 2025 | EMNLP | HAWK: Highlighting Entity-aware Knowledge for Alleviating Information Sparsity in Long Contexts. | Seonmin Koo, Jinsung Kim, Chanjun Park, Heuiseok Lim |
| 2025 | EMNLP | MultiDocFusion : Hierarchical and Multimodal Chunking Pipeline for Enhanced RAG on Long Industrial Documents. | Joongmin Shin, Chanjun Park, Jeongbae Park, Jaehyung Seo, Heuiseok Lim |
| 2025 | NAACL | LCIRC: A Recurrent Compression Approach for Efficient Long-form Context and Query Dependent Modeling in LLMs. | Sumin An, Junyoung Sung, Wonpyo Park, Chanjun Park, Paul Hongsuck Seo |
| 2025 | NAACL | FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models. | Dahyun Jung, Seungyoon Lee, Hyeonseok Moon, Chanjun Park, Heuiseok Lim |
| 2025 | NAACL | CoME: An Unlearning-based Approach to Conflict-free Model Editing. | Dahyun Jung, Jaehyung Seo, Jaewook Lee, Chanjun Park, Heuiseok Lim |
| 2025 | NAACL | Open Ko-LLM Leaderboard2: Bridging Foundational and Practical Evaluation for Korean LLMs. | Hyeonwoo Kim, Dahyun Kim, Jihoo Kim, Sukyung Lee, Yungi Kim, Chanjun Park |
| 2025 | NAACL | Find the Intention of Instruction: Comprehensive Evaluation of Instruction Understanding for Large Language Models. | Hyeonseok Moon, Jaehyung Seo, Seungyoon Lee, Chanjun Park, Heuiseok Lim |
| 2025 | NAACL | Understanding LLM Development Through Longitudinal Study: Insights from the Open Ko-LLM Leaderboard. | Chanjun Park, Hyeonwoo Kim |
| 2025 | NAACL | Dataverse: Open-Source ETL (Extract, Transform, Load) Pipeline for Large Language Models. | Hyunbyung Park, Sukyung Lee, Gyoungjin Gim, Yungi Kim, Dahyun Kim, Chanjun Park |
| 2025 | NAACL | MIRAGE: A Metric-Intensive Benchmark for Retrieval-Augmented Generation Evaluation. | Chanhee Park, Hyeonseok Moon, Chanjun Park, Heuiseok Lim |
| 2025 | NAACL | CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents. | Jeiyoon Park, Chanjun Park, Heuiseok Lim |
| 2024 | ACL | Length-aware Byte Pair Encoding for Mitigating Over-segmentation in Korean Machine Translation. | Jungseob Lee, Hyeonseok Moon, Seungjun Lee, Chanjun Park, Sugyeong Eo, Hyunwoong Ko, Jaehyung Seo, Seungyoon Lee, Heuiseok Lim |
| 2024 | ACL | Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark. | Chanjun Park, Hyeonwoo Kim, Dahyun Kim, Seonghwan Cho, Sanghoon Kim, Sukyung Lee, Yungi Kim, Hwalsuk Lee |
| 2024 | ACL | KoCommonGEN v2: A Benchmark for Navigating Korean Commonsense Reasoning Challenges in Large Language Models. | Jaehyung Seo, Jaewook Lee, Chanjun Park, Seongtae Hong, Seungjun Lee, Heuiseok Lim |
| 2024 | COLING | Detecting Critical Errors Considering Cross-Cultural Factors in English-Korean Translation. | Sugyeong Eo, Jungwoo Lim, Chanjun Park, Dahyun Jung, Seonmin Koo, Hyeonseok Moon, Jaehyung Seo, Heuiseok Lim |
| 2024 | COLING | Leveraging Pre-existing Resources for Data-Efficient Counter-Narrative Generation in Korean. | Seungyoon Lee, Chanjun Park, Dahyun Jung, Hyeonseok Moon, Jaehyung Seo, Sugyeong Eo, Heuiseok Lim |
| 2024 | EACL | Generative Interpretation: Toward Human-Like Evaluation for Educational Question-Answer Pair Generation. | Hyeonseok Moon, Jaewook Lee, Sugyeong Eo, Chanjun Park, Jaehyung Seo, Heuiseok Lim |
| 2024 | EACL | Hyper-BTS Dataset: Scalability and Enhanced Analysis of Back TranScription (BTS) for ASR Post-Processing. | Chanjun Park, Jaehyung Seo, Seolhwa Lee, Junyoung Son, Hyeonseok Moon, Sugyeong Eo, Chanhee Lee, Heuiseok Lim |
| 2024 | EMNLP | SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models. | Hyeonwoo Kim, Gyoungjin Gim, Yungi Kim, Jihoo Kim, Byungju Kim, Wonseok Lee, Chanjun Park |
| 2024 | EMNLP | Evalverse: Unified and Accessible Library for Large Language Model Evaluation. | Jihoo Kim, Wonho Song, Dahyun Kim, Yunsu Kim, Yungi Kim, Chanjun Park |
| 2024 | EMNLP | Where am I? Large Language Models Wandering between Semantics and Structures in Long Contexts. | Seonmin Koo, Jinsung Kim, YoungJoon Jang, Chanjun Park, Heuiseok Lim |
| 2024 | EMNLP | Search if you don't know! Knowledge-Augmented Korean Grammatical Error Correction with Large Language Models. | Seonmin Koo, Jinsung Kim, Chanjun Park, Heuiseok Lim |
| 2024 | EMNLP | Translation of Multifaceted Data without Re-Training of Machine Translation Systems. | Hyeonseok Moon, Seungyoon Lee, Seongtae Hong, Seungjun Lee, Chanjun Park, Heuiseok Lim |
| 2024 | NAACL | Explainable CED: A Dataset for Explainable Critical Error Detection in Machine Translation. | Dahyun Jung, Sugyeong Eo, Chanjun Park, Heuiseok Lim |
| 2024 | NAACL | SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling. | Sanghoon Kim, Dahyun Kim, Chanjun Park, Wonsung Lee, Wonho Song, Yunsu Kim, Hyeonwoo Kim, Yungi Kim, Hyeonju Lee, Jihoo Kim, Changbae Ahn, Seonghoon Yang, Sukyung Lee, Hyunbyung Park, Gyoungjin Gim, Mikyoung Cha, Hwalsuk Lee, Sunghun Kim |
| 2024 | NAACL | Exploring Inherent Biases in LLMs within Korean Social Context: A Comparative Analysis of ChatGPT and GPT-4. | Seungyoon Lee, Dong Kim, Dahyun Jung, Chanjun Park, Heuiseok Lim |
| 2023 | ACL | PEEP-Talk: A Situational Dialogue-based Chatbot for English Education. | Seungjun Lee, Yoonna Jang, Chanjun Park, Jungseob Lee, Jaehyung Seo, Hyeonseok Moon, Sugyeong Eo, Seounghoon Lee, Bernardo Yahya, Heuiseok Lim |
| 2023 | EMNLP | KEBAP: Korean Error Explainable Benchmark Dataset for ASR and Post-processing. | Seonmin Koo, Chanjun Park, Jinsung Kim, Jaehyung Seo, Sugyeong Eo, Hyeonseok Moon, Heuiseok Lim |
| 2023 | EMNLP | CHEF in the Language Kitchen: A Generative Data Augmentation Leveraging Korean Morpheme Ingredients. | Jaehyung Seo, Hyeonseok Moon, Jaewook Lee, Sugyeong Eo, Chanjun Park, Heuiseok Lim |
| 2023 | ICDM | Alternative Speech: Complementary Method to Counter-Narrative for Better Discourse. | Seungyoon Lee, Dahyun Jung, Chanjun Park, Seolhwa Lee, Heuiseok Lim |
| 2023 | IJCNLP | Informative Evidence-guided Prompt-based Fine-tuning for English-Korean Critical Error Detection. | Dahyun Jung, Sugyeong Eo, Chanjun Park, Hyeonseok Moon, Jaehyung Seo, Heuiseok Lim |
| 2022 | COLING | QUAK: A Synthetic Quality Estimation Dataset for Korean-English Neural Machine Translation. | Sugyeong Eo, Chanjun Park, Hyeonseok Moon, Jaehyung Seo, Gyeongmin Kim, Jungseob Lee, Heuiseok Lim |
| 2022 | IJCNLP | PicTalky: Augmentative and Alternative Communication for Language Developmental Disabilities. | Chanjun Park, Yoonna Jang, Seolhwa Lee, Jaehyung Seo, Kisu Yang, Heuiseok Lim |
| 2022 | LREC | Empirical Analysis of Noising Scheme based Synthetic Data Generation for Automatic Post-editing. | Hyeonseok Moon, Chanjun Park, Seolhwa Lee, Jaehyung Seo, Jungseob Lee, Sugyeong Eo, Heuiseok Lim |
| 2022 | LREC | FreeTalky: Don't Be Afraid! Conversations Made Easier by a Humanoid Robot using Persona-based Dialogue. | Chanjun Park, Yoonna Jang, Seolhwa Lee, Sungjin Park, Heuiseok Lim |
| 2022 | LREC | Priming Ancient Korean Neural Machine Translation. | Chanjun Park, Seolhwa Lee, Jaehyung Seo, Hyeonseok Moon, Sugyeong Eo, Heuiseok Lim |
| 2022 | NAACL | A Dog Is Passing Over The Jet? A Text-Generation Dataset for Korean Commonsense Reasoning and Evaluation. | Jaehyung Seo, Seounghoon Lee, Chanjun Park, Yoonna Jang, Hyeonseok Moon, Sugyeong Eo, Seonmin Koo, Heuiseok Lim |
| 2021 | NAACL | Should we find another model?: Improving Neural Machine Translation Performance with ONE-Piece Tokenization Method without Model Modification. | Chanjun Park, Sugyeong Eo, Hyeonseok Moon, Heuiseok Lim |