| 2026 | EuroPar | Performance Characterization and Optimization of LLM Inference on Tenstorrent AI Accelerators. | Jangho Lim, Dongin Shin, Uichan Kim, Jinhyeok Choi, Kyung Min Kim, Sangwon Shin, Sangwoo Park, Gunjae Koo, Taeweon Suh |
| 2026 | ICS | Three Birds, One Stone: Fast, Accurate-aware and Cost-Efficient Accelerator for Ternary LLM. | Wonseok Jung, Junseok Kang, Sangwon Shin, Hongjun Um, Jangho Lim, Yongjun Park, Gunjae Koo, Sangwoo Park, Taeweon Suh |
| 2026 | ICS | SumcheckPIM: An Efficient HBM-Based PIM Architecture for Linear Complexity Zero Knowledge Proofs. | Sunchae Kim, Taewoon Kang, Sangwon Shin, Taeweon Suh, Yibin Yang, Gunjae Koo |
| 2025 | DATE | HyMM: A Hybrid Sparse-Dense Matrix Multiplication Accelerator for GCNs. | Hunjong Lee, Jihun Lee, Jaewon Seo, Yunho Oh, Myung Kuk Yoon, Gunjae Koo |
| 2025 | ICCD | FINEA: An Efficient Neural Network Accelerator Exploiting Factorized Input Features. | Yujin Kim, Chanhun Jeong, Yunho Oh, Myung Kuk Yoon, Gunjae Koo |
| 2025 | ICS | SparsePIM: An Efficient HBM-Based PIM Architecture for Sparse Matrix-Vector Multiplications. | Taewoon Kang, Geonwoo Choi, Taeweon Suh, Gunjae Koo |
| 2025 | ISPASS | Hierarchical Traversal Stack Design Using Shared Memory for GPU Ray Tracing. | Eunsoo Jung, Eunbi Jeong, Gunjae Koo, Yunho Oh, Myung Kuk Yoon |
| 2024 | ICPP | VitBit: Enhancing Embedded GPU Performance for AI Workloads through Register Operand Packing. | Jaebeom Jeon, Minseong Gil, Junsu Kim, Jaeyong Park, Gunjae Koo, Myung Kuk Yoon, Yunho Oh |
| 2023 | ICPP | Warped-MC: An Efficient Memory Controller Scheme for Massively Parallel Processors. | Jong-Hyun Jeong, Myung Kuk Yoon, Yunho Oh, Gunjae Koo |
| 2022 | DATE | Stealth ECC: A Data-Width Aware Adaptive ECC Scheme for DRAM Error Resilience. | Young Seo Lee, Gunjae Koo, Young-Ho Gong, Sung Woo Chung |
| 2022 | DATE | CacheRewinder: Revoking Speculative Cache Updates Exploiting Write-Back Buffer. | Jongmin Lee, Jun-Yeon Lee, Taeweon Suh, Gunjae Koo |
| 2019 | ISCA | GraphSSD: graph semantics aware SSD. | Kiran Kumar Matam, Gunjae Koo, Haipeng Zha, Hung-Wei Tseng, Murali Annavaram |
| 2019 | ISCA | Linebacker: preserving victim cache lines in idle register files of GPUs. | Yunho Oh, Gunjae Koo, Murali Annavaram, Won Woo Ro |
| 2017 | ISCA | Access Pattern-Aware Cache Management for Improving Data Utilization in GPU. | Gunjae Koo, Yunho Oh, Won Woo Ro, Murali Annavaram |
| 2017 | MICRO | Summarizer: trading communication with computing near storage. | Gunjae Koo, Kiran Kumar Matam, Te I, H. V. Krishna Giri Narra, Jing Li, Hung-Wei Tseng, Steven Swanson, Murali Annavaram |
| 2016 | HPCA | Warped-preexecution: A GPU pre-execution approach for improving latency hiding. | Keunsoo Kim, Sangpil Lee, Myung Kuk Yoon, Gunjae Koo, Won Woo Ro, Murali Annavaram |
| 2015 | ISCA | Warped-compression: enabling power efficient GPUs through register compression. | Sangpil Lee, Keunsoo Kim, Gunjae Koo, Hyeran Jeon, Won Woo Ro, Murali Annavaram |
| 2006 | ISCAS | A robust PRML read channel with digital timing recovery for multi-format optical disc. | Gunjae Koo, Woochul Jung, Heesub Lee |