| 2025 | AAAI | Extract Free Dense Misalignment from CLIP. | JeongYeon Nam, Jinbae Im, Wonjae Kim, Taeho Kil |
| 2025 | ICCV | An Efficient Post-Hoc Framework for Reducing Task Discrepancy of Text Encoders for Composed Image Retrieval. | Jaeseok Byun, Seokhyeon Jeong, Wonjae Kim, Sanghyuk Chun, Taesup Moon |
| 2025 | ICLR | Probabilistic Language-Image Pre-Training. | Sanghyuk Chun, Wonjae Kim, Song Park, Sangdoo Yun |
| 2024 | CVPR | Language-only Efficient Training of Zero-shot Composed Image Retrieval. | Geonmo Gu, Sanghyuk Chun, Wonjae Kim, Yoohoon Kang, Sangdoo Yun |
| 2024 | ECCV | HYPE: Hyperbolic Entailment Filtering for Underspecified Images and Texts. | Wonjae Kim, Sanghyuk Chun, Taekyung Kim, Dongyoon Han, Sangdoo Yun |
| 2024 | ICML | STELLA: Continual Audio-Video Pre-training with SpatioTemporal Localized Alignment. | Jaewoo Lee, Jaehong Yoon, Wonjae Kim, Yunji Kim, Sung Ju Hwang |
| 2023 | ACL | Pivotal Role of Language Modeling in Recommender Systems: Enriching Task-specific and Task-agnostic Representation Learning. | Kyuyong Shin, Hanock Kwak, Wonjae Kim, Jisu Jeong, Seungjae Jung, Kyungmin Kim, Jung-Woo Ha, Sang-Woo Lee |
| 2023 | ICCV | SeiT: Storage-Efficient Vision Training with Tokens Using 1% of Pixel Storage. | Song Park, Sanghyuk Chun, Byeongho Heo, Wonjae Kim, Sangdoo Yun |
| 2023 | ICLR | What Do Self-Supervised Vision Transformers Learn? | Namuk Park, Wonjae Kim, Byeongho Heo, Taekyung Kim, Sangdoo Yun |
| 2022 | BMVC | Correlation between Alignment-Uniformity and Performance of Dense Contrastive Representations. | Jong Hak Moon, Wonjae Kim, Edward Choi |
| 2022 | CHI | Speeding up Inference with User Simulators throughPolicy Modulation. | Hee-Seung Moon, Seungwon Do, Wonjae Kim, Jiwon Seo, Minsuk Chang, Byungjoo Lee |
| 2022 | ECCV | ECCV Caption: Correcting False Negatives by Collecting Machine-and-Human-verified Image-Caption Associations for MS-COCO. | Sanghyuk Chun, Wonjae Kim, Song Park, Minsuk Chang, Seong Joon Oh |
| 2022 | ICLR | ViDT: An Efficient and Effective Fully Transformer-based Object Detector. | Hwanjun Song, Deqing Sun, Sanghyuk Chun, Varun Jampani, Dongyoon Han, Byeongho Heo, Wonjae Kim, Ming-Hsuan Yang |
| 2021 | ICML | ViLT: Vision-and-Language Transformer Without Convolution or Region Supervision. | Wonjae Kim, Bokyung Son, Ildoo Kim |
| 2020 | ECCV | Diversified Mutual Learning for Deep Metric Learning. | Wonpyo Park, Wonjae Kim, Kihyun You, Minsu Cho |
| 2017 | CHI | ChartSense: Interactive Data Extraction from Chart Images. | Daekyoung Jung, Wonjae Kim, Hyunjoo Song, Jeongin Hwang, Bongshin Lee, Bo Hyoung Kim, Jinwook Seo |