| 2026 | ACL | WoW-Bench: Evaluating Fine-Grained Acoustic Perception in Audio-Language Models via Marine Mammal Vocalizations. | Jaeyeon Kim, Heeseung Yun, Tony Woo, Chao-Han Huck Yang, Gunhee Kim |
| 2025 | ACL | Can LLMs Deceive CLIP? Benchmarking Adversarial Compositionality of Pre-trained Multimodal Representation via Text Updates. | Jaewoo Ahn, Heeseung Yun, Dayoon Ko, Gunhee Kim |
| 2025 | CVPR | ReSpec: Relevance and Specificity Grounded Online Filtering for Learning on Video-Text Data Streams. | Chris Dongjoo Kim, Jihwan Moon, Sangwoo Moon, Heeseung Yun, Sihaeng Lee, Aniruddha Kembhavi, Soonyoung Lee, Gunhee Kim, Sangho Lee, Christopher Clark |
| 2025 | EMNLP | FlashAdventure: A Benchmark for GUI Agents Solving Full Story Arcs in Diverse Adventure Games. | Jaewoo Ahn, Junseo Kim, Heeseung Yun, Jaehyeon Son, Dongmin Park, Jaewoong Cho, Gunhee Kim |
| 2025 | ICLR | ViSAGe: Video-to-Spatial Audio Generation. | Jaeyeon Kim, Heeseung Yun, Gunhee Kim |
| 2024 | ECCV | Spherical World-Locking for Audio-Visual Localization in Egocentric Videos. | Heeseung Yun, Ruohan Gao, Ishwarya Ananthabhotla, Anurag Kumar, Jacob Donley, Chao Li, Gunhee Kim, Vamsi Krishna Ithapu, Calvin Murdock |
| 2023 | CVPR | Fusing Pre-Trained Language Models with Multimodal Prompts through Reinforcement Learning. | Youngjae Yu, Jiwan Chung, Heeseung Yun, Jack Hessel, Jae Sung Park, Ximing Lu, Rowan Zellers, Prithviraj Ammanabrolu, Ronan Le Bras, Gunhee Kim, Yejin Choi |
| 2023 | ICCV | Dense 2D-3D Indoor Prediction with Sound via Aligned Cross-Modal Distillation. | Heeseung Yun, Joonil Na, Gunhee Kim |
| 2022 | ECCV | Panoramic Vision Transformer for Saliency Detection in 360$^\circ $ Videos. | Heeseung Yun, Sehun Lee, Gunhee Kim |
| 2021 | CVPR | Transitional Adaptation of Pretrained Models for Visual Storytelling. | Youngjae Yu, Jiwan Chung, Heeseung Yun, Jongseok Kim, Gunhee Kim |
| 2021 | ICCV | Pano-AVQA: Grounded Audio-Visual Question Answering on 360° Videos. | Heeseung Yun, Youngjae Yu, Wonsuk Yang, Kangil Lee, Gunhee Kim |
| 2020 | ECCV | Character Grounding and Re-identification in Story of Videos and Text Descriptions. | Youngjae Yu, Jongseok Kim, Heeseung Yun, Jiwan Chung, Gunhee Kim |