| 2025 | ICCV | Multi-Granular Spatio-Temporal Token Merging for Training-Free Acceleration of Video LLMs. | Jeongseok Hyun, Sukjun Hwang, Su Ho Han, Taeoh Kim, Inwoong Lee, Dongyoon Wee, Joon-Young Lee, Seon Joo Kim, Minho Shim |
| 2025 | ICCV | Prototypes Are Balanced Units for Efficient and Effective Partially Relevant Video Retrieval. | WonJun Moon, Cheol-Ho Cho, Woojin Jun, Taeoh Kim, Inwoong Lee, Dongyoon Wee, Minho Shim, Jae-Pil Heo |
| 2024 | ECCV | Classification Matters: Improving Video Action Detection with Class-Specific Attention. | Jinsung Lee, Taeoh Kim, Inwoong Lee, Minho Shim, Dongyoon Wee, Minsu Cho, Suha Kwak |
| 2023 | AAAI | Frequency Selective Augmentation for Video Representation Learning. | Jinhyung Kim, Taeoh Kim, Minho Shim, Dongyoon Han, Dongyoon Wee, Junmo Kim |
| 2023 | CVPR | Decomposed Cross-Modal Distillation for RGB-based Temporal Action Detection. | Pilhyeon Lee, Taeoh Kim, Minho Shim, Dongyoon Wee, Hyeran Byun |
| 2023 | ICLR | Exploring Temporally Dynamic Data Augmentation for Video Recognition. | Taeoh Kim, Jinhyung Kim, Minho Shim, Sangdoo Yun, Myunggu Kang, Dongyoon Wee, Sangyoun Lee |
| 2020 | ECCV | READ: Reciprocal Attention Discriminator for Image-to-Video Re-identification. | Minho Shim, Hsuan-I Ho, Jinhyung Kim, Dongyoon Wee |
| 2020 | ICASSP | Learning from Dances: Pose-Invariant Re-Identification for Multi-Person Tracking. | Hsuan-I Ho, Minho Shim, Dongyoon Wee |
| 2018 | ECCV | Teaching Machines to Understand Baseball Games: Large-Scale Baseball Video Database for Multiple Video Understanding Tasks. | Minho Shim, Young Hwi Kim, Kyungmin Kim, Seon Joo Kim |