| 2025 | ICCV | ESSENTIAL: Episodic and Semantic Memory Integration for Video Class-Incremental Learning. | Jongseo Lee, Kyungho Bae, Kyle Min, Gyeong-Moon Park, Jinwoo Choi |
| 2025 | ICCV | Reinforcement Learning Meets Masked Video Modeling : Trajectory-Guided Adaptive Token Selection. | Ayush K. Rai, Kyle Min, Tarun Krishna, Feiyan Hu, Alan F. Smeaton, Noel E. O'Connor |
| 2025 | ICCV | EASG-Bench: Video Q&A Benchmark with Egocentric Action Scene Graphs. | Ivan Rodin, Tz-Ying Wu, Kyle Min, Sharath Nittur Sridhar, Antonino Furnari, Subarna Tripathi, Giovanni Maria Farinella |
| 2025 | ICCV | Long-Form Reasoning for Keystep Recognition Using Graph Neural Networks. | Julia Lee Romero, Kyle Min, Subarna Tripathi, Morteza Karimzadeh |
| 2025 | WACV | Deep Geometric Moments Promote Shape Consistency in Text-to-3D Generation. | Utkarsh Nath, Rajeev Goel, Eun Som Jeon, Changhoon Kim, Kyle Min, Yezhou Yang, Yingzhen Yang, Pavan K. Turaga |
| 2025 | WACV | Ego-VPA: Egocentric Video Understanding with Parameter-Efficient Adaptation. | Tz-Ying Wu, Kyle Min, Subarna Tripathi, Nuno Vasconcelos |
| 2024 | CVPR | WOUAF: Weight Modulation for User Attribution and Fingerprinting in Text-to-Image Diffusion Models. | Changhoon Kim, Kyle Min, Maitreya Patel, Sheng Cheng, Yezhou Yang |
| 2024 | CVPR | Action Scene Graphs for Long-Form Understanding of Egocentric Videos. | Ivan Rodin, Antonino Furnari, Kyle Min, Subarna Tripathi, Giovanni Maria Farinella |
| 2024 | ECCV | R.A.C.E. : Robust Adversarial Concept Erasure for Secure Text-to-Image Diffusion Model. | Changhoon Kim, Kyle Min, Yezhou Yang |
| 2023 | CVPR | SViTT: Temporal Learning of Sparse Video-Text Transformers. | Yi Li, Kyle Min, Subarna Tripathi, Nuno Vasconcelos |
| 2023 | CVPR | Unbiased Scene Graph Generation in Videos. | Sayak Nag, Kyle Min, Subarna Tripathi, Amit K. Roy-Chowdhury |
| 2022 | ECCV | Learning Long-Term Spatial-Temporal Graphs for Active Speaker Detection. | Kyle Min, Sourya Roy, Subarna Tripathi, Tanaya Guha, Somdeb Majumdar |
| 2021 | WACV | Integrating Human Gaze into Attention for Egocentric Activity Recognition. | Kyle Min, Jason J. Corso |
| 2020 | ECCV | Adversarial Background-Aware Loss for Weakly-Supervised Temporal Activity Localization. | Kyle Min, Jason J. Corso |
| 2019 | ICCV | TASED-Net: Temporally-Aggregating Spatial Encoder-Decoder Network for Video Saliency Detection. | Kyle Min, Jason J. Corso |
| 2018 | CVPR | Hierarchical Novelty Detection for Visual Object Recognition. | Kibok Lee, Kimin Lee, Kyle Min, Yuting Zhang, Jinwoo Shin, Honglak Lee |