| 2025 | CVPR | Few-shot Personalized Scanpath Prediction. | Ruoyu Xue, Jingyi Xu, Sounak Mondal, Hieu Le, Gregory J. Zelinsky, Minh Hoai, Dimitris Samaras |
| 2025 | DICTA | Can Current AI Models Count What We Mean, Not What They See? A Benchmark and Systematic Evaluation. | Gia Khanh Nguyen, Yifeng Huang, Minh Hoai |
| 2025 | ICCV | Multi-View Gaze Target Estimation. | Qiaomu Miao, Vivek Raju Golani, Jingyi Xu, Progga Paromita Dutta, Minh Hoai, Dimitris Samaras |
| 2025 | ICCV | Region-Level Data Attribution for Text-To-Image Generative Models. | Trong Bang Nguyen, Phi Le Nguyen, Simon Lucey, Minh Hoai |
| 2025 | ICCV | Low-Rank Prompt Adaptation for Open-Vocabulary Object Detection. | Zekun Zhang, Vu Quang Truong, Minh Hoai |
| 2024 | AAAI | Count What You Want: Exemplar Identification and Few-Shot Counting of Human Actions in the Wild. | Yifeng Huang, Duc Duy Nguyen, Lam Nguyen, Cuong Pham, Minh Hoai |
| 2024 | BMVC | Efficiency-preserving Scene-adaptive Object Detection. | Zekun Zhang, Vu Quang Truong, Minh Hoai |
| 2024 | CVPR | Unifying Top-Down and Bottom-Up Scanpath Prediction Using Transformers. | Zhibo Yang, Sounak Mondal, Seoyoung Ahn, Ruoyu Xue, Gregory J. Zelinsky, Minh Hoai, Dimitris Samaras |
| 2024 | CVPR | Error Detection in Egocentric Procedural Task Videos. | Shih-Po Lee, Zijia Lu, Zekun Zhang, Minh Hoai, Ehsan Elhamifar |
| 2024 | CVPR | HanDiffuser: Text-to-Image Generation with Realistic Hand Appearances. | Supreeth Narasimhaswamy, Uttaran Bhattacharya, Xiang Chen, Ishita Dasgupta, Saayan Mitra, Minh Hoai |
| 2024 | CVPR | HOIST-Former: Hand-Held Objects Identification, Segmentation, and Tracking in the Wild. | Supreeth Narasimhaswamy, Huy Anh Nguyen, Lihan Huang, Minh Hoai |
| 2024 | CVPR | Blur2Blur: Blur Conversion for Unsupervised Image Deblurring on Unknown Domains. | Bang-Dang Pham, Phong Tran, Anh Tuan Tran, Cuong Pham, Rang Nguyen, Minh Hoai |
| 2024 | ECCV | Diffusion-Refined VQA Annotations for Semi-supervised Gaze Following. | Qiaomu Miao, Alexandros Graikos, Jingwei Zhang, Sounak Mondal, Minh Hoai, Dimitris Samaras |
| 2024 | ECCV | Look Hear: Gaze Prediction for Speech-Directed Human Attention. | Sounak Mondal, Seoyoung Ahn, Zhibo Yang, Niranjan Balasubramanian, Dimitris Samaras, Gregory J. Zelinsky, Minh Hoai |
| 2024 | ETRA | Characterizing Learners' Complex Attentional States During Online Multimedia Learning Using Eye-tracking, Egocentric Camera, Webcam, and Retrospective recalls. | Prasanth Chandran, Yifeng Huang, Jeremy Munsell, Brian Howatt, Brayden Wallace, Lindsey Wilson, Sidney D'Mello, Minh Hoai, N. Sanjay Rebello, Lester C. Loschky |
| 2023 | CVPR | Gazeformer: Scalable, Effective and Fast Prediction of Goal-Directed Human Attention. | Sounak Mondal, Zhibo Yang, Seoyoung Ahn, Dimitris Samaras, Gregory J. Zelinsky, Minh Hoai |
| 2023 | CVPR | HyperCUT: Video Sequence from a Single Blurry Image using Unsupervised Ordering. | Bang-Dang Pham, Phong Tran, Anh Tran, Cuong Pham, Rang Nguyen, Minh Hoai |
| 2023 | CVPR | Object Detection with Self-Supervised Scene Adaptation. | Zekun Zhang, Minh Hoai |
| 2023 | EACL | Text-Derived Knowledge Helps Vision: A Simple Cross-modal Distillation for Video-based Action Anticipation. | Sayontan Ghosh, Tanvi Aggarwal, Minh Hoai, Niranjan Balasubramanian |
| 2023 | ICCV | Interactive Class-Agnostic Object Counting. | Yifeng Huang, Viresh Ranjan, Minh Hoai |
| 2023 | WACV | Patch-level Gaze Distribution Prediction for Gaze Following. | Qiaomu Miao, Minh Hoai, Dimitris Samaras |
| 2022 | ACCV | From Within to Between: Knowledge Distillation for Cross Modality Retrieval. | Vinh Tran, Niranjan Balasubramanian, Minh Hoai |
| 2022 | ACCV | Self-supervised Learning with Multi-view Rendering for 3D Point Cloud Analysis. | Bach Tran, Binh-Son Hua, Anh Tuan Tran, Minh Hoai |
| 2022 | CVPR | Characterizing Target-absent Human Attention. | Yupei Chen, Zhibo Yang, Souradeep Chakraborty, Sounak Mondal, Seoyoung Ahn, Dimitris Samaras, Minh Hoai, Gregory J. Zelinsky |
| 2022 | CVPR | Forward Propagation, Backward Regression, and Pose Association for Hand Tracking in the Wild. | Mingzhen Huang, Supreeth Narasimhaswamy, Saif Vazir, Haibin Ling, Minh Hoai |
| 2022 | CVPR | Whose Hands are These? Hand Detection and Hand-Body Association in the Wild. | Supreeth Narasimhaswamy, Thanh Nguyen, Mingzhen Huang, Minh Hoai |
| 2022 | CVPR | Vicinal Counting Networks. | Viresh Ranjan, Minh Hoai |
| 2022 | ECCV | Few-Shot Object Counting and Detection. | Thanh Nguyen, Chau Pham, Khoi Nguyen, Minh Hoai |
| 2022 | ECCV | Target-Absent Human Attention. | Zhibo Yang, Sounak Mondal, Seoyoung Ahn, Gregory J. Zelinsky, Minh Hoai, Dimitris Samaras |
| 2021 | AAAI | Localization in the Crowd with Topological Constraints. | Shahira Abousamra, Minh Hoai, Dimitris Samaras, Chao Chen |
| 2021 | BMVC | Exemplar-Based Early Event Prediction in Video. | Zekun Zhang, Farrukh M. Koraishy, Minh Hoai |
| 2021 | CVPR | Progressive Semantic Segmentation. | Chuong Huynh, Anh Tuan Tran, Khoa Luu, Minh Hoai |
| 2021 | CVPR | Dictionary-Guided Scene Text Recognition. | Nguyen Nguyen, Thu Nguyen, Vinh Tran, Minh-Triet Tran, Thanh Duc Ngo, Thien Huu Nguyen, Minh Hoai |
| 2021 | CVPR | Lipstick Ain't Enough: Beyond Color Matching for In-the-Wild Makeup Transfer. | Thao Nguyen, Anh Tuan Tran, Minh Hoai |
| 2021 | CVPR | Learning To Count Everything. | Viresh Ranjan, Udbhav Sharma, Thu Nguyen, Minh Hoai |
| 2021 | CVPR | Explore Image Deblurring via Encoded Blur Kernel Space. | Phong Tran, Anh Tuan Tran, Quynh Phung, Minh Hoai |
| 2021 | ICCV | Toward Realistic Single-View 3D Object Reconstruction with Unsupervised Learning from Multiple Images. | Long-Nhat Ho, Anh Tuan Tran, Quynh Phung, Minh Hoai |
| 2021 | ICIP | Knowledge Distillation for Human Action Anticipation. | Vinh Tran, Yang Wang, Zekun Zhang, Minh Hoai |
| 2021 | ICIP | Progressive Knowledge Distillation For Early Action Recognition. | Vinh Tran, Niranjan Balasubramanian, Minh Hoai |
| 2021 | WACV | Adaptive Streaming of 360-Degree Videos with Reinforcement Learning. | Sohee Kim Park, Minh Hoai, Arani Bhattacharya, Samir R. Das |
| 2021 | WACV | Supervoxel Attention Graphs for Long-Range Video Modeling. | Yang Wang, Gedas Bertasius, Tae-Hyun Oh, Abhinav Gupta, Minh Hoai, Lorenzo Torresani |
| 2020 | ACCV | Uncertainty Estimation and Sample Selection for Crowd Counting. | Viresh Ranjan, Boyu Wang, Mubarak Shah, Minh Hoai |
| 2020 | CVPR | Active Vision for Early Recognition of Human Actions. | Boyu Wang, Lihan Huang, Minh Hoai |
| 2020 | CVPR | Learning Visual Emotion Representations From Web Data. | Zijun Wei, Jianming Zhang, Zhe Lin, Joon-Young Lee, Niranjan Balasubramanian, Minh Hoai, Dimitris Samaras |
| 2020 | CVPR | Predicting Goal-Directed Human Attention Using Inverse Reinforcement Learning. | Zhibo Yang, Lihan Huang, Yupei Chen, Zijun Wei, Seoyoung Ahn, Gregory J. Zelinsky, Dimitris Samaras, Minh Hoai |
| 2020 | EMNLP | Structural and Functional Decomposition for Personality Image Captioning in a Communication Game. | Minh Thu Nguyen, Duy Phung, Minh Hoai, Thien Huu Nguyen |
| 2019 | BMVC | WorkingHands: A Hand-Tool Assembly Dataset for Image Segmentation and Activity Mining. | Roy Shilkrot, Supreeth Narasimhaswamy, Saif Vazir, Minh Hoai |
| 2019 | CVPR | GIF2Video: Color Dequantization and Temporal Interpolation of GIF Images. | Yang Wang, Haibin Huang, Chuan Wang, Tong He, Jue Wang, Minh Hoai |
| 2019 | CVPR | Benchmarking Gaze Prediction for Categorical Visual Search. | Gregory J. Zelinsky, Zhibo Yang, Lihan Huang, Yupei Chen, Seoyoung Ahn, Zijun Wei, Hossein Adeli, Dimitris Samaras, Minh Hoai |
| 2018 | CVPR | Pulling Actions out of Context: Explicit Separation for Effective Combination. | Yang Wang, Minh Hoai |
| 2018 | CVPR | Good View Hunting: Learning Photo Composition From Dense View Pairs. | Zijun Wei, Jianming Zhang, Xiaohui Shen, Zhe Lin, Radomr Mech, Minh Hoai, Dimitris Samaras |
| 2018 | ECCV | A+D Net: Training a Shadow Detector with Adversarial Shadow Attenuation. | Hieu Le, Tomas F. Yago Vicente, Vu Nguyen, Minh Hoai, Dimitris Samaras |
| 2018 | ECCV | Iterative Crowd Counting. | Viresh Ranjan, Hieu Le, Minh Hoai |
| 2017 | BMVC | Large-scale Continual Road Inspection: Visual Infrastructure Assessment in the Wild. | Ke Ma, Minh Hoai, Dimitris Samaras |
| 2017 | ICCV | Shadow Detection with Conditional Generative Adversarial Networks. | Vu Nguyen, Tomas F. Yago Vicente, Maozheng Zhao, Minh Hoai, Dimitris Samaras |
| 2017 | WACV | X-Ray Scattering Image Classification Using Deep Learning. | Boyu Wang, Kevin G. Yager, Dantong Yu, Minh Hoai |
| 2016 | CVPR | Noisy Label Recovery for Shadow Detection in Unfamiliar Domains. | Tomas F. Yago Vicente, Minh Hoai, Dimitris Samaras |
| 2016 | CVPR | Improving Human Action Recognition by Non-action Classification. | Yang Wang, Minh Hoai |
| 2016 | CVPR | Region Ranking SVM for Image Classification. | Zijun Wei, Minh Hoai |
| 2016 | ECCV | Large-Scale Training of Shadow Detectors with Noisily-Annotated Shadow Examples. | Toms F. Yago Vicente, Le Hou, Chen-Ping Yu, Minh Hoai, Dimitris Samaras |
| 2015 | CVPR | Recognizing cultural events in images: A study of image categorization models. | Heeyoung Kwon, Kiwon Yun, Minh Hoai, Dimitris Samaras |
| 2015 | ICCV | Leave-One-Out Kernel Optimization for Shadow Detection. | Tomas F. Yago Vicente, Minh Hoai, Dimitris Samaras |
| 2014 | ACCV | Thread-Safe: Towards Recognizing Human Actions Across Shot Boundaries. | Minh Hoai, Andrew Zisserman |
| 2014 | ACCV | Improving Human Action Recognition Using Score Distribution and Ranking. | Minh Hoai, Andrew Zisserman |
| 2014 | BMVC | Regularized Max Pooling for Image Categorization. | Minh Hoai |
| 2014 | BMVC | Action Recognition From Weak Alignment of Body Parts. | Minh Hoai, Lubor Ladicky, Andrew Zisserman |
| 2014 | CVPR | Talking Heads: Detecting Humans and Recognizing Their Interactions. | Minh Hoai, Andrew Zisserman |
| 2013 | CVPR | Discriminative Sub-categorization. | Minh Hoai, Andrew Zisserman |