| 2024 | ACCV | Questioning, Answering, and Captioning for Zero-Shot Detailed Image Caption. | Duc-Tuan Luu, Viet-Tuan Le, Duc Minh Vo |
| 2024 | CVPR | Improving the Robustness of 3D Human Pose Estimation: A Benchmark Dataset and Learning from Noisy Input. | Trung-Hieu Hoang, Mona Zehni, Huy Phan, Duc Minh Vo, Minh N. Do |
| 2024 | CVPR | Evcap: Retrieval-Augmented Image Captioning with External Visual-Name Memory for Open-World Comprehension. | Jiaxuan Li, Duc Minh Vo, Akihiro Sugimoto, Hideki Nakayama |
| 2024 | ECCV | A Compact Dynamic 3D Gaussian Representation for Real-Time Dynamic View Synthesis. | Kai Katsumata, Duc Minh Vo, Hideki Nakayama |
| 2024 | WACV | Soft Curriculum for Learning Conditional GANs with Noisy-Labeled and Uncurated Unlabeled Data. | Kai Katsumata, Duc Minh Vo, Tatsuya Harada, Hideki Nakayama |
| 2024 | WACV | Revisiting Latent Space of GAN Inversion for Robust Real Image Editing. | Kai Katsumata, Duc Minh Vo, Bei Liu, Hideki Nakayama |
| 2024 | WACV | Label Augmentation as Inter-class Data Augmentation for Conditional Image Synthesis with Imbalanced Data. | Kai Katsumata, Duc Minh Vo, Hideki Nakayama |
| 2023 | CVPR | A-CAP: Anticipation Captioning with Commonsense Knowledge. | Duc Minh Vo, Quoc-An Luong, Akihiro Sugimoto, Hideki Nakayama |
| 2023 | ICCV | Partition-and-Debias: Agnostic Biases Mitigation via A Mixture of Biases-Specific Experts. | Jiaxuan Li, Duc Minh Vo, Hideki Nakayama |
| 2023 | WACV | Indirect Adversarial Losses via an Intermediate Distribution for Training GANs. | Rui Yang, Duc Minh Vo, Hideki Nakayama |
| 2022 | CVPR | OSSGAN: Open-Set Semi-Supervised Image Generation. | Kai Katsumata, Duc Minh Vo, Hideki Nakayama |
| 2022 | CVPR | NOC-REK: Novel Object Captioning with Retrieved Vocabulary from External Knowledge. | Duc Minh Vo, Hong Chen, Akihiro Sugimoto, Hideki Nakayama |
| 2022 | EMNLP | StoryER: Automatic Story Evaluation via Ranking, Rating and Reasoning. | Hong Chen, Duc Minh Vo, Hiroya Takamura, Yusuke Miyao, Hideki Nakayama |
| 2022 | WACV | PPCD-GAN: Progressive Pruning and Class-Aware Distillation for Large-Scale Conditional GANs Compression. | Duc Minh Vo, Akihiro Sugimoto, Hideki Nakayama |
| 2021 | MVA | Saliency based Subject Selection for Diverse Image Captioning. | Quoc-An Luong, Duc Minh Vo, Akihiro Sugimoto |
| 2020 | ECCV | Visual-Relation Conscious Image Generation from Structured-Text. | Duc Minh Vo, Akihiro Sugimoto |
| 2020 | ICPR | Stylized-Colorization for Line Arts. | Tzu-Ting Fang, Duc Minh Vo, Akihiro Sugimoto, Shang-Hong Lai |
| 2018 | ACCV | Paired-D GAN for Semantic Image Synthesis. | Duc Minh Vo, Akihiro Sugimoto |
| 2018 | WACV | Balancing Content and Style with Two-Stream FCNs for Style Transfer. | Duc Minh Vo, Trung-Nghia Le, Akihiro Sugimoto |
| 2016 | ICPR | Facial expression recognition by re-ranking with global and local generic features. | Duc Minh Vo, Akihiro Sugimoto, Thai Hoang Le |