| 2026 | AAAI | Rethinking Deep Alignment Through the Lens of Incomplete Safety Learning. | Thong Bach, Dung Nguyen, Thao Minh Le, Truyen Tran |
| 2026 | ACL | Continual Safety Alignment via Gradient-Based Sample Selection. | Thong Bach, Dung Nguyen, Thao Minh Le, Truyen Tran |
| 2025 | AAAI | Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models. | Quang-Hung Le, Long Hoang Dang, Ngan Hoang Le, Truyen Tran, Thao Minh Le |
| 2025 | ECAI | Planner-Refiner: Dynamic Space-Time Refinement for Vision-Language Alignment in Videos. | Tuyen Tran, Thao Minh Le, Quang-Hung Le, Truyen Tran |
| 2024 | BMVC | Unified Compositional Query Machine with Multimodal Consistency for Video-based Human Activity Recognition. | Tuyen Tran, Thao Minh Le, Duy Hung Tran, Truyen Tran |
| 2023 | WACV | Guiding Visual Question Answering with Attention Priors. | Thao Minh Le, Vuong Le, Sunil Gupta, Svetha Venkatesh, Truyen Tran |
| 2022 | ECCV | Video Dialog as Conversation About Objects Living in Space-Time. | Hoang-Anh Pham, Thao Minh Le, Vuong Le, Tu Minh Phuong, Truyen Tran |
| 2021 | IJCAI | Hierarchical Object-oriented Spatio-Temporal Reasoning for Video Question Answering. | Long Hoang Dang, Thao Minh Le, Vuong Le, Truyen Tran |
| 2021 | IJCNN | Object-Centric Representation Learning for Video Question Answering. | Long Hoang Dang, Thao Minh Le, Vuong Le, Truyen Tran |
| 2021 | KDD | From Deep Learning to Deep Reasoning. | Truyen Tran, Vuong Le, Hung Le, Thao Minh Le |
| 2020 | CVPR | Hierarchical Conditional Relation Networks for Video Question Answering. | Thao Minh Le, Vuong Le, Svetha Venkatesh, Truyen Tran |
| 2020 | IJCAI | Dynamic Language Binding in Relational Visual Reasoning. | Thao Minh Le, Vuong Le, Svetha Venkatesh, Truyen Tran |
| 2020 | IJCNN | Neural Reasoning, Fast and Slow, for Video Question Answering. | Thao Minh Le, Vuong Le, Svetha Venkatesh, Truyen Tran |