| 2025 | AAAI | Procedure Knowledge Decoupled Distillation Strategy for Procedure Planning in Instructional Videos. | Xiaotian Pan, Zhaobo Qi, Xin Sun, Yuanrong Xu, Weigang Zhang |
| 2025 | CVPR | Video Language Model Pretraining with Spatio-temporal Masking. | Yue Wu, Zhaobo Qi, Junshu Sun, Yaowei Wang, Qingming Huang, Shuhui Wang |
| 2025 | ICLR | Enhancing Pre-trained Representation Classifiability can Boost its Interpretability. | Shufan Shen, Zhaobo Qi, Junshu Sun, Qingming Huang, Qi Tian, Shuhui Wang |
| 2025 | ICLR | Learning Fine-Grained Representations through Textual Token Disentanglement in Composed Video Retrieval. | Yue Wu, Zhaobo Qi, Yiling Wu, Junshu Sun, Yaowei Wang, Shuhui Wang |
| 2025 | ICLR | Masked Temporal Interpolation Diffusion for Procedure Planning in Instructional Videos. | Yufan Zhou, Zhaobo Qi, Lingshuai Lin, Junqi Jing, Tingting Chai, Beichen Zhang, Shuhui Wang, Weigang Zhang |
| 2024 | AAAI | Bias-Conflict Sample Synthesis and Adversarial Removal Debias Strategy for Temporal Sentence Grounding in Video. | Zhaobo Qi, Yibo Yuan, Xiaowen Ruan, Shuhui Wang, Weigang Zhang, Qingming Huang |