| 2026 | AAAI | TubeRMC: Tube-conditioned Reconstruction with Mutual Constraints for Weakly-supervised Spatio-Temporal Video Grounding. | Jinxuan Li, Yi Zhang, Jian-Fang Hu, Chaolei Tan, Tianming Liang, Beihao Xia |
| 2025 | AAAI | SAUGE: Taming SAM for Uncertainty-Aligned Multi-Granularity Edge Detection. | Xing Liufu, Chaolei Tan, Xiaotong Lin, Yonggang Qi, Jinxuan Li, Jian-Fang Hu |
| 2025 | ICCV | ReferDINO: Referring Video Object Segmentation with Visual Grounding Foundations. | Tianming Liang, Kun-Yu Lin, Chaolei Tan, Jianguo Zhang, Wei-Shi Zheng, Jian-Fang Hu |
| 2025 | ICCV | Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning. | Jun Li, Jinpeng Wang, Chaolei Tan, Niu Lian, Long Chen, Yaowei Wang, Min Zhang, Shu-Tao Xia, Bin Chen |
| 2024 | CVPR | Ranking Distillation for Open-Ended Video Question Answering with Insufficient Labels. | Tianming Liang, Chaolei Tan, Beihao Xia, Wei-Shi Zheng, Jian-Fang Hu |
| 2024 | CVPR | Siamese Learning with Joint Alignment and Regression for Weakly-Supervised Video Paragraph Grounding. | Chaolei Tan, Jianhuang Lai, Wei-Shi Zheng, Jian-Fang Hu |
| 2023 | CVPR | Collaborative Static and Dynamic Vision-Language Streams for Spatio-Temporal Video Grounding. | Zihang Lin, Chaolei Tan, Jian-Fang Hu, Zhi Jin, Tiancai Ye, Wei-Shi Zheng |
| 2023 | CVPR | Hierarchical Semantic Correspondence Networks for Video Paragraph Grounding. | Chaolei Tan, Zihang Lin, Jian-Fang Hu, Wei-Shi Zheng, Jianhuang Lai |