| 2026 | AAAI | TubeRMC: Tube-conditioned Reconstruction with Mutual Constraints for Weakly-supervised Spatio-Temporal Video Grounding. | Jinxuan Li, Yi Zhang, Jian-Fang Hu, Chaolei Tan, Tianming Liang, Beihao Xia |
| 2025 | AAAI | CLIP-RestoreX: Restore Image Structure and Perception in Exposure Correction. | Xiang Huang, Qing Zhang, Jian-Fang Hu, Wei-Shi Zheng |
| 2025 | AAAI | SAUGE: Taming SAM for Uncertainty-Aligned Multi-Granularity Edge Detection. | Xing Liufu, Chaolei Tan, Xiaotong Lin, Yonggang Qi, Jinxuan Li, Jian-Fang Hu |
| 2025 | CVPR | Modeling Multiple Normal Action Representations for Error Detection in Procedural Tasks. | Wei-Jin Huang, Yuan-Ming Li, Zhi-Wei Xia, Yu-Ming Tang, Kun-Yu Lin, Jian-Fang Hu, Wei-Shi Zheng |
| 2025 | CVPR | Panorama Generation From NFoV Image Done Right. | Dian Zheng, Cheng Zhang, Xiao-Ming Wu, Cao Li, Chengfei Lv, Jian-Fang Hu, Wei-Shi Zheng |
| 2025 | ICCV | ViSpeak: Visual Instruction Feedback in Streaming Videos. | Shenghao Fu, Qize Yang, Yuan-Ming Li, Yi-Xing Peng, Kun-Yu Lin, Xihan Wei, Jian-Fang Hu, Xiaohua Xie, Wei-Shi Zheng |
| 2025 | ICCV | ReferDINO: Referring Video Object Segmentation with Visual Grounding Foundations. | Tianming Liang, Kun-Yu Lin, Chaolei Tan, Jianguo Zhang, Wei-Shi Zheng, Jian-Fang Hu |
| 2024 | CVPR | Ranking Distillation for Open-Ended Video Question Answering with Insufficient Labels. | Tianming Liang, Chaolei Tan, Beihao Xia, Wei-Shi Zheng, Jian-Fang Hu |
| 2024 | CVPR | Siamese Learning with Joint Alignment and Regression for Weakly-Supervised Video Paragraph Grounding. | Chaolei Tan, Jianhuang Lai, Wei-Shi Zheng, Jian-Fang Hu |
| 2024 | CVPR | Selective Hourglass Mapping for Universal Image Restoration Based on Diffusion Model. | Dian Zheng, Xiao-Ming Wu, Shuzhou Yang, Jian Zhang, Jian-Fang Hu, Wei-Shi Zheng |
| 2024 | ECCV | Progressive Pretext Task Learning for Human Trajectory Prediction. | Xiaotong Lin, Tianming Liang, Jianhuang Lai, Jian-Fang Hu |
| 2023 | CVPR | Collaborative Static and Dynamic Vision-Language Streams for Spatio-Temporal Video Grounding. | Zihang Lin, Chaolei Tan, Jian-Fang Hu, Zhi Jin, Tiancai Ye, Wei-Shi Zheng |
| 2023 | CVPR | Hierarchical Semantic Correspondence Networks for Video Paragraph Grounding. | Chaolei Tan, Zihang Lin, Jian-Fang Hu, Wei-Shi Zheng, Jianhuang Lai |
| 2023 | ICIG | Learning Discriminative Proposal Representation for Multi-object Tracking. | Yejia Huang, Xianqin Liu, Yijun Zhang, Jian-Fang Hu |