| 2026 | AAAI | TSPO: Temporal Sampling Policy Optimization for Long-form Video Language Understanding. | Canhui Tang, Zifan Han, Hongbo Sun, Sanping Zhou, Xuchong Zhang, Xin Wei, Ye Yuan, Huayu Zhang, Jinglin Xu, Hao Sun |
| 2025 | AAAI | REGNav: Room Expert Guided Image-Goal Navigation. | Pengna Li, Kangyi Wu, Jingwen Fu, Sanping Zhou |
| 2025 | AAAI | Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding. | Xiaolong Sun, Liushuai Shi, Le Wang, Sanping Zhou, Kun Xia, Yabing Wang, Gang Hua |
| 2025 | AAAI | RefDetector: A Simple Yet Effective Matching-based Method for Referring Expression Comprehension. | Yabing Wang, Zhuotao Tian, Zheng Qin, Sanping Zhou, Le Wang |
| 2025 | AIAI | GaussBEV: Multi-head Gaussian Feature Grouping for Multi-view 3D Object Detection. | Junjie Zhang, Sanping Zhou, Yuhao Huang, Jinpeng Dong, Jingwen Fu, Nanning Zheng |
| 2025 | CVPR | Boosting Point-Supervised Temporal Action Localization through Integrating Query Reformation and Optimal Transport. | Mengnan Liu, Le Wang, Sanping Zhou, Kun Xia, Xiaolong Sun, Gang Hua |
| 2025 | CVPR | PDFactor: Learning Tri-Perspective View Policy Diffusion Field for Multi-Task Robotic Manipulation. | Jingyi Tian, Le Wang, Sanping Zhou, Sen Wang, Jiayi Li, Haowen Sun, Wei Tang |
| 2025 | CVPR | FlowRAM: Grounding Flow Matching Policy with Region-Aware Mamba Framework for Robotic Manipulation. | Sen Wang, Le Wang, Sanping Zhou, Jingyi Tian, Jiayi Li, Haowen Sun, Wei Tang |
| 2025 | CVPR | Towards Precise Embodied Dialogue Localization via Causality Guided Diffusion. | Haoyu Wang, Le Wang, Sanping Zhou, Jingyi Tian, Zheng Qin, Yabing Wang, Gang Hua, Wei Tang |
| 2025 | CVPR | Event-Equalized Dense Video Captioning. | Kangyi Wu, Pengna Li, Jingwen Fu, Yizhe Li, Yang Wu, Yuhan Liu, Jinjun Wang, Sanping Zhou |
| 2025 | ICCV | Enhancing Mamba Decoder with Bidirectional Interaction in Multi-Task Dense Prediction. | Mang Cao, Sanping Zhou, Yizhe Li, Ye Deng, Wenli Huang, Le Wang |
| 2025 | ICCV | DAMap: Distance-Aware MapNet for High Quality HD Map Construction. | Jinpeng Dong, Chen Li, Yutong Lin, Jingwen Fu, Sanping Zhou, Nanning Zheng |
| 2025 | ICCV | Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching. | Yuhan Liu, Jingwen Fu, Yang Wu, Kangyi Wu, Pengna Li, Jiayi Wu, Sanping Zhou, Jingmin Xin |
| 2025 | ICCV | Moment Quantization for Video Temporal Grounding. | Xiaolong Sun, Le Wang, Sanping Zhou, Liushuai Shi, Kun Xia, Mengnan Liu, Yabing Wang, Gang Hua |
| 2025 | ICCV | FreqPDE: Rethinking Positional Depth Embedding for Multi-View 3D Object Detection Transformers. | Haisheng Su, Junjie Zhang, Feixiang Song, Sanping Zhou, Wei Wu, Junchi Yan, Nanning Zheng |
| 2024 | AAAI | Voxel or Pillar: Exploring Efficient Point Cloud Representation for 3D Object Detection. | Yuhao Huang, Sanping Zhou, Junjie Zhang, Jinpeng Dong, Nanning Zheng |
| 2024 | AAAI | Temporal Correlation Vision Transformer for Video Person Re-Identification. | Pengfei Wu, Le Wang, Sanping Zhou, Gang Hua, Changyin Sun |
| 2024 | CVPR | Towards Generalizable Multi-Object Tracking. | Zheng Qin, Le Wang, Sanping Zhou, Panpan Fu, Gang Hua, Wei Tang |
| 2024 | ECCV | AugDETR: Improving Multi-scale Learning for Detection Transformer. | Jinpeng Dong, Yutong Lin, Chen Li, Sanping Zhou, Nanning Zheng |
| 2024 | ECCV | PMT: Progressive Mean Teacher via Exploring Temporal Consistency for Semi-Supervised Medical Image Segmentation. | Ning Gao, Sanping Zhou, Le Wang, Nanning Zheng |
| 2024 | ECCV | Stepwise Multi-grained Boundary Detector for Point-Supervised Temporal Action Localization. | Mengnan Liu, Le Wang, Sanping Zhou, Kun Xia, Qi Wu, Qilin Zhang, Gang Hua |
| 2024 | ECCV | Learning Anomalies with Normality Prior for Unsupervised Video Anomaly Detection. | Haoyue Shi, Le Wang, Sanping Zhou, Gang Hua, Wei Tang |
| 2024 | IROS | Vehicle Trajectory Prediction with Soft Behavior Constraints. | Ke Ye, Sanping Zhou, Miao Kang, Jingwen Fu, Nanning Zheng |
| 2023 | AAAI | Multi-Stream Representation Learning for Pedestrian Trajectory Prediction. | Yuxuan Wu, Le Wang, Sanping Zhou, Jinghai Duan, Gang Hua, Wei Tang |
| 2023 | CVPR | MotionTrack: Learning Robust Short-Term and Long-Term Motions for Multi-Object Tracking. | Zheng Qin, Sanping Zhou, Le Wang, Jinghai Duan, Gang Hua, Wei Tang |
| 2023 | CVPR | StructVPR: Distill Structural Knowledge with Weighting Samples for Visual Place Recognition. | Yanqing Shen, Sanping Zhou, Jingwen Fu, Ruotong Wang, Shitao Chen, Nanning Zheng |
| 2023 | ICANN | MLF-DET: Multi-Level Fusion for Cross-Modal 3D Object Detection. | Zewei Lin, Yanqing Shen, Sanping Zhou, Shitao Chen, Nanning Zheng |
| 2023 | ICCV | Sparse Instance Conditioned Multimodal Trajectory Prediction. | Yonghao Dong, Le Wang, Sanping Zhou, Gang Hua |
| 2023 | ICCV | Parallel Attention Interaction Network for Few-Shot Skeleton-based Action Recognition. | Xingyu Liu, Sanping Zhou, Le Wang, Gang Hua |
| 2023 | ICCV | Trajectory Unified Transformer for Pedestrian Trajectory Prediction. | Liushuai Shi, Le Wang, Sanping Zhou, Gang Hua |
| 2023 | ICCV | Learning from Noisy Pseudo Labels for Semi-Supervised Temporal Action Localization. | Kun Xia, Le Wang, Sanping Zhou, Gang Hua, Wei Tang |
| 2023 | ICIP | Pseudo Labels Refinement with Intra-Camera Similarity for Unsupervised Person Re-Identification. | Pengna Li, Kangyi Wu, Sanping Zhou, Qianxin Huang, Jinjun Wang |
| 2023 | IJCNN | TEMI-MOT: Towards Efficient Multi-Modality Instance-Aware Feature Learning for 3D Multi-Object Tracking. | Yufeng Hu, Sanping Zhou, Jinpeng Dong, Nanning Zheng |
| 2022 | AAAI | Complementary Attention Gated Network for Pedestrian Trajectory Prediction. | Jinghai Duan, Le Wang, Chengjiang Long, Sanping Zhou, Fang Zheng, Liushuai Shi, Gang Hua |
| 2022 | AAAI | Social Interpretable Tree for Pedestrian Trajectory Prediction. | Liushuai Shi, Le Wang, Chengjiang Long, Sanping Zhou, Fang Zheng, Nanning Zheng, Gang Hua |
| 2022 | CVPR | TransVPR: Transformer-Based Place Recognition with Multi-Level Attention Aggregation. | Ruotong Wang, Yanqing Shen, Weiliang Zuo, Sanping Zhou, Nanning Zheng |
| 2022 | CVPR | Learning to Refactor Action and Co-occurrence Features for Temporal Action Localization. | Kun Xia, Le Wang, Sanping Zhou, Nanning Zheng, Wei Tang |
| 2022 | ECCV | Hourglass Attention Network for Image Inpainting. | Ye Deng, Siqi Hui, Rongye Meng, Sanping Zhou, Jinjun Wang |
| 2022 | IROS | Pedestrian Intention Prediction Based on Traffic-Aware Scene Graph Model. | Xingchen Song, Miao Kang, Sanping Zhou, Jianji Wang, Yishu Mao, Nanning Zheng |
| 2022 | MICCAI | Meta Pixel Loss Correction for Medical Image Segmentation with Noisy Labels. | Zhuotong Cai, Jingmin Xin, Peiwen Shi, Sanping Zhou, Jiayi Wu, Nanning Zheng |
| 2021 | CVPR | SGCN: Sparse Graph Convolution Network for Pedestrian Trajectory Prediction. | Liushuai Shi, Le Wang, Chengjiang Long, Sanping Zhou, Mo Zhou, Zhenxing Niu, Gang Hua |
| 2021 | ICCV | Meta Pairwise Relationship Distillation for Unsupervised Person Re-identification. | Haoxuanye Ji, Le Wang, Sanping Zhou, Wei Tang, Nanning Zheng, Gang Hua |
| 2021 | ICCV | Unlimited Neighborhood Interaction for Heterogeneous Trajectory Prediction. | Fang Zheng, Le Wang, Sanping Zhou, Wei Tang, Zhenxing Niu, Nanning Zheng, Gang Hua |
| 2021 | ICIP | Learning Generic Feature Representations with Adversarial Regularization for Person Re-Identification. | Qindong Zhang, Sanping Zhou, Jinjun Wang |
| 2020 | MICCAI | Meta Corrupted Pixels Mining for Medical Image Segmentation. | Jixin Wang, Sanping Zhou, Chaowei Fang, Le Wang, Jinjun Wang |
| 2019 | ICCV | Person-in-WiFi: Fine-Grained Person Perception Using WiFi. | Fei Wang, Sanping Zhou, Stanislav Panev, Jinsong Han, Dong Huang |
| 2019 | ICCV | Discriminative Feature Learning With Consistent Attention Regularization for Person Re-Identification. | Sanping Zhou, Fei Wang, Zeyi Huang, Jinjun Wang |
| 2018 | CVPR | An Online and Flexible Multi-Object Tracking Framework Using Long Short-Term Memory. | Xingyu Wan, Jinjun Wang, Sanping Zhou |
| 2018 | ICPR | Continuous Action Recognition and Segmentation in Untrimmed Videos. | Ruibin Bai, Qing Zhao, Sanping Zhou, Yubing Li, Xueji Zhao, Jinjun Wang |
| 2017 | CVPR | Point to Set Similarity Based Deep Feature Learning for Person Re-Identification. | Sanping Zhou, Jinjun Wang, Jiayun Wang, Yihong Gong, Nanning Zheng |
| 2016 | CVPR | Person Re-identification by Multi-Channel Parts-Based CNN with Improved Triplet Loss Function. | De Cheng, Yihong Gong, Sanping Zhou, Jinjun Wang, Nanning Zheng |