| 2026 | AAAI | TCoT: Trajectory Chain-of-Thoughts for Robotic Manipulation with Failure Recovery in Vision-Language-Action Model. | Xiang Li, Ya-Li Li, Yuan Wang, Huaqiang Wang, Shengjin Wang |
| 2026 | AAAI | Preserving Topological and Geometric Embeddings for Point Cloud Recovery. | Kaiyue Zhou, Zelong Tan, Hongxiao Wang, Ya-li Li, Shengjin Wang |
| 2025 | AAAI | LIBA: Language Instructed Multi-granularity Bridge Assistant for 3D Visual Grounding. | Yuan Wang, Yali Li, Eastman Z. Y. Wu, Shengjin Wang |
| 2025 | CVPR | HSI-GPT: A General-Purpose Large Scene-Motion-Language Model for Human Scene Interaction. | Yuan Wang, Yali Li, Xiang Li, Shengjin Wang |
| 2025 | ICASSP | Attention Augmented Structure-centric Bias Mitigation with Feature Disentanglement. | Xuege Hou, Yali Li, Shengjin Wang |
| 2025 | ICASSP | Find Details in Long Videos: Tower-of-Thoughts and Self-Retrieval Augmented Generation for Video Understanding. | Tong Yue, Mingrui Xiao, Dafeng Zhang, Xin Liu, Yali Li, Shengjin Wang |
| 2025 | ICASSP | Dynamic Object Queries for Transformer-based Incremental Object Detection. | Jichuan Zhang, Wei Li, Shuang Cheng, Yali Li, Shengjin Wang |
| 2025 | ICCV | Knowledge-Driven Query Network with Adaptive Cross-View Attention for Structured Radiology Report Generation. | Xuege Hou, Yali Li, Shengjin Wang |
| 2025 | IROS | BookBot: A Robotic Manipulation Benchmark for Voice-Driven Book Recognition and Grasping in Cluttered Environments. | Huaqiang Wang, Yuan Wang, Xiang Li, Yali Li, Shengjin Wang |
| 2024 | CVPR | G | Yuan Wang, Yali Li, Shengjin Wang |
| 2024 | CVPR | Exploring Pose-Aware Human-Object Interaction via Hybrid Learning. | Eastman Z. Y. Wu, Yali Li, Yuan Wang, Shengjin Wang |
| 2024 | ECCV | Risk-Aware Self-consistent Imitation Learning for Trajectory Planning in Autonomous Driving. | Yixuan Fan, Yali Li, Shengjin Wang |
| 2024 | ECCV | OV-Uni3DETR: Towards Unified Open-Vocabulary 3D Object Detection via Cycle-Modality Propagation. | Zhenyu Wang, Yali Li, Taichi Liu, Hengshuang Zhao, Shengjin Wang |
| 2024 | ICASSP | RCIF: Towards Robust Distributed DNN Collaborative Inference Under Highly Lossy Networks. | Yujun Cheng, Zhewei Zhang, Shengjin Wang |
| 2024 | ICASSP | FED-SDS: Adaptive Structured Dynamic Sparsity for Federated Learning Under Heterogeneous Clients. | Yujun Cheng, Zhewei Zhang, Shengjin Wang |
| 2024 | ICASSP | Learning Generalizable Visual Representations via Self-Supervised Information Bottleneck. | Xin Liu, Yali Li, Shengjin Wang |
| 2024 | ICLR | Alice Benchmarks: Connecting Real World Re-Identification with the Synthetic. | Xiaoxiao Sun, Yue Yao, Shengjin Wang, Hongdong Li, Liang Zheng |
| 2024 | IGARSS | Cross Teaching between Single-Spectral and Multi-Spectral Detection Transformers for Remote Sensing Object Detection. | Jiahe Zhu, Kaiyue Zhou, Huan Zhang, Shengjin Wang, Hongbing Ma |
| 2024 | IJCNN | Transformer-Based Few-Shot Object Detection with Enhanced Fine-Tuning Stability. | Zuyu Chen, Yali Li, Shengjin Wang |
| 2024 | MICCAI | AC-UNet: A Self-adaptive Cropping Approach for Kidney Pathology Image Segmentation. | Xuege Hou, Eastman Z. Y. Wu, Guangyu Dong, Wang Yuan, Yali Li, Shengjin Wang |
| 2023 | CVPR | Detecting Everything in the Open World: Towards Universal Object Detection. | Zhenyu Wang, Yali Li, Xi Chen, Ser-Nam Lim, Antonio Torralba, Hengshuang Zhao, Shengjin Wang |
| 2023 | ICASSP | Divcon: Learning Concept Sequences for Semantically Diverse Image Captioning. | Yue Zheng, Yali Li, Shengjin Wang |
| 2023 | ICCV | Identity-Seeking Self-Supervised Representation Learning for Generalizable Person Re-identification. | Zhaopeng Dou, Zhongdao Wang, Yali Li, Shengjin Wang |
| 2023 | ICIG | RoICLIP: Text-Enhanced UAV-Based Video Object Detection. | Peiyi Zhang, Yali Li, Shengjin Wang |
| 2023 | IROS | Look Before You Drive: Boosting Trajectory Forecasting via Imagining Future. | Yixuan Fan, Xin Liu, Yali Li, Shengjin Wang |
| 2023 | IROS | VL-Grasp: a 6-Dof Interactive Grasp Policy for Language-Oriented Objects in Cluttered Indoor Scenes. | Yuhao Lu, Yixuan Fan, Beixing Deng, Fangfu Liu, Yali Li, Shengjin Wang |
| 2023 | ISVC | Deep Representation Learning for License Plate Recognition in Low Quality Video Images. | Kemeng Zhao, Liangrui Peng, Ning Ding, Gang Yao, Pei Tang, Shengjin Wang |
| 2023 | VCIP | A prompt tuning method for few-shot action recognition. | Shu Yang, Yali Li, Shengjin Wang |
| 2022 | AAAI | Delving into Probabilistic Uncertainty for Unsupervised Domain Adaptive Person Re-identification. | Jian Han, Ya-Li Li, Shengjin Wang |
| 2022 | BMVC | Disentangling based Environment-Robust Feature Learning for Person ReID. | Yifan Liu, Yali Li, Shengjin Wang |
| 2022 | BMVC | Polishing Network for Decoding of Higher-Quality Diverse Image Captions. | Yue Zheng, Ya-Li Li, Shengjin Wang |
| 2022 | CVPR | R(Det) | Yali Li, Shengjin Wang |
| 2022 | CVPR | OSKDet: Orientation-sensitive Keypoint Localization for Rotated Object Detection. | Dongchen Lu, Dongmei Li, Yali Li, Shengjin Wang |
| 2022 | CVPR | Noisy Boundaries: Lemon or Lemonade for Semi-supervised Instance Segmentation? | Zhenyu Wang, Yali Li, Shengjin Wang |
| 2022 | ECCV | Reliability-Aware Prediction via Uncertainty Learning for Person Image Retrieval. | Zhaopeng Dou, Zhongdao Wang, Weihua Chen, Yali Li, Shengjin Wang |
| 2022 | ECCV | GraphCSPN: Geometry-Aware Depth Completion via Dynamic GCNs. | Xin Liu, Xiaofei Shao, Bo Wang, Yali Li, Shengjin Wang |
| 2022 | ICASSP | Progressive-Granularity Retrieval Via Hierarchical Feature Alignment for Person Re-Identification. | Zhaopeng Dou, Zhongdao Wang, Yali Li, Shengjin Wang |
| 2022 | ICASSP | Few-Shot Object Detection with Local Correspondence RPN and Attentive Head. | Jian Han, Yali Li, Shengjin Wang |
| 2022 | ICASSP | CRPN: Distinguish Novel Categories Via Class-Relevant Region Proposal Network for Few-Shot Object Detection. | Han Wang, Yali Li, Shengjin Wang |
| 2022 | ICRA | Hybrid Physical Metric For 6-DoF Grasp Pose Detection. | Yuhao Lu, Beixing Deng, Zhenyu Wang, Peiyuan Zhi, Yali Li, Shengjin Wang |
| 2021 | CVPR | A2-FPN: Attention Aggregation Based Feature Pyramid Network for Instance Segmentation. | Miao Hu, Yali Li, Lu Fang, Shengjin Wang |
| 2021 | CVPR | Multi-Target Domain Adaptation With Collaborative Consistency Learning. | Takashi Isobe, Xu Jia, Shuaijun Chen, Jianzhong He, Yongjie Shi, Jianzhuang Liu, Huchuan Lu, Shengjin Wang |
| 2021 | CVPR | Data-Uncertainty Guided Multi-Phase Learning for Semi-Supervised Object Detection. | Zhenyu Wang, Yali Li, Ye Guo, Lu Fang, Shengjin Wang |
| 2021 | ICASSP | Frame-Rate-Aware Aggregation for Efficient Video Super-Resolution. | Takashi Isobe, Fang Zhu, Shengjin Wang |
| 2021 | ICCV | Disentangled Representation for Age-Invariant Face Recognition: A Mutual Information Minimization Perspective. | Xuege Hou, Yali Li, Shengjin Wang |
| 2021 | ICCV | Towards Discriminative Representation Learning for Unsupervised Person Re-identification. | Takashi Isobe, Dong Li, Lu Tian, Weihua Chen, Yi Shan, Shengjin Wang |
| 2021 | ICCV | Partial Off-policy Learning: Balance Accuracy and Diversity for Human-Oriented Image Captioning. | Jiahe Shi, Yali Li, Shengjin Wang |
| 2021 | ICDAR | Mask Scene Text Recognizer. | Haodong Shi, Liangrui Peng, Ruijie Yan, Gang Yao, Shuman Han, Shengjin Wang |
| 2020 | AAAI | Softmax Dissection: Towards Understanding Intra- and Inter-Class Objective for Embedding Learning. | Lanqing He, Zhongdao Wang, Yali Li, Shengjin Wang |
| 2020 | BMVC | Revisiting Temporal Modeling for Video Super-resolution. | Takashi Isobe, Fang Zhu, Shengjin Wang |
| 2020 | CVPR | Video Super-Resolution With Temporal Group Attention. | Takashi Isobe, Songjiang Li, Xu Jia, Shanxin Yuan, Gregory G. Slabaugh, Chunjing Xu, Ya-Li Li, Shengjin Wang, Qi Tian |
| 2020 | ECCV | Video Super-Resolution with Recurrent Structure-Detail Network. | Takashi Isobe, Xu Jia, Shuhang Gu, Songjiang Li, Shengjin Wang, Qi Tian |
| 2020 | ECCV | Towards Real-Time Multi-Object Tracking. | Zhongdao Wang, Liang Zheng, Yixuan Liu, Yali Li, Shengjin Wang |
| 2020 | ECCV | CycAs: Self-supervised Cycle Association for Learning Re-identifiable Descriptions. | Zhongdao Wang, Jingwei Zhang, Liang Zheng, Yixuan Liu, Yifan Sun, Yali Li, Shengjin Wang |
| 2020 | ICASSP | CS-R-FCN: Cross-Supervised Learning for Large-Scale Object Detection. | Ye Guo, Yali Li, Shengjin Wang |
| 2020 | ICIP | Intra-Clip Aggregation For Video Person Re-Identification. | Takashi Isobe, Jian Han, Fang Zhu, Yali Li, Shengjin Wang |
| 2019 | BMVC | Adversarial View-Consistent Learning for Monocular Depth Estimation. | Yixuan Liu, Yuwang Wang, Shengjin Wang |
| 2019 | CVPR | Perceive Where to Focus: Learning Visibility-Aware Part-Level Features for Partial Person Re-Identification. | Yifan Sun, Qin Xu, Yali Li, Chi Zhang, Yikang Li, Shengjin Wang, Jian Sun |
| 2019 | CVPR | Linkage Based Face Clustering via Graph Convolution Network. | Zhongdao Wang, Liang Zheng, Yali Li, Shengjin Wang |
| 2019 | CVPR | Intention Oriented Image Captions With Guiding Objects. | Yue Zheng, Yali Li, Shengjin Wang |
| 2019 | EMNLP | Applying BERT to Document Retrieval with Birch. | Zeynep Akkalyoncu Yilmaz, Shengjin Wang, Wei Yang, Haotian Zhang, Jimmy Lin |
| 2019 | ICDAR | Deep Network with Pixel-Level Rectification and Robust Training for Handwriting Recognition. | Shanyu Xiao, Liangrui Peng, Ruijie Yan, Shengjin Wang |
| 2019 | ICIG | Parallel-Structure-based Transfer Learning for Deep NIR-to-VIS Face Recognition. | Yufei Wang, Yali Li, Shengjin Wang |
| 2019 | ICIP | Cascade Attention: Multiple Feature Based Learning for Image Captioning. | Jiahe Shi, Yali Li, Shengjin Wang |
| 2018 | ACCV | Learning from PhotoShop Operation Videos: The PSOV Dataset. | Jingchun Cheng, Han-Kai Hsu, Chen Fang, Hailin Jin, Shengjin Wang, Ming-Hsuan Yang |
| 2018 | BMVC | A Highly Accurate Feature Fusion Network For Vehicle Detection In Surveillance Scenarios. | Jianqiang Wang, Ya-Li Li, Shengjin Wang |
| 2018 | CVPR | Fast and Accurate Online Video Object Segmentation via Tracking Parts. | Jingchun Cheng, Yi-Hsuan Tsai, Wei-Chih Hung, Shengjin Wang, Ming-Hsuan Yang |
| 2018 | ECCV | Beyond Part Models: Person Retrieval with Refined Part Pooling (and A Strong Convolutional Baseline). | Yifan Sun, Liang Zheng, Yi Yang, Qi Tian, Shengjin Wang |
| 2018 | ECCV | VisDrone-DET2018: The Vision Meets Drone Object Detection in Image Challenge Results. | Pengfei Zhu, Longyin Wen, Dawei Du, Xiao Bian, Haibin Ling, Qinghua Hu, Qinqin Nie, Hao Cheng, Chenfeng Liu, Xiaoyu Liu, Wenya Ma, Haotian Wu, Lianjie Wang, Arne Schumann, Chase Brown, Qian Chen, Chengzheng Li, Dongdong Li, Emmanouil Michail, Fan Zhang, Feng Ni, Feng Zhu, Guanghui Wang, Haipeng Zhang, Han Deng, Hao Liu, Haoran Wang, Heqian Qiu, Honggang Qi, Honghui Shi, Hongliang Li, Hongyu Xu, Hu Lin, Ioannis Kompatsiaris, Jian Cheng, Jianqiang Wang, Jianxiu Yang, Jingkai Zhou, Juanping Zhao, K. J. Joseph, Kaiwen Duan, Karthik Suresh, Bo Ke, Ke Wang, Konstantinos Avgerinakis, Lars Wilko Sommer, Lei Zhang, Li Yang, Lin Cheng, Lin Ma, Liyu Lu, Lu Ding, Minyu Huang, Naveen Kumar Vedurupaka, Nehal Mamgain, Nitin Bansal, Oliver Acatay, Panagiotis Giannakeris, Qian Wang, Qijie Zhao, Qingming Huang, Qiong Liu, Qishang Cheng, Qiuchen Sun, Robert Laganire, Sheng Jiang, Shengjin Wang, Shubo Wei, Siwei Wang, Stefanos Vrochidis, Sujuan Wang, Tiaojio Lee, Usman Sajid, Vineeth N. Balasubramanian, Wei Li, Wei Zhang, Weikun Wu, Wenchi Ma, Wenrui He, Wenzhe Yang, Xiaoyu Chen, Xin Sun, Xinbin Luo, Xintao Lian, Xiufang Li, Yangliu Kuai, Yali Li, Yi Luo, Yifan Zhang, Yiling Liu, Ying Li, Yong Wang, Yongtao Wang, Yuanwei Wu, Yue Fan, Yunchao Wei, Yuqin Zhang, Zexin Wang, Zhangyang Wang, Zhaoyue Xia, Zhen Cui, Zhenwei He, Zhipeng Deng, Zhiyao Guo, Zichen Song |
| 2018 | ICIP | Feature Learning for One-Shot Face Recognition. | Lingxiao Wang, Yali Li, Shengjin Wang |
| 2018 | ICPR | Attend and Align: Improving Deep Representations with Feature Alignment Layer for Person Retrieval. | Qin Xu, Yifan Sun, Yali Li, Shengjin Wang |
| 2018 | PAKDD | On the Large-Scale Transferability of Convolutional Neural Networks. | Liang Zheng, Yali Zhao, Shengjin Wang, Jingdong Wang, Yi Yang, Qi Tian |
| 2017 | ICCV | SegFlow: Joint Learning for Video Object Segmentation and Optical Flow. | Jingchun Cheng, Yi-Hsuan Tsai, Shengjin Wang, Ming-Hsuan Yang |
| 2017 | ICCV | SVDNet for Pedestrian Retrieval. | Yifan Sun, Liang Zheng, Weijian Deng, Shengjin Wang |
| 2017 | ICCV | Orientation Invariant Feature Embedding and Spatial Temporal Regularization for Vehicle Re-identification. | Zhongdao Wang, Luming Tang, Xihui Liu, Zhuliang Yao, Shuai Yi, Jing Shao, Junjie Yan, Shengjin Wang, Hongsheng Li, Xiaogang Wang |
| 2017 | ICDAR | Residual Recurrent Neural Network with Sparse Training for Offline Arabic Handwriting Recognition. | Ruijie Yan, Liangrui Peng, GuangXiang Bin, Shengjin Wang, Yao Cheng |
| 2017 | ICIP | A highly accurate facial region network for unconstrained face detection. | Han Shu, Dangdang Chen, Yali Li, Shengjin Wang |
| 2016 | CVPR | Weakly Supervised Object Localization with Progressive Domain Adaptation. | Dong Li, Jia-Bin Huang, Yali Li, Shengjin Wang, Ming-Hsuan Yang |
| 2016 | ECCV | Unsupervised Visual Representation Learning by Graph-Based Consistent Constraints. | Dong Li, Wei-Chih Hung, Jia-Bin Huang, Shengjin Wang, Narendra Ahuja, Ming-Hsuan Yang |
| 2016 | ECCV | MARS: A Video Benchmark for Large-Scale Person Re-Identification. | Liang Zheng, Zhi Bie, Yifan Sun, Jingdong Wang, Chi Su, Shengjin Wang, Qi Tian |
| 2016 | ICASSP | Bagging regularized common spatial pattern with hybrid motor imagery and myoelectric signal. | Hongchuan Liu, Yali Li, Hongma Liu, Shengjin Wang |
| 2016 | KES | A Multi-stage Method for Chinese Text Detection in News Videos. | Yaqi Wang, Liangrui Peng, Shengjin Wang |
| 2015 | CVPR | Query-adaptive late fusion for image search and person re-identification. | Liang Zheng, Shengjin Wang, Lu Tian, Fei He, Ziqiong Liu, Qi Tian |
| 2015 | HCI | New Research Methods for Media and Cognition Experiment Course. | Yi Yang, Shengjin Wang, Liangrui Peng |
| 2015 | ICCV | Fast Orthogonal Projection Based on Kronecker Product. | Xu Zhang, Felix X. Yu, Ruiqi Guo, Sanjiv Kumar, Shengjin Wang, Shih-Fu Chang |
| 2015 | ICCV | Scalable Person Re-identification: A Benchmark. | Liang Zheng, Liyue Shen, Lu Tian, Shengjin Wang, Jingdong Wang, Qi Tian |
| 2015 | ICIP | Selective parts for fine-grained recognition. | Dong Li, Yali Li, Shengjin Wang |
| 2014 | CVPR | Packing and Padding: Coupled Multi-index for Accurate Image Retrieval. | Liang Zheng, Shengjin Wang, Ziqiong Liu, Qi Tian |
| 2014 | CVPR | Bayes Merging of Multiple Vocabularies for Scalable Image Retrieval. | Liang Zheng, Shengjin Wang, Wengang Zhou, Qi Tian |
| 2014 | ECCV | Person Re-identification by Video Ranking. | Taiqing Wang, Shaogang Gong, Xiatian Zhu, Shengjin Wang |
| 2014 | ICASSP | Visual reranking with improved image graph. | Ziqiong Liu, Shengjin Wang, Liang Zheng, Qi Tian |
| 2013 | CVPR | Lp-Norm IDF for Large Scale Image Search. | Liang Zheng, Shengjin Wang, Ziqiong Liu, Qi Tian |
| 2012 | ACCV | Combining Fast Extracted Edge Descriptors and Feature Sharing for Rapid Object Detection. | Yali Li, Fei He, Wenhao Lu, Shengjin Wang |
| 2012 | ICPR | Evaluation of canonical correlation analysis: A Correlation Generation Model. | Ya Su, Shengjin Wang, Yun Fu |
| 2012 | ICPR | Submanifold decomposition. | Ya Su, Shengjin Wang, Yun Fu |
| 2010 | ICIP | Person-independent head pose estimation based on random forest regression. | Yali Li, Shengjin Wang, Xiaoqing Ding |
| 2010 | ICPR | Part Detection, Description and Selection Based on Hidden Conditional Random Fields. | Wenhao Lu, Shengjin Wang, Xiaoqing Ding |
| 2009 | SMC | Vehicle Detection and Tracking in Relatively Crowded Conditions. | Wenhao Lu, Shengjin Wang, Xiaoqing Ding |
| 2008 | ICPR | Full body tracking-based human action recognition. | Junxia Gu, Xiaoqing Ding, Shengjin Wang, Youshou Wu |
| 2007 | ISNN | Multi-view Moving Human Detection and Correspondence Based on Object Occupancy Random Field. | Jian Xu, Xiaoqing Ding, Shengjin Wang, Youshou Wu |
| 2006 | ICPR | AdaBoost Tracker Embedded in Adaptive Particle Filtering. | Yun Lei, Xiaoqing Ding, Shengjin Wang |
| 2006 | IPAS | Combining local descriptions with geometric constraints for 3D object recognition in multiple statuses. | Ying Huang, Xiaoqing Ding, Shengjin Wang |
| 2006 | ISNN | Object Detection Via Fusion of Global Classifier and Part-Based Classifier. | Zhi Zeng, Shengjin Wang, Xiaoqing Ding |
| 2004 | ICASSP | Recognition of 3-D objects in multiple statuses based on Markov random field models. | Ying Huang, Xiaoqing Ding, Shengjin Wang |