| 2026 | AAAI | Sim4Seg: Boosting Multimodal Multi-disease Medical Diagnosis Segmentation with Region-Aware Vision-Language Similarity Masks. | Lingran Song, Yucheng Zhou, Jianbing Shen |
| 2026 | AAAI | Towards High-Fidelity 3D Portrait Generation with Rich Details by Cross-View Prior-Aware Diffusion. | Haoran Wei, Wencheng Han, Xingping Dong, Jianbing Shen |
| 2026 | AAAI | Less Is More: Vision Representation Compression for Efficient Video Generation with Large Language Models. | Yucheng Zhou, Jihai Zhang, Guanjie Chen, Jianbing Shen, Yu Cheng |
| 2026 | ACL | Multimodal Large Language Models for Multi-Subject In-Context Image Generation. | Yucheng Zhou, Dubing Chen, Huan Zheng, Jianbing Shen |
| 2026 | ACL | Accelerating Training of Autoregressive Video Generation Models via Local Optimization with Representation Continuity. | Yucheng Zhou, Jianbing Shen |
| 2026 | ACL | Compatibility-Aware Dynamic Fine-Tuning for Large Language Models. | Yucheng Zhou, Junwei Sheng, Qianning Wang, Jianbing Shen |
| 2025 | AAAI | DME-Driver: Integrating Human Decision Logic and 3D Scene Perception in Autonomous Driving. | Wencheng Han, Dongqian Guo, Cheng-Zhong Xu, Jianbing Shen |
| 2025 | AAAI | Language Prompt for Autonomous Driving. | Dongming Wu, Wencheng Han, Yingfei Liu, Tiancai Wang, Cheng-Zhong Xu, Xiangyu Zhang, Jianbing Shen |
| 2025 | AAAI | OLiDM: Object-aware LiDAR Diffusion Models for Autonomous Driving. | Tianyi Yan, Junbo Yin, Xianpeng Lang, Ruigang Yang, Cheng-Zhong Xu, Jianbing Shen |
| 2025 | ACL | Improving Medical Large Vision-Language Models with Abnormal-Aware Feedback. | Yucheng Zhou, Lingran Song, Jianbing Shen |
| 2025 | ACL | MAM: Modular Multi-Agent Framework for Multi-Modal Medical Diagnosis via Role-Specialized Collaboration. | Yucheng Zhou, Lingran Song, Jianbing Shen |
| 2025 | ACL | Self-Rewarding Large Vision-Language Models for Optimizing Prompts in Text-to-Image Generation. | Hongji Yang, Yucheng Zhou, Wencheng Han, Jianbing Shen |
| 2025 | CVPR | Rethinking Temporal Fusion with a Unified Gradient Descent View for 3D Semantic Occupancy Prediction. | Dubing Chen, Huan Zheng, Jin Fang, Xingping Dong, Xianfei Li, Wenlong Liao, Tao He, Pai Peng, Jianbing Shen |
| 2025 | CVPR | LOGICZSL: Exploring Logic-induced Representation for Compositional Zero-shot Learning. | Peng Wu, Xiankai Lu, Hao Hu, Yongqin Xian, Jianbing Shen, Wenguan Wang |
| 2025 | CVPR | DrivingSphere: Building a High-fidelity 4D World for Closed-loop Simulation. | Tianyi Yan, Dongming Wu, Wencheng Han, Junpeng Jiang, Xia Zhou, Kun Zhan, Cheng-Zhong Xu, Jianbing Shen |
| 2025 | CVPR | Decoupling Fine Detail and Global Geometry for Compressed Depth Map Super-Resolution. | Huan Zheng, Wencheng Han, Jianbing Shen |
| 2025 | ICCV | ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions. | Dubing Chen, Jin Fang, Wencheng Han, Xinjing Cheng, Junbo Yin, Chenzhong Xu, Fahad Shahbaz Khan, Jianbing Shen |
| 2025 | ICCV | Semantic Causality-Aware Vision-Based 3D Occupancy Prediction. | Dubing Chen, Huan Zheng, Yucheng Zhou, Xianfei Li, Wenlong Liao, Tao He, Pai Peng, Jianbing Shen |
| 2025 | ICCV | RAGNet: Large-Scale Reasoning-Based Affordance Segmentation Benchmark Towards General Grasping. | Dongming Wu, Yanping Fu, Saike Huang, Yingfei Liu, Fan Jia, Nian Liu, Feng Dai, Tiancai Wang, Rao Muhammad Anwer, Fahad Shahbaz Khan, Jianbing Shen |
| 2025 | ICCV | DC-ControlNet: Decoupling Inter- and Intra-Element Conditions in Image Generation with Diffusion Models. | Hongji Yang, Wencheng Han, Yucheng Zhou, Jianbing Shen |
| 2025 | ICLR | Weak to Strong Generalization for Large Language Models with Multi-capabilities. | Yucheng Zhou, Jianbing Shen, Yu Cheng |
| 2024 | AAAI | DI-V2X: Learning Domain-Invariant Representation for Vehicle-Infrastructure Collaborative 3D Object Detection. | Xiang Li, Junbo Yin, Wei Li, Chengzhong Xu, Ruigang Yang, Jianbing Shen |
| 2024 | AAAI | Fine-Grained Distillation for Long Document Retrieval. | Yucheng Zhou, Tao Shen, Xiubo Geng, Chongyang Tao, Jianbing Shen, Guodong Long, Can Xu, Daxin Jiang |
| 2024 | ACL | Visual In-Context Learning for Large Vision-Language Models. | Yucheng Zhou, Xiang Li, Qianning Wang, Jianbing Shen |
| 2024 | CVPR | IS-Fusion: Instance-Scene Collaborative Fusion for Multimodal 3D Object Detection. | Junbo Yin, Jianbing Shen, Runnan Chen, Wei Li, Ruigang Yang, Pascal Frossard, Wenguan Wang |
| 2024 | CVPR | Leveraging Frame Affinity for sRGB-to-RAWVideo De-Rendering. | Chen Zhang, Wencheng Han, Yang Zhou, Jianbing Shen, Cheng-Zhong Xu, Wentao Liu |
| 2024 | ECCV | Compressed Depth Map Super-Resolution and Restoration: AIM 2024 Challenge Results. | Marcos V. Conde, Florin-Alexandru Vasluianu, Jinhui Xiong, Wei Ye, Rakesh Ranjan, Radu Timofte, Huan Zheng, Wencheng Han, Tianyi Yan, Jianbing Shen, Pihai Sun, Yuanqi Yao, Kui Jiang, Wenbo Zhao, Xianming Liu, Evgeny Burnaev, Junjun Jiang, Woojae Han, Kyeonghyun Lee, Seongmin Hong, Se Young Chun, Jinseong Kim, Dohyeong Kim, Jeahwan Kim, Yubo Wang, Chi Zhang, Huizhen Luo, Yansai Wu, Mengcheng Huang, Chengji Liu, Chongli Yve, Jianhang Sun, Cheng Guo, Yingcai Du, Huang Jianhao, Liu Shuai, Li Chenghua |
| 2024 | ECCV | High-Precision Self-supervised Monocular Depth Estimation with Rich-Resource Prior. | Wencheng Han, Jianbing Shen |
| 2024 | ECCV | RepVF: A Unified Vector Fields Representation for Multi-task 3D Perception. | Chunliang Li, Wencheng Han, Jun Yin, Sanyuan Zhao, Jianbing Shen |
| 2024 | ICLR | TopoMLP: A Simple yet Strong Pipeline for Driving Topology Reasoning. | Dongming Wu, Jiahao Chang, Fan Jia, Yingfei Liu, Tiancai Wang, Jianbing Shen |
| 2023 | AAAI | LWSIS: LiDAR-Guided Weakly Supervised Instance Segmentation for Autonomous Driving. | Xiang Li, Junbo Yin, Botian Shi, Yikang Li, Ruigang Yang, Jianbing Shen |
| 2023 | AAAI | Exposing the Self-Supervised Space-Time Correspondence Learning via Graph Kernels. | Zheyun Qin, Xiankai Lu, Xiushan Nie, Yilong Yin, Jianbing Shen |
| 2023 | AAAI | SSDA3D: Semi-supervised Domain Adaptation for 3D Object Detection from Point Cloud. | Yan Wang, Junbo Yin, Wei Li, Pascal Frossard, Ruigang Yang, Jianbing Shen |
| 2023 | CVPR | Weakly Supervised Monocular 3D Object Detection Using Multi-View Projection and Direction Consistency. | Runzhou Tao, Wencheng Han, Zhongying Qiu, Cheng-Zhong Xu, Jianbing Shen |
| 2023 | CVPR | Referring Multi-Object Tracking. | Dongming Wu, Wencheng Han, Tiancai Wang, Xingping Dong, Xiangyu Zhang, Jianbing Shen |
| 2023 | ICCV | Self-Supervised Monocular Depth Estimation by Direction-aware Cumulative Convolution Network. | Wencheng Han, Junbo Yin, Jianbing Shen |
| 2023 | ICCV | OnlineRefer: A Simple Online Baseline for Referring Video Object Segmentation. | Dongming Wu, Tiancai Wang, Yuang Zhang, Xiangyu Zhang, Jianbing Shen |
| 2022 | CVPR | Tree Energy Loss: Towards Sparsely Annotated Semantic Segmentation. | Zhiyuan Liang, Tiancai Wang, Xiangyu Zhang, Jian Sun, Jianbing Shen |
| 2022 | CVPR | Counterfactual Cycle-Consistent Learning for Instruction Following and Generation in Vision-Language Navigation. | Hanqing Wang, Wei Liang, Jianbing Shen, Luc Van Gool, Wenguan Wang |
| 2022 | CVPR | Multi-Level Representation Learning with Semantic Alignment for Referring Video Object Segmentation. | Dongming Wu, Xingping Dong, Ling Shao, Jianbing Shen |
| 2022 | ECCV | Learning Disentanglement with Decoupled Labels for Vision-Language Navigation. | Wenhao Cheng, Xingping Dong, Salman H. Khan, Jianbing Shen |
| 2022 | ECCV | Rethinking Clustering-Based Pseudo-Labeling for Unsupervised Meta-Learning. | Xingping Dong, Jianbing Shen, Ling Shao |
| 2022 | ECCV | BRNet: Exploring Comprehensive Features for Monocular Depth Estimation. | Wencheng Han, Junbo Yin, Xiaogang Jin, Xiangdong Dai, Jianbing Shen |
| 2022 | ECCV | Semi-supervised 3D Object Detection with Proficient Teachers. | Junbo Yin, Jin Fang, Dingfu Zhou, Liangjun Zhang, Cheng-Zhong Xu, Jianbing Shen, Wenguan Wang |
| 2022 | ECCV | ProposalContrast: Unsupervised Pre-training for LiDAR-Based 3D Object Detection. | Junbo Yin, Dingfu Zhou, Liangjun Zhang, Jin Fang, Cheng-Zhong Xu, Jianbing Shen, Wenguan Wang |
| 2022 | ECCV | Modality Synergy Complement Learning with Cascaded Aggregation for Visible-Infrared Person Re-Identification. | Yiyuan Zhang, Sanyuan Zhao, Yuhao Kang, Jianbing Shen |
| 2021 | CVPR | Video Object Segmentation Using Global and Instance Embedding Learning. | Wenbin Ge, Xiankai Lu, Jianbing Shen |
| 2021 | CVPR | Learning To Fuse Asymmetric Feature Maps in Siamese Trackers. | Wencheng Han, Xingping Dong, Fahad Shahbaz Khan, Ling Shao, Jianbing Shen |
| 2021 | CVPR | Structured Scene Memory for Vision-Language Navigation. | Hanqing Wang, Wenguan Wang, Wei Liang, Caiming Xiong, Jianbing Shen |
| 2021 | CVPR | Face Forensics in the Wild. | Tianfei Zhou, Wenguan Wang, Zhiyuan Liang, Jianbing Shen |
| 2021 | ICCV | Cross-Modality Person Re-Identification via Modality Confusion and Center Aggregation. | Xin Hao, Sanyuan Zhao, Mang Ye, Jianbing Shen |
| 2021 | ICCV | Full-Duplex Strategy for Video Object Segmentation. | Ge-Peng Ji, Keren Fu, Zhe Wu, Deng-Ping Fan, Jianbing Shen, Ling Shao |
| 2020 | CVPR | Multi-Mutual Consistency Induced Transfer Subspace Learning for Human Motion Segmentation. | Tao Zhou, Huazhu Fu, Chen Gong, Jianbing Shen, Ling Shao, Fatih Porikli |
| 2020 | CVPR | Camouflaged Object Detection. | Deng-Ping Fan, Ge-Peng Ji, Guolei Sun, Ming-Ming Cheng, Jianbing Shen, Ling Shao |
| 2020 | CVPR | Self-Learning With Rectification Strategy for Human Parsing. | Tao Li, Zhiyuan Liang, Sanyuan Zhao, Jiahao Gong, Jianbing Shen |
| 2020 | CVPR | NETNet: Neighbor Erasing and Transferring Network for Better Single Shot Object Detection. | Yazhao Li, Yanwei Pang, Jianbing Shen, Jiale Cao, Ling Shao |
| 2020 | CVPR | Learning Video Object Segmentation From Unlabeled Videos. | Xiankai Lu, Wenguan Wang, Jianbing Shen, Yu-Wing Tai, David J. Crandall, Steven C. H. Hoi |
| 2020 | CVPR | Hierarchical Human Parsing With Typed Part-Relation Reasoning. | Wenguan Wang, Hailong Zhu, Jifeng Dai, Yanwei Pang, Jianbing Shen, Ling Shao |
| 2020 | CVPR | Probabilistic Structural Latent Representation for Unsupervised Embedding. | Mang Ye, Jianbing Shen |
| 2020 | CVPR | LiDAR-Based Online 3D Video Object Detection With Graph-Based Message Passing and Spatiotemporal Transformer Attention. | Junbo Yin, Jianbing Shen, Chenye Guan, Dingfu Zhou, Ruigang Yang |
| 2020 | CVPR | A Unified Object Motion and Affinity Model for Online Multi-Object Tracking. | Junbo Yin, Wenguan Wang, Qinghao Meng, Ruigang Yang, Jianbing Shen |
| 2020 | CVPR | Cascaded Human-Object Interaction Recognition. | Tianfei Zhou, Wenguan Wang, Siyuan Qi, Haibin Ling, Jianbing Shen |
| 2020 | ECCV | CLNet: A Compact Latent Network for Fast Adjusting Siamese Trackers. | Xingping Dong, Jianbing Shen, Ling Shao, Fatih Porikli |
| 2020 | ECCV | Video Object Segmentation with Episodic Graph Memory Networks. | Xiankai Lu, Wenguan Wang, Martin Danelljan, Tianfei Zhou, Jianbing Shen, Luc Van Gool |
| 2020 | ECCV | Weakly Supervised 3D Object Detection from Lidar Point Cloud. | Qinghao Meng, Wenguan Wang, Tianfei Zhou, Jianbing Shen, Luc Van Gool, Dengxin Dai |
| 2020 | ECCV | Active Visual Information Gathering for Vision-Language Navigation. | Hanqing Wang, Wenguan Wang, Tianmin Shu, Wei Liang, Jianbing Shen |
| 2020 | ECCV | Dynamic Dual-Attentive Aggregation Learning for Visible-Infrared Person Re-identification. | Mang Ye, Jianbing Shen, David J. Crandall, Ling Shao, Jiebo Luo |
| 2020 | MICCAI | PraNet: Parallel Reverse Attention Network for Polyp Segmentation. | Deng-Ping Fan, Ge-Peng Ji, Tao Zhou, Geng Chen, Huazhu Fu, Jianbing Shen, Ling Shao |
| 2020 | MICCAI | M | Tao Zhou, Huazhu Fu, Yu Zhang, Changqing Zhang, Xiankai Lu, Jianbing Shen, Ling Shao |
| 2020 | VCIP | Efficient Light Deep Network for Street Scene Parsing. | ZheHui Wang, Sanyuan Zhao, Jianbing Shen, Zhengchao Lei |
| 2019 | CVPR | Shifting More Attention to Video Salient Object Detection. | Deng-Ping Fan, Wenguan Wang, Ming-Ming Cheng, Jianbing Shen |
| 2019 | CVPR | Striking the Right Balance With Uncertainty. | Salman H. Khan, Munawar Hayat, Syed Waqas Zamir, Jianbing Shen, Ling Shao |
| 2019 | CVPR | See More, Know More: Unsupervised Video Object Segmentation With Co-Attention Siamese Networks. | Xiankai Lu, Wenguan Wang, Chao Ma, Jianbing Shen, Ling Shao, Fatih Porikli |
| 2019 | CVPR | An Iterative and Cooperative Top-Down and Bottom-Up Inference Network for Salient Object Detection. | Wenguan Wang, Jianbing Shen, Ming-Ming Cheng, Ling Shao |
| 2019 | CVPR | Learning Unsupervised Video Object Segmentation Through Visual Attention. | Wenguan Wang, Hongmei Song, Shuyang Zhao, Jianbing Shen, Sanyuan Zhao, Steven C. H. Hoi, Haibin Ling |
| 2019 | CVPR | Salient Object Detection With Pyramid Attention and Salient Edges. | Wenguan Wang, Shuyang Zhao, Jianbing Shen, Steven C. H. Hoi, Ali Borji |
| 2019 | ICCV | Gaussian Affinity for Max-Margin Class Imbalanced Learning. | Munawar Hayat, Salman H. Khan, Syed Waqas Zamir, Jianbing Shen, Ling Shao |
| 2019 | ICCV | Adversarial Defense by Restricting the Hidden Space of Deep Neural Networks. | Aamir Mustafa, Salman H. Khan, Munawar Hayat, Roland Goecke, Jianbing Shen, Ling Shao |
| 2019 | ICCV | Towards Bridging Semantic Gap to Improve Semantic Segmentation. | Yanwei Pang, Yazhao Li, Jianbing Shen, Ling Shao |
| 2019 | ICCV | Human-Aware Motion Deblurring. | Ziyi Shen, Wenguan Wang, Xiankai Lu, Jianbing Shen, Haibin Ling, Tingfa Xu, Ling Shao |
| 2019 | ICCV | Zero-Shot Video Object Segmentation via Attentive Graph Neural Networks. | Wenguan Wang, Xiankai Lu, Jianbing Shen, David J. Crandall, Ling Shao |
| 2019 | ICCV | Learning Compositional Neural Information Fusion for Human Parsing. | Wenguan Wang, Zhijie Zhang, Siyuan Qi, Jianbing Shen, Yanwei Pang, Ling Shao |
| 2019 | MICCAI | Inter-modality Dependence Induced Data Recovery for MCI Conversion Prediction. | Tao Zhou, Kim-Han Thung, Yu Zhang, Huazhu Fu, Jianbing Shen, Dinggang Shen, Ling Shao |
| 2019 | MICCAI | Evaluation of Retinal Image Quality Assessment Networks in Different Color-Spaces. | Huazhu Fu, Boyang Wang, Jianbing Shen, Shanshan Cui, Yanwu Xu, Jiang Liu, Ling Shao |
| 2019 | MICCAI | Extreme Points Derived Confidence Map as a Cue for Class-Agnostic Interactive Segmentation Using Deep Neural Network. | Shadab Khan, Ahmed H. Shahin, Javier Villafruela, Jianbing Shen, Ling Shao |
| 2019 | MICCAI | ET-Net: A Generic Edge-aTtention Guidance Network for Medical Image Segmentation. | Zhijie Zhang, Huazhu Fu, Hang Dai, Jianbing Shen, Yanwei Pang, Ling Shao |
| 2019 | MICCAI | Deep Multi-modal Latent Representation Learning for Automated Dementia Diagnosis. | Tao Zhou, Mingxia Liu, Huazhu Fu, Jun Wang, Jianbing Shen, Ling Shao, Dinggang Shen |
| 2018 | CVPR | Hyperparameter Optimization for Tracking With Continuous Deep Q-Learning. | Xingping Dong, Jianbing Shen, Wenguan Wang, Yu Liu, Ling Shao, Fatih Porikli |
| 2018 | CVPR | Salient Object Detection Driven by Fixation Prediction. | Wenguan Wang, Jianbing Shen, Xingping Dong, Ali Borji |
| 2018 | CVPR | Revisiting Video Saliency: A Large-Scale Benchmark and a New Model. | Wenguan Wang, Jianbing Shen, Fang Guo, Ming-Ming Cheng, Ali Borji |
| 2018 | CVPR | Attentive Fashion Grammar Network for Fashion Landmark Detection and Clothing Category Classification. | Wenguan Wang, Yuanlu Xu, Jianbing Shen, Song-Chun Zhu |
| 2018 | ECCV | Triplet Loss in Siamese Network for Object Tracking. | Xingping Dong, Jianbing Shen |
| 2018 | ECCV | Learning Human-Object Interactions by Graph Parsing Neural Networks. | Siyuan Qi, Wenguan Wang, Baoxiong Jia, Jianbing Shen, Song-Chun Zhu |
| 2018 | ECCV | Pyramid Dilated Deeper ConvLSTM for Video Salient Object Detection. | Hongmei Song, Wenguan Wang, Sanyuan Zhao, Jianbing Shen, Kin-Man Lam |
| 2017 | ICCV | Deep Cropping via Attention Box Prediction and Aesthetics Assessment. | Wenguan Wang, Jianbing Shen |
| 2017 | ICCV | Super-Trajectory for Video Segmentation. | Wenguan Wang, Jianbing Shen, Jianwen Xie, Fatih Porikli |
| 2015 | CVPR | Saliency-aware geodesic video object segmentation. | Wenguan Wang, Jianbing Shen, Fatih Porikli |
| 2015 | ICCV | Linearization to Nonlinear Learning for Visual Tracking. | Bo Ma, Hongwei Hu, Jianbing Shen, Yuping Zhang, Fatih Porikli |
| 2011 | CVPR | Intrinsic images using optimization. | Jianbing Shen, Xiaoshan Yang, Yunde Jia, Xuelong Li |
| 2010 | DICTA | Re-texturing by Intrinsic Video. | Xing Yan, Jianbing Shen, Ying He, Xiaoyang Mao |
| 2008 | CW | Real-Time Tone Mapping for High-Resolution HDR Images. | Hanli Zhao, Xiaogang Jin, Jianbing Shen |