| 2025 | AAAI | SSLFusion: Scale and Space Aligned Latent Fusion Model for Multimodal 3D Object Detection. | Bonan Ding, Jin Xie, Jing Nie, Jiale Cao |
| 2025 | CVPR | VideoGLaMM : A Large Multimodal Model for Pixel-Level Visual Grounding in Videos. | Shehan Munasinghe, Hanan Gani, Wenqi Zhu, Jiale Cao, Eric P. Xing, Fahad Shahbaz Khan, Salman H. Khan |
| 2025 | CVPR | Wavelet and Prototype Augmented Query-based Transformer for Pixel-level Surface Defect Detection. | Feng Yan, Xiaoheng Jiang, Yang Lu, Jiale Cao, Dong Chen, Mingliang Xu |
| 2025 | ICCV | CLIPeR: Hierarchically Improving Spatial Representation of CLIP for Open-Vocabulary Semantic Segmentation. | Lin Sun, Jiale Cao, Jin Xie, Xiaoheng Jiang, Yanwei Pang |
| 2025 | ICLR | Glad: A Streaming Scene Generator for Autonomous Driving. | Bin Xie, Yingfei Liu, Tiancai Wang, Jiale Cao, Xiangyu Zhang |
| 2025 | WACV | SGD: Street View Synthesis with Gaussian Splatting and Diffusion Prior. | Zhongrui Yu, Haoran Wang, Jinze Yang, Hanzhang Wang, Jiale Cao, Zhong Ji, Mingming Sun |
| 2024 | CEC | An Evolutionary Algorithm with Feasibility Tracking Strategy for Constrained Multi-Objective Optimization Problems. | Lei Yang, Jinglin Tian, Jiale Cao, Kangshun Li, Chaoda Peng |
| 2024 | CVPR | SED: A Simple Encoder-Decoder for Open-Vocabulary Semantic Segmentation. | Bin Xie, Jiale Cao, Jin Xie, Fahad Shahbaz Khan, Yanwei Pang |
| 2024 | MICCAI | DB-SAM: Delving into High Quality Universal Medical Image Segmentation. | Chao Qin, Jiale Cao, Huazhu Fu, Fahad Shahbaz Khan, Rao Muhammad Anwer |
| 2023 | MICCAI | A Spatial-Temporal Deformable Attention Based Framework for Breast Lesion Detection in Videos. | Chao Qin, Jiale Cao, Huazhu Fu, Rao Muhammad Anwer, Fahad Shahbaz Khan |
| 2022 | CVPR | PSTR: End-to-End One-Step Person Search With Transformers. | Jiale Cao, Yanwei Pang, Rao Muhammad Anwer, Hisham Cholakkal, Jin Xie, Mubarak Shah, Fahad Shahbaz Khan |
| 2022 | ECCV | Video Instance Segmentation via Multi-Scale Spatio-Temporal Split Attention Transformer. | Omkar Thawakar, Sanath Narayan, Jiale Cao, Hisham Cholakkal, Rao Muhammad Anwer, Muhammad Haris Khan, Salman Khan, Michael Felsberg, Fahad Shahbaz Khan |
| 2021 | AAAI | Co-mining: Self-Supervised Learning for Sparsely Annotated Object Detection. | Tiancai Wang, Tong Yang, Jiale Cao, Xiangyu Zhang |
| 2021 | CVPR | Track To Detect and Segment: An Online Multi-Object Tracker. | Jialian Wu, Jiale Cao, Liangchen Song, Yu Wang, Ming Yang, Junsong Yuan |
| 2020 | CVPR | D2Det: Towards High Quality Object Detection and Instance Segmentation. | Jiale Cao, Hisham Cholakkal, Rao Muhammad Anwer, Fahad Shahbaz Khan, Yanwei Pang, Ling Shao |
| 2020 | CVPR | NETNet: Neighbor Erasing and Transferring Network for Better Single Shot Object Detection. | Yazhao Li, Yanwei Pang, Jianbing Shen, Jiale Cao, Ling Shao |
| 2020 | ECCV | SipMask: Spatial Information Preservation for Fast Image and Video Instance Segmentation. | Jiale Cao, Rao Muhammad Anwer, Hisham Cholakkal, Fahad Shahbaz Khan, Yanwei Pang, Ling Shao |
| 2019 | CVPR | Triply Supervised Decoder Networks for Joint Detection and Segmentation. | Jiale Cao, Yanwei Pang, Xuelong Li |
| 2019 | ICCV | Hierarchical Shot Detector. | Jiale Cao, Yanwei Pang, Jungong Han, Xuelong Li |
| 2016 | CVPR | Pedestrian Detection Inspired by Appearance Constancy and Shape Symmetry. | Jiale Cao, Yanwei Pang, Xuelong Li |