Skip to content

Song Bai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

68

Venues

12

Active years

2014–2026

Best venue rank

A*

Where they publish

Papers

68 indexed papers, newest first.

YearVenueTitleAuthors
2026WACVLearning to Animate Images from A Few Videos to Portray Delicate Human Actions.Haoxin Li, Yingchen Yu, Qilong Wu, Hanwang Zhang, Song Bai, Boyang Li
2025CVPRPVUW 2025 Challenge Report: Advances in Pixel-level Understanding of Complex Videos in the Wild.Henghui Ding, Chang Liu, Nikhila Ravi, Shuting He, Yunchao Wei, Song Bai, Philip Torr
2025ICCVDescribe, Adapt and Combine: Empowering CLIP Encoders for Open-Set 3D Object Retrieval.Zhichuan Wang, Yang Zhou, Zhe Liu, Rui Yu, Song Bai, Yulong Wang, Xinwei He, Xiang Bai
2025ICCVTimeexpert: an Expert-Guided Video Llm for Video Temporal Grounding.Zuhao Yang, Yingchen Yu, Yunqing Zhao, Shijian Lu, Song Bai
2025ICCVVersatile Transition Generation with Image-to-Video Diffusion.Zuhao Yang, Jiahui Zhang, Yingchen Yu, Shijian Lu, Song Bai
2024CVPRDIRECT-3D: Learning Direct Text-to-3D Generation on Massive Noisy 3D Data.Qihao Liu, Yi Zhang, Song Bai, Adam Kortylewski, Alan L. Yuille
2024CVPRDragDiffusion: Harnessing Diffusion Models for Interactive Point-Based Image Editing.Yujun Shi, Chuhui Xue, Jun Hao Liew, Jiachun Pan, Hanshu Yan, Wenqing Zhang, Vincent Y. F. Tan, Song Bai
2024CVPRGeneral Object Foundation Model for Images and Videos at Scale.Junfeng Wu, Yi Jiang, Qihao Liu, Zehuan Yuan, Xiang Bai, Song Bai
2024ECCVPVUW 2024 Challenge on Complex Video Understanding: Methods and Results.Henghui Ding, Chang Liu, Yunchao Wei, Nikhila Ravi, Shuting He, Song Bai, Philip Torr, Deshui Miao, Xin Li, Zhenyu He, Yaowei Wang, Ming-Hsuan Yang, Zhensong Xu, Jiangtao Yao, Chengjing Wu, Ting Liu, Luoqi Liu, Xinyu Liu, Jing Zhang, Kexin Zhang, Yuting Yang, Licheng Jiao, Shuyuan Yang, Mingqi Gao, Jingnan Luo, Jinyu Yang, Jungong Han, Feng Zheng, Bin Cao, Yisi Zhang, Xuanxu Lin, Xingjian He, Bo Zhao, Jing Liu, Feiyu Pan, Hao Fang, Xiankai Lu
2024ECCVPartGLEE: A Foundation Model for Recognizing and Parsing Any Objects.Junyi Li, Junfeng Wu, Weizhi Zhao, Song Bai, Xiang Bai
2024ECCVFree-ATM: Harnessing Free Attention Masks for Representation Learning on Diffusion-Generated Images.David Junhao Zhang, Mutian Xu, Jay Zhangjie Wu, Chuhui Xue, Wenqing Zhang, Xiaoguang Han, Song Bai, Mike Zheng Shou
2024ICDEOn the Ecosystem of High-Definition (HD) Maps.Yuanjie Zhuy, Hussah Alrashid, Song Bai, Chunhan Zhang, Ziliang Zhang, Zhengyi Qu, Reem Y. Ali, Amr Magdy
2024ICLRDiscovering Failure Modes of Text-guided Diffusion Models via Adversarial Search.Qihao Liu, Adam Kortylewski, Yutong Bai, Song Bai, Alan L. Yuille
2023CVPRPLA: Language-Driven Open-Vocabulary 3D Scene Understanding.Runyu Ding, Jihan Yang, Chuhui Xue, Wenqing Zhang, Song Bai, Xiaojuan Qi
2023CVPRInstMove: Instance Motion for Object-centric Video Segmentation.Qihao Liu, Junfeng Wu, Yi Jiang, Xiang Bai, Alan L. Yuille, Song Bai
2023ICCVMOSE: A New Dataset for Video Object Segmentation in Complex Scenes.Henghui Ding, Chang Liu, Shuting He, Xudong Jiang, Philip H. S. Torr, Song Bai
2023ICCVSRFormer: Permuted Self-Attention for Single Image Super-Resolution.Yupeng Zhou, Zhen Li, Chun-Le Guo, Song Bai, Ming-Ming Cheng, Qibin Hou
2023ICLRIs Synthetic Data from Generative Models Ready for Image Recognition?Ruifei He, Shuyang Sun, Xin Yu, Chuhui Xue, Wenqing Zhang, Philip H. S. Torr, Song Bai, Xiaojuan Qi
2023ICLRTowards Understanding and Mitigating Dimensional Collapse in Heterogeneous Federated Learning.Yujun Shi, Jian Liang, Wenqing Zhang, Vincent Y. F. Tan, Song Bai
2023ICLRPV3D: A 3D Generative Model for Portrait Video Generation.Eric Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, Wenqing Zhang, Song Bai, Jiashi Feng, Mike Zheng Shou
2023IWCMCA network architecture for carrying terminal functions on 5G and 6G satellites.Jing Jia, Heng Nie, Song Bai, Xu Xia, Yanxia Xing, Yang Liu
2022CVPRYouMVOS: An Actor-centric Multi-shot Video Object Segmentation Dataset.Donglai Wei, Siddhant Kharbanda, Sarthak Arora, Roshan Roy, Nishant Jain, Akash Palrecha, Tanav Shah, Shray Mathur, Ritik Mathur, Abhijay Kemkar, Anirudh Srinivasan Chakravarthy, Zudi Lin, Won-Dong Jang, Yansong Tang, Song Bai, James Tompkin, Philip H. S. Torr, Hanspeter Pfister
2022CVPRTransMix: Attend to Mix for Vision Transformers.Jieneng Chen, Shuyang Sun, Ju He, Philip H. S. Torr, Alan L. Yuille, Song Bai
2022CVPRKnowledge Distillation as Efficient Pre-training: Faster Convergence, Higher Data-efficiency, and Better Transferability.Ruifei He, Shuyang Sun, Jihan Yang, Song Bai, Xiaojuan Qi
2022CVPRAn Empirical Study of End-to-End Temporal Action Detection.Xiaolong Liu, Song Bai, Xiang Bai
2022CVPRMimicking the Oracle: An Initial Phase Decorrelation Approach for Class Incremental Learning.Yujun Shi, Kuangqi Zhou, Jian Liang, Zihang Jiang, Jiashi Feng, Philip H. S. Torr, Song Bai, Vincent Y. F. Tan
2022CVPRDanceTrack: Multi-Object Tracking in Uniform Appearance and Diverse Motion.Peize Sun, Jinkun Cao, Yi Jiang, Zehuan Yuan, Song Bai, Kris Kitani, Ping Luo
2022CVPRFourier Document Restoration for Robust Document Dewarping and Recognition.Chuhui Xue, Zichen Tian, Fangneng Zhan, Shijian Lu, Song Bai
2022ECCVExplicit Occlusion Reasoning for Multi-person 3D Human Pose Estimation.Qihao Liu, Yi Zhang, Song Bai, Alan L. Yuille
2022ECCVSeqFormer: Sequential Transformer for Video Instance Segmentation.Junfeng Wu, Yi Jiang, Song Bai, Wenqing Zhang, Xiang Bai
2022ECCVIn Defense of Online Models for Video Instance Segmentation.Junfeng Wu, Qihao Liu, Yi Jiang, Song Bai, Alan L. Yuille, Xiang Bai
2022ECCVContextual Text Block Detection Towards Scene Text Understanding.Chuhui Xue, Jiaxing Huang, Wenqing Zhang, Shijian Lu, Changhu Wang, Song Bai
2022ECCVLanguage Matters: A Weakly Supervised Vision-Language Pre-training Approach for Scene Text Detection and Spotting.Chuhui Xue, Wenqing Zhang, Yu Hao, Shijian Lu, Philip H. S. Torr, Song Bai
2021CVPRMulti-Shot Temporal Event Localization: A Benchmark.Xiaolong Liu, Yao Hu, Song Bai, Fei Ding, Xiang Bai, Philip H. S. Torr
2021CVPRSwiftNet: Real-Time Video Object Segmentation.Haochen Wang, Xiaolong Jiang, Haibing Ren, Yao Hu, Song Bai
2021CVPRAnchor-Free Person Search.Yichao Yan, Jinpeng Li, Jie Qin, Song Bai, Shengcai Liao, Li Liu, Fan Zhu, Ling Shao
2021ICCVPlaneTR: Structure-Guided Transformers for 3D Plane Recovery.Bin Tan, Nan Xue, Song Bai, Tianfu Wu, Gui-Song Xia
2020AAAIImportance-Aware Semantic Segmentation in Self-Driving with Discrete Wasserstein Training.Xiaofeng Liu, Yuzhuo Han, Song Bai, Yi Ge, Tianxing Wang, Xu Han, Site Li, Jane You, Jun Lu
2020AAAILearning Transferable Adversarial Examples via Ghost Networks.Yingwei Li, Song Bai, Yuyin Zhou, Cihang Xie, Zhishuai Zhang, Alan L. Yuille
2020BMVCBipartite Graph Reasoning GANs for Person Image Generation.Hao Tang, Song Bai, Philip H. S. Torr, Nicu Sebe
2020CVPRNeural Architecture Search for Lightweight Non-Local Networks.Yingwei Li, Xiaojie Jin, Jieru Mei, Xiaochen Lian, Linjie Yang, Cihang Xie, Qihang Yu, Yuyin Zhou, Song Bai, Alan L. Yuille
2020CVPRHolistically-Attracted Wireframe Parsing.Nan Xue, Tianfu Wu, Song Bai, Fudong Wang, Gui-Song Xia, Liangpei Zhang, Philip H. S. Torr
2020ECCVCorner Proposal Network for Anchor-Free, Two-Stage Object Detection.Kaiwen Duan, Lingxi Xie, Honggang Qi, Song Bai, Qingming Huang, Qi Tian
2020ECCVRegional Homogeneity: Towards Learning Transferable Universal Adversarial Perturbations Against Defenses.Yingwei Li, Song Bai, Cihang Xie, Zhenyu Liao, Xiaohui Shen, Alan L. Yuille
2020ECCVXingGAN for Person Image Generation.Hao Tang, Song Bai, Li Zhang, Philip H. S. Torr, Nicu Sebe
2020ICRAInstance Segmentation of LiDAR Point Clouds.Feihu Zhang, Chenye Guan, Jin Fang, Song Bai, Ruigang Yang, Philip H. S. Torr, Victor Prisacariu
2019CVPRRe-Ranking via Metric Fusion for Object Retrieval and Person Re-Identification.Song Bai, Peng Tang, Philip H. S. Torr, Longin Jan Latecki
2019CVPRImproving Transferability of Adversarial Examples With Input Diversity.Cihang Xie, Zhishuai Zhang, Yuyin Zhou, Song Bai, Jianyu Wang, Zhou Ren, Alan L. Yuille
2019CVPRLearning Attraction Field Representation for Robust Line Segment Detection.Nan Xue, Song Bai, Fudong Wang, Gui-Song Xia, Tianfu Wu, Liangpei Zhang
2019ICCVCenterNet: Keypoint Triplets for Object Detection.Kaiwen Duan, Song Bai, Lingxi Xie, Honggang Qi, Qingming Huang, Qi Tian
2019ICCVView N-Gram Network for 3D Object Retrieval.Xinwei He, Tengteng Huang, Song Bai, Xiang Bai
2019ICCVLearn to Scale: Generating Multipolar Normalized Density Maps for Crowd Counting.Chenfeng Xu, Kai Qiu, Jianlong Fu, Song Bai, Yongchao Xu, Xiang Bai
2019ICCVSymmetry-Constrained Rectification Network for Scene Text Recognition.Mingkun Yang, Yushuo Guan, Minghui Liao, Xin He, Kaigui Bian, Song Bai, Cong Yao, Xiang Bai
2019ICCVAnchor Diffusion for Unsupervised Video Object Segmentation.Zhao Yang, Qiang Wang, Luca Bertinetto, Song Bai, Weiming Hu, Philip H. S. Torr
2019ICCVPrior-Aware Neural Network for Partially-Supervised Multi-Organ Segmentation.Yuyin Zhou, Zhe Li, Song Bai, Xinlei Chen, Mei Han, Chong Wang, Elliot K. Fishman, Alan L. Yuille
2019ICCVAsymmetric Non-Local Neural Networks for Semantic Segmentation.Zhen Zhu, Mengdu Xu, Song Bai, Tengteng Huang, Xiang Bai
2019WACVSemi-Supervised 3D Abdominal Multi-Organ Segmentation Via Deep Multi-Planar Co-Training.Yuyin Zhou, Yan Wang, Peng Tang, Song Bai, Wei Shen, Elliot K. Fishman, Alan L. Yuille
2018CVPRTriplet-Center Loss for Multi-View 3D Object Retrieval.Xinwei He, Yang Zhou, Zhichao Zhou, Song Bai, Xiang Bai
2018ECCVHard-Aware Point-to-Set Deep Metric for Person Re-identification.Rui Yu, Zhiyong Dou, Song Bai, Zhaoxiang Zhang, Yongchao Xu, Xiang Bai
2017AAAIMultidimensional Scaling on Multiple Input Distance Matrices.Song Bai, Xiang Bai, Longin Jan Latecki, Qi Tian
2017AAAIRegularized Diffusion Process for Visual Retrieval.Song Bai, Xiang Bai, Qi Tian, Longin Jan Latecki
2017BMVCDivide and Fuse: A Re-ranking Approach for Person Re-identification.Rui Yu, Zhichao Zhou, Song Bai, Xiang Bai
2017CVPRScalable Person Re-identification on Supervised Smoothed Manifold.Song Bai, Xiang Bai, Qi Tian
2017ICCVEnsemble Diffusion for Retrieval.Song Bai, Zhichao Zhou, Jingdong Wang, Xiang Bai, Longin Jan Latecki, Qi Tian
2016CVPRGIFT: A Real-Time and Scalable 3D Shape Search Engine.Song Bai, Xiang Bai, Zhichao Zhou, Zhaoxiang Zhang, Longin Jan Latecki
2016ECCVSmooth Neighborhood Structure Mining on Multiple Affinity Graphs with Applications to Context-Sensitive Similarity.Song Bai, Shaoyan Sun, Xiang Bai, Zhaoxiang Zhang, Qi Tian
2014ACCVMultiple Stage Residual Model for Accurate Image Classification.Song Bai, Xinggang Wang, Cong Yao, Xiang Bai
2014ICIPAggregating contour fragments for shape classification.Song Bai, Xinggang Wang, Xiang Bai