Song Bai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
68
Venues
12
Active years
2014–2026
Best venue rank
A*
Where they publish
Papers
68 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | WACV | Learning to Animate Images from A Few Videos to Portray Delicate Human Actions. | Haoxin Li, Yingchen Yu, Qilong Wu, Hanwang Zhang, Song Bai, Boyang Li |
| 2025 | CVPR | PVUW 2025 Challenge Report: Advances in Pixel-level Understanding of Complex Videos in the Wild. | Henghui Ding, Chang Liu, Nikhila Ravi, Shuting He, Yunchao Wei, Song Bai, Philip Torr |
| 2025 | ICCV | Describe, Adapt and Combine: Empowering CLIP Encoders for Open-Set 3D Object Retrieval. | Zhichuan Wang, Yang Zhou, Zhe Liu, Rui Yu, Song Bai, Yulong Wang, Xinwei He, Xiang Bai |
| 2025 | ICCV | Timeexpert: an Expert-Guided Video Llm for Video Temporal Grounding. | Zuhao Yang, Yingchen Yu, Yunqing Zhao, Shijian Lu, Song Bai |
| 2025 | ICCV | Versatile Transition Generation with Image-to-Video Diffusion. | Zuhao Yang, Jiahui Zhang, Yingchen Yu, Shijian Lu, Song Bai |
| 2024 | CVPR | DIRECT-3D: Learning Direct Text-to-3D Generation on Massive Noisy 3D Data. | Qihao Liu, Yi Zhang, Song Bai, Adam Kortylewski, Alan L. Yuille |
| 2024 | CVPR | DragDiffusion: Harnessing Diffusion Models for Interactive Point-Based Image Editing. | Yujun Shi, Chuhui Xue, Jun Hao Liew, Jiachun Pan, Hanshu Yan, Wenqing Zhang, Vincent Y. F. Tan, Song Bai |
| 2024 | CVPR | General Object Foundation Model for Images and Videos at Scale. | Junfeng Wu, Yi Jiang, Qihao Liu, Zehuan Yuan, Xiang Bai, Song Bai |
| 2024 | ECCV | PVUW 2024 Challenge on Complex Video Understanding: Methods and Results. | Henghui Ding, Chang Liu, Yunchao Wei, Nikhila Ravi, Shuting He, Song Bai, Philip Torr, Deshui Miao, Xin Li, Zhenyu He, Yaowei Wang, Ming-Hsuan Yang, Zhensong Xu, Jiangtao Yao, Chengjing Wu, Ting Liu, Luoqi Liu, Xinyu Liu, Jing Zhang, Kexin Zhang, Yuting Yang, Licheng Jiao, Shuyuan Yang, Mingqi Gao, Jingnan Luo, Jinyu Yang, Jungong Han, Feng Zheng, Bin Cao, Yisi Zhang, Xuanxu Lin, Xingjian He, Bo Zhao, Jing Liu, Feiyu Pan, Hao Fang, Xiankai Lu |
| 2024 | ECCV | PartGLEE: A Foundation Model for Recognizing and Parsing Any Objects. | Junyi Li, Junfeng Wu, Weizhi Zhao, Song Bai, Xiang Bai |
| 2024 | ECCV | Free-ATM: Harnessing Free Attention Masks for Representation Learning on Diffusion-Generated Images. | David Junhao Zhang, Mutian Xu, Jay Zhangjie Wu, Chuhui Xue, Wenqing Zhang, Xiaoguang Han, Song Bai, Mike Zheng Shou |
| 2024 | ICDE | On the Ecosystem of High-Definition (HD) Maps. | Yuanjie Zhuy, Hussah Alrashid, Song Bai, Chunhan Zhang, Ziliang Zhang, Zhengyi Qu, Reem Y. Ali, Amr Magdy |
| 2024 | ICLR | Discovering Failure Modes of Text-guided Diffusion Models via Adversarial Search. | Qihao Liu, Adam Kortylewski, Yutong Bai, Song Bai, Alan L. Yuille |
| 2023 | CVPR | PLA: Language-Driven Open-Vocabulary 3D Scene Understanding. | Runyu Ding, Jihan Yang, Chuhui Xue, Wenqing Zhang, Song Bai, Xiaojuan Qi |
| 2023 | CVPR | InstMove: Instance Motion for Object-centric Video Segmentation. | Qihao Liu, Junfeng Wu, Yi Jiang, Xiang Bai, Alan L. Yuille, Song Bai |
| 2023 | ICCV | MOSE: A New Dataset for Video Object Segmentation in Complex Scenes. | Henghui Ding, Chang Liu, Shuting He, Xudong Jiang, Philip H. S. Torr, Song Bai |
| 2023 | ICCV | SRFormer: Permuted Self-Attention for Single Image Super-Resolution. | Yupeng Zhou, Zhen Li, Chun-Le Guo, Song Bai, Ming-Ming Cheng, Qibin Hou |
| 2023 | ICLR | Is Synthetic Data from Generative Models Ready for Image Recognition? | Ruifei He, Shuyang Sun, Xin Yu, Chuhui Xue, Wenqing Zhang, Philip H. S. Torr, Song Bai, Xiaojuan Qi |
| 2023 | ICLR | Towards Understanding and Mitigating Dimensional Collapse in Heterogeneous Federated Learning. | Yujun Shi, Jian Liang, Wenqing Zhang, Vincent Y. F. Tan, Song Bai |
| 2023 | ICLR | PV3D: A 3D Generative Model for Portrait Video Generation. | Eric Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, Wenqing Zhang, Song Bai, Jiashi Feng, Mike Zheng Shou |
| 2023 | IWCMC | A network architecture for carrying terminal functions on 5G and 6G satellites. | Jing Jia, Heng Nie, Song Bai, Xu Xia, Yanxia Xing, Yang Liu |
| 2022 | CVPR | YouMVOS: An Actor-centric Multi-shot Video Object Segmentation Dataset. | Donglai Wei, Siddhant Kharbanda, Sarthak Arora, Roshan Roy, Nishant Jain, Akash Palrecha, Tanav Shah, Shray Mathur, Ritik Mathur, Abhijay Kemkar, Anirudh Srinivasan Chakravarthy, Zudi Lin, Won-Dong Jang, Yansong Tang, Song Bai, James Tompkin, Philip H. S. Torr, Hanspeter Pfister |
| 2022 | CVPR | TransMix: Attend to Mix for Vision Transformers. | Jieneng Chen, Shuyang Sun, Ju He, Philip H. S. Torr, Alan L. Yuille, Song Bai |
| 2022 | CVPR | Knowledge Distillation as Efficient Pre-training: Faster Convergence, Higher Data-efficiency, and Better Transferability. | Ruifei He, Shuyang Sun, Jihan Yang, Song Bai, Xiaojuan Qi |
| 2022 | CVPR | An Empirical Study of End-to-End Temporal Action Detection. | Xiaolong Liu, Song Bai, Xiang Bai |
| 2022 | CVPR | Mimicking the Oracle: An Initial Phase Decorrelation Approach for Class Incremental Learning. | Yujun Shi, Kuangqi Zhou, Jian Liang, Zihang Jiang, Jiashi Feng, Philip H. S. Torr, Song Bai, Vincent Y. F. Tan |
| 2022 | CVPR | DanceTrack: Multi-Object Tracking in Uniform Appearance and Diverse Motion. | Peize Sun, Jinkun Cao, Yi Jiang, Zehuan Yuan, Song Bai, Kris Kitani, Ping Luo |
| 2022 | CVPR | Fourier Document Restoration for Robust Document Dewarping and Recognition. | Chuhui Xue, Zichen Tian, Fangneng Zhan, Shijian Lu, Song Bai |
| 2022 | ECCV | Explicit Occlusion Reasoning for Multi-person 3D Human Pose Estimation. | Qihao Liu, Yi Zhang, Song Bai, Alan L. Yuille |
| 2022 | ECCV | SeqFormer: Sequential Transformer for Video Instance Segmentation. | Junfeng Wu, Yi Jiang, Song Bai, Wenqing Zhang, Xiang Bai |
| 2022 | ECCV | In Defense of Online Models for Video Instance Segmentation. | Junfeng Wu, Qihao Liu, Yi Jiang, Song Bai, Alan L. Yuille, Xiang Bai |
| 2022 | ECCV | Contextual Text Block Detection Towards Scene Text Understanding. | Chuhui Xue, Jiaxing Huang, Wenqing Zhang, Shijian Lu, Changhu Wang, Song Bai |
| 2022 | ECCV | Language Matters: A Weakly Supervised Vision-Language Pre-training Approach for Scene Text Detection and Spotting. | Chuhui Xue, Wenqing Zhang, Yu Hao, Shijian Lu, Philip H. S. Torr, Song Bai |
| 2021 | CVPR | Multi-Shot Temporal Event Localization: A Benchmark. | Xiaolong Liu, Yao Hu, Song Bai, Fei Ding, Xiang Bai, Philip H. S. Torr |
| 2021 | CVPR | SwiftNet: Real-Time Video Object Segmentation. | Haochen Wang, Xiaolong Jiang, Haibing Ren, Yao Hu, Song Bai |
| 2021 | CVPR | Anchor-Free Person Search. | Yichao Yan, Jinpeng Li, Jie Qin, Song Bai, Shengcai Liao, Li Liu, Fan Zhu, Ling Shao |
| 2021 | ICCV | PlaneTR: Structure-Guided Transformers for 3D Plane Recovery. | Bin Tan, Nan Xue, Song Bai, Tianfu Wu, Gui-Song Xia |
| 2020 | AAAI | Importance-Aware Semantic Segmentation in Self-Driving with Discrete Wasserstein Training. | Xiaofeng Liu, Yuzhuo Han, Song Bai, Yi Ge, Tianxing Wang, Xu Han, Site Li, Jane You, Jun Lu |
| 2020 | AAAI | Learning Transferable Adversarial Examples via Ghost Networks. | Yingwei Li, Song Bai, Yuyin Zhou, Cihang Xie, Zhishuai Zhang, Alan L. Yuille |
| 2020 | BMVC | Bipartite Graph Reasoning GANs for Person Image Generation. | Hao Tang, Song Bai, Philip H. S. Torr, Nicu Sebe |
| 2020 | CVPR | Neural Architecture Search for Lightweight Non-Local Networks. | Yingwei Li, Xiaojie Jin, Jieru Mei, Xiaochen Lian, Linjie Yang, Cihang Xie, Qihang Yu, Yuyin Zhou, Song Bai, Alan L. Yuille |
| 2020 | CVPR | Holistically-Attracted Wireframe Parsing. | Nan Xue, Tianfu Wu, Song Bai, Fudong Wang, Gui-Song Xia, Liangpei Zhang, Philip H. S. Torr |
| 2020 | ECCV | Corner Proposal Network for Anchor-Free, Two-Stage Object Detection. | Kaiwen Duan, Lingxi Xie, Honggang Qi, Song Bai, Qingming Huang, Qi Tian |
| 2020 | ECCV | Regional Homogeneity: Towards Learning Transferable Universal Adversarial Perturbations Against Defenses. | Yingwei Li, Song Bai, Cihang Xie, Zhenyu Liao, Xiaohui Shen, Alan L. Yuille |
| 2020 | ECCV | XingGAN for Person Image Generation. | Hao Tang, Song Bai, Li Zhang, Philip H. S. Torr, Nicu Sebe |
| 2020 | ICRA | Instance Segmentation of LiDAR Point Clouds. | Feihu Zhang, Chenye Guan, Jin Fang, Song Bai, Ruigang Yang, Philip H. S. Torr, Victor Prisacariu |
| 2019 | CVPR | Re-Ranking via Metric Fusion for Object Retrieval and Person Re-Identification. | Song Bai, Peng Tang, Philip H. S. Torr, Longin Jan Latecki |
| 2019 | CVPR | Improving Transferability of Adversarial Examples With Input Diversity. | Cihang Xie, Zhishuai Zhang, Yuyin Zhou, Song Bai, Jianyu Wang, Zhou Ren, Alan L. Yuille |
| 2019 | CVPR | Learning Attraction Field Representation for Robust Line Segment Detection. | Nan Xue, Song Bai, Fudong Wang, Gui-Song Xia, Tianfu Wu, Liangpei Zhang |
| 2019 | ICCV | CenterNet: Keypoint Triplets for Object Detection. | Kaiwen Duan, Song Bai, Lingxi Xie, Honggang Qi, Qingming Huang, Qi Tian |
| 2019 | ICCV | View N-Gram Network for 3D Object Retrieval. | Xinwei He, Tengteng Huang, Song Bai, Xiang Bai |
| 2019 | ICCV | Learn to Scale: Generating Multipolar Normalized Density Maps for Crowd Counting. | Chenfeng Xu, Kai Qiu, Jianlong Fu, Song Bai, Yongchao Xu, Xiang Bai |
| 2019 | ICCV | Symmetry-Constrained Rectification Network for Scene Text Recognition. | Mingkun Yang, Yushuo Guan, Minghui Liao, Xin He, Kaigui Bian, Song Bai, Cong Yao, Xiang Bai |
| 2019 | ICCV | Anchor Diffusion for Unsupervised Video Object Segmentation. | Zhao Yang, Qiang Wang, Luca Bertinetto, Song Bai, Weiming Hu, Philip H. S. Torr |
| 2019 | ICCV | Prior-Aware Neural Network for Partially-Supervised Multi-Organ Segmentation. | Yuyin Zhou, Zhe Li, Song Bai, Xinlei Chen, Mei Han, Chong Wang, Elliot K. Fishman, Alan L. Yuille |
| 2019 | ICCV | Asymmetric Non-Local Neural Networks for Semantic Segmentation. | Zhen Zhu, Mengdu Xu, Song Bai, Tengteng Huang, Xiang Bai |
| 2019 | WACV | Semi-Supervised 3D Abdominal Multi-Organ Segmentation Via Deep Multi-Planar Co-Training. | Yuyin Zhou, Yan Wang, Peng Tang, Song Bai, Wei Shen, Elliot K. Fishman, Alan L. Yuille |
| 2018 | CVPR | Triplet-Center Loss for Multi-View 3D Object Retrieval. | Xinwei He, Yang Zhou, Zhichao Zhou, Song Bai, Xiang Bai |
| 2018 | ECCV | Hard-Aware Point-to-Set Deep Metric for Person Re-identification. | Rui Yu, Zhiyong Dou, Song Bai, Zhaoxiang Zhang, Yongchao Xu, Xiang Bai |
| 2017 | AAAI | Multidimensional Scaling on Multiple Input Distance Matrices. | Song Bai, Xiang Bai, Longin Jan Latecki, Qi Tian |
| 2017 | AAAI | Regularized Diffusion Process for Visual Retrieval. | Song Bai, Xiang Bai, Qi Tian, Longin Jan Latecki |
| 2017 | BMVC | Divide and Fuse: A Re-ranking Approach for Person Re-identification. | Rui Yu, Zhichao Zhou, Song Bai, Xiang Bai |
| 2017 | CVPR | Scalable Person Re-identification on Supervised Smoothed Manifold. | Song Bai, Xiang Bai, Qi Tian |
| 2017 | ICCV | Ensemble Diffusion for Retrieval. | Song Bai, Zhichao Zhou, Jingdong Wang, Xiang Bai, Longin Jan Latecki, Qi Tian |
| 2016 | CVPR | GIFT: A Real-Time and Scalable 3D Shape Search Engine. | Song Bai, Xiang Bai, Zhichao Zhou, Zhaoxiang Zhang, Longin Jan Latecki |
| 2016 | ECCV | Smooth Neighborhood Structure Mining on Multiple Affinity Graphs with Applications to Context-Sensitive Similarity. | Song Bai, Shaoyan Sun, Xiang Bai, Zhaoxiang Zhang, Qi Tian |
| 2014 | ACCV | Multiple Stage Residual Model for Accurate Image Classification. | Song Bai, Xinggang Wang, Cong Yao, Xiang Bai |
| 2014 | ICIP | Aggregating contour fragments for shape classification. | Song Bai, Xinggang Wang, Xiang Bai |