| 2025 | CVPR | See Further When Clear: Curriculum Consistency Model. | Yunpeng Liu, Boxiao Liu, Yi Zhang, Xingzhong Hou, Guanglu Song, Yu Liu, Haihang You |
| 2025 | ICLR | MMSearch: Unveiling the Potential of Large Models as Multi-modal Search Engines. | Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanmin Wu, Jiayi Lei, Pengshuo Qiu, Pan Lu, Zehui Chen, Guanglu Song, Peng Gao, Yu Liu, Chunyuan Li, Hongsheng Li |
| 2025 | ICML | EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM. | Zhuofan Zong, Dongzhi Jiang, Bingqi Ma, Guanglu Song, Hao Shao, Dazhong Shen, Yu Liu, Hongsheng Li |
| 2025 | ICRA | Robo-MUTUAL: Robotic Multimodal Task Specification via Unimodal Learning. | Jianxiong Li, Zhihao Wang, Jinliang Zheng, Xiaoai Zhou, Guanming Wang, Guanglu Song, Yu Liu, Jingjing Liu, Ya-Qin Zhang, Junzhi Yu, Xianyuan Zhan |
| 2024 | CVPR | LMDrive: Closed-Loop End-to-End Driving with Large Language Models. | Hao Shao, Yuxuan Hu, Letian Wang, Guanglu Song, Steven L. Waslander, Yu Liu, Hongsheng Li |
| 2024 | CVPR | Rethinking the Spatial Inconsistency in Classifier-Free Diffusion Guidance. | Dazhong Shen, Guanglu Song, Zeyue Xue, Fu-Yun Wang, Yu Liu |
| 2024 | ECCV | FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis. | Linjiang Huang, Rongyao Fang, Aiping Zhang, Guanglu Song, Si Liu, Yu Liu, Hongsheng Li |
| 2024 | ECCV | ZoLA: Zero-Shot Creative Long Animation Generation with Short Video Model. | Fu-Yun Wang, Zhaoyang Huang, Qiang Ma, Guanglu Song, Xudong Lu, Weikang Bian, Yijin Li, Yu Liu, Hongsheng Li |
| 2024 | ECCV | Be-Your-Outpainter: Mastering Video Outpainting Through Input-Specific Adaptation. | Fu-Yun Wang, Xiaoshi Wu, Zhaoyang Huang, Xiaoyu Shi, Dazhong Shen, Guanglu Song, Yu Liu, Hongsheng Li |
| 2024 | ECCV | Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models. | Xiaoshi Wu, Yiming Hao, Manyuan Zhang, Keqiang Sun, Zhaoyang Huang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2024 | ECCV | Three Things We Need to Know About Transferring Stable Diffusion to Visual Dense Prediction Tasks. | Manyuan Zhang, Guanglu Song, Xiaoyu Shi, Yu Liu, Hongsheng Li |
| 2024 | SiggraphA | AnimateLCM: Computation-Efficient Personalized Style Video Generation without Personalized Video Data. | Fu-Yun Wang, Zhaoyang Huang, Weikang Bian, Xiaoyu Shi, Keqiang Sun, Guanglu Song, Yu Liu, Hongsheng Li |
| 2023 | ICCV | UniKD: Universal Knowledge Distillation for Mimicking Homogeneous or Heterogeneous Object Detectors. | Shanshan Lao, Guanglu Song, Boxiao Liu, Yu Liu, Yujiu Yang |
| 2023 | ICCV | Masked Autoencoders Are Stronger Knowledge Distillers. | Shanshan Lao, Guanglu Song, Boxiao Liu, Yu Liu, Yujiu Yang |
| 2023 | ICCV | Decoupled DETR: Spatially Disentangling Localization and Classification for Improved End-to-End Object Detection. | Manyuan Zhang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2023 | ICCV | Temporal Enhanced Training of Multi-view 3D Object Detector via Historical Object Prediction. | Zhuofan Zong, Dongzhi Jiang, Guanglu Song, Zeyue Xue, Jingyong Su, Hongsheng Li, Yu Liu |
| 2023 | ICCV | DETRs with Collaborative Hybrid Assignments Training. | Zhuofan Zong, Guanglu Song, Yu Liu |
| 2022 | ECCV | Unifying Visual Perception by Dispersible Points Learning. | Jianming Liang, Guanglu Song, Biao Leng, Yu Liu |
| 2022 | ECCV | UniNet: Unified Architecture Search with Convolution, Transformer, and MLP. | Jihao Liu, Xin Huang, Guanglu Song, Hongsheng Li, Yu Liu |
| 2022 | ECCV | Rethinking Robust Representation Learning Under Fine-Grained Noisy Faces. | Bingqi Ma, Guanglu Song, Boxiao Liu, Yu Liu |
| 2022 | ECCV | Towards Robust Face Recognition with Comprehensive Search. | Manyuan Zhang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2022 | ECCV | Self-slimmed Vision Transformer. | Zhuofan Zong, Kunchang Li, Guanglu Song, Yali Wang, Yu Qiao, Biao Leng, Yu Liu |
| 2022 | ICLR | UniFormer: Unified Transformer for Efficient Spatial-Temporal Representation Learning. | Kunchang Li, Yali Wang, Peng Gao, Guanglu Song, Yu Liu, Hongsheng Li, Yu Qiao |
| 2021 | ICCV | Switchable K-class Hyperplanes for Noise-Robust Representation Learning. | Boxiao Liu, Guanglu Song, Manyuan Zhang, Haihang You, Yu Liu |
| 2021 | ICIP | PCNET: Parallelly Conquer the Large Variance of Person Re-Identification. | Jianyuan Wang, Meiyue You, Biao Leng, Ming Jiang, Guanglu Song |
| 2021 | ICONIP | Scale Semantic Flow Preserving Across Image Pyramid. | Zhili Lin, Guanglu Song, Biao Leng |
| 2020 | AAAI | KPNet: Towards Minimal Face Detector. | Guanglu Song, Yu Liu, Yuhang Zang, Xiaogang Wang, Biao Leng, Qingsheng Yuan |
| 2020 | CVPR | Revisiting the Sibling Head in Object Detector. | Guanglu Song, Yu Liu, Xiaogang Wang |
| 2020 | ECCV | Discriminability Distillation in Group Representation Learning. | Manyuan Zhang, Guanglu Song, Hang Zhou, Yu Liu |
| 2018 | AAAI | Region-Based Quality Estimation Network for Large-Scale Person Re-Identification. | Guanglu Song, Biao Leng, Yu Liu, Congrui Hetang, Shaofan Cai |
| 2018 | CVPR | Beyond Trade-Off: Accelerate FCN-Based Face Detector With Higher Accuracy. | Guanglu Song, Yu Liu, Ming Jiang, Yujie Wang, Junjie Yan, Biao Leng |
| 2018 | ECCV | Transductive Centroid Projection for Semi-supervised Large-Scale Recognition. | Yu Liu, Guanglu Song, Jing Shao, Xiao Jin, Xiaogang Wang |
| 2018 | ICONIP | Fast Portrait Matting Using Spatial Detail-Preserving Network. | Shaofan Cai, Biao Leng, Guanglu Song, Zheng Ge |
| 2017 | ICANN | A Multi-level Weighted Representation for Person Re-identification. | Xianglai Meng, Biao Leng, Guanglu Song |
| 2017 | ICONIP | Spatial Quality Aware Network for Video-Based Person Re-identification. | Yujie Wang, Biao Leng, Guanglu Song |