| 2026 | AAAI | Personalize Anything for Free with Diffusion Transformer. | Haoran Feng, Zehuan Huang, Lin Li, Lu Sheng |
| 2026 | AAAI | IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks. | Xiaoya Lu, Zeren Chen, Xuhao Hu, Yijin Zhou, Weichen Zhang, Dongrui Liu, Lu Sheng, Jing Shao |
| 2026 | AAAI | InterMoE: Individual-Specific 3D Human Interaction Generation via Dynamic Temporal-Selective MoE. | Lipeng Wang, Hongxing Fan, Haohua Chen, Zehuan Huang, Lu Sheng |
| 2025 | CVPR | MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation. | Zehuan Huang, Yuan-Chen Guo, Xingqiao An, Yunhan Yang, Yangguang Li, Zi-Xin Zou, Ding Liang, Xihui Liu, Yan-Pei Cao, Lu Sheng |
| 2025 | CVPR | T2ISafety: Benchmark for Assessing Fairness, Toxicity, and Privacy in Image Generation. | Lijun Li, Zhelun Shi, Xuhao Hu, Bowen Dong, Yiran Qin, Xihui Liu, Lu Sheng, Jing Shao |
| 2025 | CVPR | Ouroboros3D: Image-to-3D Generation via 3D-aware Recursive Diffusion. | Hao Wen, Zehuan Huang, Yaohui Wang, Xinyuan Chen, Lu Sheng |
| 2025 | CVPR | Code-as-Monitor: Constraint-aware Visual Programming for Reactive and Proactive Robotic Failure Detection. | Enshen Zhou, Qi Su, Cheng Chi, Zhizheng Zhang, Zhongyuan Wang, Tiejun Huang, Lu Sheng, He Wang |
| 2025 | ICCV | Mv-Adapter: Multi-View Consistent Image Generation Made Easy. | Zehuan Huang, Yuan-Chen Guo, Haoran Wang, Ran Yi, Lizhuang Ma, Yan-Pei Cao, Lu Sheng |
| 2025 | ICML | WorldSimBench: Towards Video Generation Models as World Simulators. | Yiran Qin, Zhelun Shi, Jiwen Yu, Xijun Wang, Enshen Zhou, Lijun Li, Zhenfei Yin, Xihui Liu, Lu Sheng, Jing Shao, Lei Bai, Ruimao Zhang |
| 2025 | IROS | RH20T-P: A Primitive-Level Robotic Manipulation Dataset towards Composable Generalization Agents in Real-world Scenarios. | Zeren Chen, Zhelun Shi, Xiaoya Lu, Lehan He, Sucheng Qian, Enshen Zhou, Zhenfei Yin, Wanli Ouyang, Jing Shao, Yu Qiao, Cewu Lu, Lu Sheng |
| 2025 | IROS | Chain-of-Imagination for Reliable Instruction Following in Decision Making. | Enshen Zhou, Yiran Qin, Zhenfei Yin, Zhelun Shi, Yuzhou Huang, Ruimao Zhang, Lu Sheng, Jing Shao |
| 2025 | SiggraphA | AnimaX: Animating the Inanimate in 3D with Joint Video-Pose Diffusion Models. | Zehuan Huang, Haoran Feng, Yang-Tian Sun, Yuan-Chen Guo, Yan-Pei Cao, Lu Sheng |
| 2024 | AAAI | Multi-Modality Affinity Inference for Weakly Supervised 3D Semantic Segmentation. | Xiawei Li, Qingyuan Xu, Jing Zhang, Tianyi Zhang, Qian Yu, Lu Sheng, Dong Xu |
| 2024 | AAAI | Data-Free Generalized Zero-Shot Learning. | Bowen Tang, Jing Zhang, Long Yan, Qian Yu, Lu Sheng, Dong Xu |
| 2024 | CVPR | EpiDiff: Enhancing Multi-View Synthesis via Localized Epipolar-Constrained Diffusion. | Zehuan Huang, Hao Wen, Junting Dong, Yaohui Wang, Yangguang Li, Xinyuan Chen, Yan-Pei Cao, Ding Liang, Yu Qiao, Bo Dai, Lu Sheng |
| 2024 | CVPR | MP5: A Multi-modal Open-ended Embodied System in Minecraft via Active Perception. | Yiran Qin, Enshen Zhou, Qichang Liu, Zhenfei Yin, Lu Sheng, Ruimao Zhang, Yu Qiao, Jing Shao |
| 2024 | ICLR | Octavius: Mitigating Task Interference in MLLMs via LoRA-MoE. | Zeren Chen, Ziqin Wang, Zhen Wang, Huayang Liu, Zhenfei Yin, Si Liu, Lu Sheng, Wanli Ouyang, Jing Shao |
| 2024 | IJCAI | Self-Supervised Monocular Depth Estimation in the Dark: Towards Data Distribution Compensation. | Haolin Yang, Chaoqiang Zhao, Lu Sheng, Yang Tang |
| 2023 | CVPR | Siamese DETR. | Zeren Chen, Gengshi Huang, Wei Li, Jianing Teng, Kun Wang, Jing Shao, Chen Change Loy, Lu Sheng |
| 2023 | CVPR | VL-SAT: Visual-Linguistic Semantics Assisted Training for 3D Semantic Scene Graph Prediction in Point Cloud. | Ziqin Wang, Bowen Cheng, Lichen Zhao, Dong Xu, Yang Tang, Lu Sheng |
| 2022 | AAAI | DanceFormer: Music Conditioned 3D Dance Generation with Parametric Motion Transformer. | Buyu Li, Yongchi Zhao, Zhelun Shi, Lu Sheng |
| 2022 | CVPR | 3DJCG: A Unified Framework for Joint Dense Captioning and Visual Grounding on 3D Point Clouds. | Daigang Cai, Lichen Zhao, Jing Zhang, Lu Sheng, Dong Xu |
| 2022 | ECCV | SketchSampler: Sketch-Based 3D Reconstruction via View-Dependent Depth Sampling. | Chenjian Gao, Qian Yu, Lu Sheng, Yi-Zhe Song, Dong Xu |
| 2022 | ECCV | X-Learner: Learning Cross Sources and Tasks for Universal Visual Representation. | Yinan He, Gengshi Huang, Siyu Chen, Jianing Teng, Kun Wang, Zhenfei Yin, Lu Sheng, Ziwei Liu, Yu Qiao, Jing Shao |
| 2022 | ECCV | Improving RGB-D Point Cloud Registration by Learning Multi-scale Local Linear Transformation. | Ziming Wang, Xiaoliang Huo, Zhenghao Chen, Jing Zhang, Lu Sheng, Dong Xu |
| 2021 | CVPR | Back-Tracing Representative Points for Voting-Based 3D Object Detection in Point Clouds. | Bowen Cheng, Lu Sheng, Shaoshuai Shi, Ming Yang, Dong Xu |
| 2021 | CVPR | ForgeryNet: A Versatile Benchmark for Comprehensive Forgery Analysis. | Yinan He, Bei Gan, Siyu Chen, Yichun Zhou, Guojun Yin, Luchuan Song, Lu Sheng, Jing Shao, Ziwei Liu |
| 2021 | ICCV | StyleFormer: Real-time Arbitrary Style Transfer via Parametric Style Composition. | Xiaolei Wu, Zhihao Hu, Lu Sheng, Dong Xu |
| 2021 | ICCV | 3DVG-Transformer: Relation Modeling for Visual Grounding on Point Clouds. | Lichen Zhao, Daigang Cai, Lu Sheng, Dong Xu |
| 2021 | WACV | IncreACO: Incrementally Learned Automatic Check-out with Photorealistic Exemplar Augmentation. | Yandan Yang, Lu Sheng, Xiaolong Jiang, Haochen Wang, Dong Xu, Xianbin Cao |
| 2020 | AAAI | Morphing and Sampling Network for Dense Point Cloud Completion. | Minghua Liu, Lu Sheng, Sheng Yang, Jing Shao, Shi-Min Hu |
| 2020 | ECCV | Powering One-Shot Topological NAS with Stabilized Share-Parameter Proxy. | Ronghao Guo, Chen Lin, Chuming Li, Keyu Tian, Ming Sun, Lu Sheng, Junjie Yan |
| 2020 | ECCV | Thinking in Frequency: Face Forgery Detection by Mining Frequency-Aware Clues. | Yuyang Qian, Guojun Yin, Lu Sheng, Zixuan Chen, Jing Shao |
| 2019 | CVPR | GS3D: An Efficient 3D Object Detection Framework for Autonomous Driving. | Buyu Li, Wanli Ouyang, Lu Sheng, Xingyu Zeng, Xiaogang Wang |
| 2019 | CVPR | Video Generation From Single Semantic Label Map. | Junting Pan, Chengyu Wang, Xu Jia, Jing Shao, Lu Sheng, Junjie Yan, Xiaogang Wang |
| 2019 | CVPR | Semantics Disentangling for Text-To-Image Generation. | Guojun Yin, Bin Liu, Lu Sheng, Nenghai Yu, Xiaogang Wang, Jing Shao |
| 2019 | CVPR | Context and Attribute Grounded Dense Captioning. | Guojun Yin, Lu Sheng, Bin Liu, Nenghai Yu, Xiaogang Wang, Jing Shao |
| 2019 | ICCV | Unsupervised Collaborative Learning of Keyframe Detection and Visual Odometry Towards Monocular Deep SLAM. | Lu Sheng, Dan Xu, Wanli Ouyang, Xiaogang Wang |
| 2019 | ICCV | Improving Pedestrian Attribute Recognition With Weakly-Supervised Multi-Scale Attribute-Specific Localization. | Chufeng Tang, Lu Sheng, Zhaoxiang Zhang, Xiaolin Hu |
| 2019 | ICCV | CAMP: Cross-Modal Adaptive Message Passing for Text-Image Retrieval. | Zihao Wang, Xihui Liu, Hongsheng Li, Lu Sheng, Junjie Yan, Xiaogang Wang, Jing Shao |
| 2018 | CVPR | Exploring Disentangled Feature Representation Beyond Face Identification. | Yu Liu, Fangyin Wei, Jing Shao, Lu Sheng, Junjie Yan, Xiaogang Wang |
| 2018 | CVPR | Avatar-Net: Multi-Scale Zero-Shot Style Transfer by Feature Decoration. | Lu Sheng, Ziyi Lin, Jing Shao, Xiaogang Wang |
| 2018 | CVPR | Optical Flow Guided Feature: A Fast and Robust Motion Representation for Video Action Recognition. | Shuyang Sun, Zhanghui Kuang, Lu Sheng, Wanli Ouyang, Wei Zhang |
| 2018 | ECCV | Zoom-Net: Mining Deep Feature Interactions for Visual Relationship Recognition. | Guojun Yin, Lu Sheng, Bin Liu, Nenghai Yu, Xiaogang Wang, Jing Shao, Chen Change Loy |
| 2017 | CVPR | A Generative Model for Depth-Based Robust 3D Facial Pose Tracking. | Lu Sheng, Jianfei Cai, Tat-Jen Cham, Vladimir Pavlovic, King Ngi Ngan |
| 2017 | ICCV | HydraPlus-Net: Attentive Deep Features for Pedestrian Analysis. | Xihui Liu, Haiyu Zhao, Maoqing Tian, Lu Sheng, Jing Shao, Shuai Yi, Junjie Yan, Xiaogang Wang |
| 2014 | ACCV | Accelerating the Distribution Estimation for the Weighted Median/Mode Filters. | Lu Sheng, King Ngi Ngan, Tak-Wai Hui |
| 2014 | ICIP | Screen-camera calibration using a thread. | Songnan Li, King Ngi Ngan, Lu Sheng |
| 2014 | ICIP | Temporal depth video enhancement based on intrinsic static structure. | Lu Sheng, King Ngi Ngan, Songnan Li |
| 2013 | ICIP | Depth enhancement based on hybrid geometric hole filling strategy. | Lu Sheng, King Ngi Ngan |
| 2013 | ICVS | A Head Pose Tracking System Using RGB-D Camera. | Songnan Li, King Ngi Ngan, Lu Sheng |