Hongsheng Li
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
248
Venues
22
Active years
2009–2026
Best venue rank
A*
Where they publish
- A*CVPR83 papers
- A*ICCV42 papers
- A*ECCV38 papers
- A*ICLR23 papers
- A*AAAI15 papers
- A*ACL10 papers
- AMICCAI8 papers
- A*ICML5 papers
- ABMVC4 papers
- A*EMNLP3 papers
- AIROS3 papers
- UnrankedCoRL3 papers
- A*ICRA2 papers
- A*SIGGRAPH1 paper
- A*SiggraphA1 paper
- BIJCNN1 paper
- AWACV1 paper
- BICPR1 paper
- A*WWW1 paper
- BVTC1 paper
- BSMC1 paper
- CICARCV1 paper
Papers
248 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Rethinking Long-tailed Dataset Distillation: A Uni-Level Framework with Unbiased Recovery and Relabeling. | Xiao Cui, Yulei Qin, Xinyue Li, Wengang Zhou, Hongsheng Li, Houqiang Li |
| 2026 | AAAI | TIDE: Temporal-Aware Sparse Autoencoders for Interpretable Diffusion Transformers in Image Generation. | Victor Shea-Jay Huang, Le Zhuo, Yi Xin, Zhaokai Wang, Fu-Yun Wang, Yuchi Wang, Renrui Zhang, Peng Gao, Hongsheng Li |
| 2026 | AAAI | UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning. | Zhengxi Lu, Yuxiang Chai, Yaxuan Guo, Xi Yin, Liang Liu, Hao Wang, Han Xiao, Shuai Ren, Pengxiang Zhao, Guangyi Liu, Guanjing Xiong, Hongsheng Li |
| 2026 | AAAI | From Solver to Tutor: Evaluating the Pedagogical Intelligence of LLMs with KMP-Bench. | Weikang Shi, Houxing Ren, Junting Pan, Aojun Zhou, Ke Wang, Zimu Lu, Yunqiao Yang, Yuxuan Hu, Linda Wei, Mingjie Zhan, Hongsheng Li |
| 2026 | AAAI | Self-NPO: Data-Free Diffusion Model Enhancement via Truncated Diffusion Fine-Tuning. | Fu-Yun Wang, Keqiang Sun, Yao Teng, Xihui Liu, Jiale Yuan, Jiaming Song, Hongsheng Li |
| 2026 | ACL | A3: Android Agent Arena for Mobile GUI Agents with Essential-State Procedural Evaluation. | Yuxiang Chai, Shunye Tang, Han Xiao, Weifeng Lin, Hanhao Li, Jiayu Zhang, Liang Liu, Pengxiang Zhao, Guangyi Liu, Guozhi Wang, Shuai Ren, Rongduo Han, Haining Zhang, Siyuan Huang, Hongsheng Li |
| 2026 | ACL | Towards Robust Real-World Spreadsheet Understanding with Multi-Agent Multi-Format Reasoning. | Houxing Ren, Mingjie Zhan, Zimu Lu, Ke Wang, Yunqiao Yang, Haotian Hou, Hongsheng Li |
| 2026 | ACL | MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning. | Weikang Shi, Aldrich Yu, Rongyao Fang, Houxing Ren, Ke Wang, Aojun Zhou, Changyao Tian, Xinyu Fu, Yuxuan Hu, Zimu Lu, Linjiang Huang, Si Liu, Rui Liu, Hongsheng Li |
| 2025 | AAAI | M3Net: Multimodal Multi-task Learning for 3D Detection, Segmentation, and Occupancy Prediction in Autonomous Driving. | Xuesong Chen, Shaoshuai Shi, Tao Ma, Jingqiu Zhou, Simon See, Ka Chun Cheung, Hongsheng Li |
| 2025 | AAAI | LiDAR-LLM: Exploring the Potential of Large Language Models for 3D LiDAR Understanding. | Senqiao Yang, Jiaming Liu, Renrui Zhang, Mingjie Pan, Ziyu Guo, Xiaoqi Li, Zehui Chen, Peng Gao, Hongsheng Li, Yandong Guo, Shanghang Zhang |
| 2025 | AAAI | GaussianPainter: Painting Point Cloud into 3D Gaussians with Normal Guidance. | Jingqiu Zhou, Lue Fan, Xuesong Chen, Linjiang Huang, Si Liu, Hongsheng Li |
| 2025 | ACL | MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning. | Ke Wang, Junting Pan, Linda Wei, Aojun Zhou, Weikang Shi, Zimu Lu, Han Xiao, Yunqiao Yang, Houxing Ren, Mingjie Zhan, Hongsheng Li |
| 2025 | ACL | AMEX: Android Multi-annotation Expo Dataset for Mobile GUI Agents. | Yuxiang Chai, Siyuan Huang, Yazhe Niu, Han Xiao, Liang Liu, Guozhi Wang, Dingyu Zhang, Shuai Ren, Hongsheng Li |
| 2025 | ACL | ReflectionCoder: Learning from Reflection Sequence for Enhanced One-off Code Generation. | Houxing Ren, Mingjie Zhan, Zhongyuan Wu, Aojun Zhou, Junting Pan, Hongsheng Li |
| 2025 | ACL | Probability-Consistent Preference Optimization for Enhanced LLM Reasoning. | Yunqiao Yang, Houxing Ren, Zimu Lu, Ke Wang, Weikang Shi, Aojun Zhou, Junting Pan, Mingjie Zhan, Hongsheng Li |
| 2025 | CVPR | SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving. | Xuesong Chen, Linjiang Huang, Tao Ma, Rongyao Fang, Shaoshuai Shi, Hongsheng Li |
| 2025 | CVPR | Adaptive Markup Language Generation for Contextually-Grounded Visual Document Understanding. | Han Xiao, Yina Xie, Guanxin Tan, Yinghao Chen, Rui Hu, Ke Wang, Aojun Zhou, Hao Li, Hao Shao, Xudong Lu, Peng Gao, Yafei Wen, Xiaoxin Chen, Shuai Ren, Hongsheng Li |
| 2025 | CVPR | GS-DiT: Advancing Video Generation with Dynamic 3D Gaussian Fields through Efficient Dense 3D Point Tracking. | Weikang Bian, Zhaoyang Huang, Xiaoyu Shi, Yijin Li, Fu-Yun Wang, Hongsheng Li |
| 2025 | CVPR | OPTICAL: Leveraging Optimal Transport for Contribution Allocation in Dataset Distillation. | Xiao Cui, Yulei Qin, Wengang Zhou, Hongsheng Li, Houqiang Li |
| 2025 | CVPR | Docopilot: Improving Multimodal Models for Document-Level Understanding. | Yuchen Duan, Zhe Chen, Yusong Hu, Weiyun Wang, Shenglong Ye, Botian Shi, Lewei Lu, Qibin Hou, Tong Lu, Hongsheng Li, Jifeng Dai, Wenhai Wang |
| 2025 | CVPR | FreeSim: Toward Free-viewpoint Camera Simulation in Driving Scenes. | Lue Fan, Hao Zhang, Qitai Wang, Hongsheng Li, Zhaoxiang Zhang |
| 2025 | CVPR | DirectTriGS: Triplane-based Gaussian Splatting Field Representation for 3D Generation. | Xiaoliang Ju, Hongsheng Li |
| 2025 | CVPR | SynerGen-VL: Towards Synergistic Image Understanding and Generation with Vision Experts and Token Folding. | Hao Li, Changyao Tian, Jie Shao, Xizhou Zhu, Zhaokai Wang, Jinguo Zhu, Wenhan Dou, Xiao-Gang Wang, Hongsheng Li, Lewei Lu, Jifeng Dai |
| 2025 | CVPR | BlueLM-V-3B: Algorithm and System Co-Design for Multimodal Large Language Models on Mobile Devices. | Xudong Lu, Yinghao Chen, Cheng Chen, Hui Tan, Boheng Chen, Yina Xie, Rui Hu, Guanxin Tan, Renshou Wu, Yan Hu, Yi Zeng, Lei Wu, Liuyang Bian, Zhaoxiong Wang, Long Liu, Yanzhou Yang, Han Xiao, Aojun Zhou, Yafei Wen, Xiaoxin Chen, Shuai Ren, Hongsheng Li |
| 2025 | CVPR | Let's Verify and Reinforce Image Generation Step by Step. | Renrui Zhang, Chengzhuo Tong, Zhizheng Zhao, Ziyu Guo, Haoquan Zhang, Manyuan Zhang, Jiaming Liu, Peng Gao, Hongsheng Li |
| 2025 | CVPR | FlexDrive: Toward Trajectory Flexibility in Driving Scene Gaussian Splatting Reconstruction and Rendering. | Jingqiu Zhou, Lue Fan, Linjiang Huang, Xiaoyu Shi, Si Liu, Zhaoxiang Zhang, Hongsheng Li |
| 2025 | EMNLP | LM-Searcher: Cross-domain Neural Architecture Search with LLMs via Unified Numerical Encoding. | Yuxuan Hu, Jihao Liu, Ke Wang, Jinliang Zheng, Weikang Shi, Manyuan Zhang, Qi Dou, Rui Liu, Aojun Zhou, Hongsheng Li |
| 2025 | EMNLP | SmartBench: Is Your LLM Truly a Good Chinese Smartphone Assistant? | Xudong Lu, Haohao Gao, Renshou Wu, Shuai Ren, Xiaoxin Chen, Hongsheng Li, Fangyuan Li |
| 2025 | EMNLP | Alignment with Fill-In-the-Middle for Enhancing Code Generation. | Houxing Ren, Zimu Lu, Weikang Shi, Haotian Hou, Yunqiao Yang, Ke Wang, Aojun Zhou, Junting Pan, Mingjie Zhan, Hongsheng Li |
| 2025 | ICCV | PUMA: Empowering Unified MLLM with Multi-Granular Visual Generation. | Rongyao Fang, Chengqi Duan, Kun Wang, Hao Li, Linjiang Huang, Hao Tian, Xingyu Zeng, Rui Zhao, Jifeng Dai, Hongsheng Li, Xihui Liu |
| 2025 | ICCV | CameraCtrl II: Dynamic Scene Exploration via Camera-Controlled Video Diffusion Models. | Hao He, Ceyuan Yang, Shanchuan Lin, Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li |
| 2025 | ICCV | GenieBlue: Integrating Both Linguistic and Multimodal Capabilities for Large Language Models on Mobile Devices. | Xudong Lu, Yinghao Chen, Renshou Wu, Haohao Gao, Xi Chen, Xue Yang, Xiangyu Zhao, Aojun Zhou, Fangyuan Li, Yafei Wen, Xiaoxin Chen, Shuai Ren, Hongsheng Li |
| 2025 | ICCV | HPSv3: Towards Wide-Spectrum Human Preference Score. | Yuhang Ma, Xiaoshi Wu, Keqiang Sun, Hongsheng Li |
| 2025 | ICCV | Lumina-Image 2.0: a Unified and Efficient Image Generative Framework. | Qi Qin, Le Zhuo, Yi Xin, Ruoyi Du, Zhen Li, Bin Fu, Yiting Lu, Xinyue Li, Dongyang Liu, Xiangyang Zhu, Will Beddow, Erwann Millon, Victor Perez, Wenhai Wang, Yu Qiao, Bo Zhang, Xiaohong Liu, Hongsheng Li, Chang Xu, Peng Gao |
| 2025 | ICCV | From Reflection to Perfection: Scaling Inference-Time Optimization for Text-to-Image Diffusion Models via Reflection Tuning. | Le Zhuo, Liangbing Zhao, Sayak Paul, Yue Liao, Renrui Zhang, Yi Xin, Peng Gao, Mohamed Elhoseiny, Hongsheng Li |
| 2025 | ICCV | ConsistentCity: Semantic Flow-Guided Occupancy DiT for Temporally Consistent Driving Scene Synthesis. | Benjin Zhu, Xiaogang Wang, Hongsheng Li |
| 2025 | ICLR | Point Cluster: A Compact Message Unit for Communication-Efficient Collaborative Perception. | Zihan Ding, Jiahui Fu, Si Liu, Hongyu Li, Siheng Chen, Hongsheng Li, Shifeng Zhang, Xu Zhou |
| 2025 | ICLR | Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures. | Yuchen Duan, Weiyun Wang, Zhe Chen, Xizhou Zhu, Lewei Lu, Tong Lu, Yu Qiao, Hongsheng Li, Jifeng Dai, Wenhai Wang |
| 2025 | ICLR | Lumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation. | Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xie, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, Tong He, Jingwen He, Junjun He, Yu Qiao, Hongsheng Li |
| 2025 | ICLR | CameraCtrl: Enabling Camera Control for Video Diffusion Models. | Hao He, Yinghao Xu, Yuwei Guo, Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang |
| 2025 | ICLR | Mixture Compressor for Mixture-of-Experts LLMs Gains More. | Wei Huang, Yue Liao, Jianhui Liu, Ruifei He, Haoru Tan, Shiming Zhang, Hongsheng Li, Si Liu, Xiaojuan Qi |
| 2025 | ICLR | MMSearch: Unveiling the Potential of Large Models as Multi-modal Search Engines. | Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanmin Wu, Jiayi Lei, Pengshuo Qiu, Pan Lu, Zehui Chen, Guanglu Song, Peng Gao, Yu Liu, Chunyuan Li, Hongsheng Li |
| 2025 | ICLR | Draw-and-Understand: Leveraging Visual Prompts to Enable MLLMs to Comprehend What You Want. | Weifeng Lin, Xinyu Wei, Ruichuan An, Peng Gao, Bocheng Zou, Yulin Luo, Siyuan Huang, Shanghang Zhang, Hongsheng Li |
| 2025 | ICLR | PixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions. | Weifeng Lin, Xinyu Wei, Renrui Zhang, Le Zhuo, Shitian Zhao, Siyuan Huang, Junlin Xie, Peng Gao, Hongsheng Li |
| 2025 | ICLR | MathCoder2: Better Math Reasoning from Continued Pretraining on Model-translated Mathematical Code. | Zimu Lu, Aojun Zhou, Ke Wang, Houxing Ren, Weikang Shi, Junting Pan, Mingjie Zhan, Hongsheng Li |
| 2025 | ICLR | LLaVA-MoD: Making LLaVA Tiny via MoE-Knowledge Distillation. | Fangxun Shu, Yue Liao, Lei Zhang, Le Zhuo, Chenning Xu, Guanghao Zhang, Haonan Shi, Long Chan, Tao Zhong, Zhelun Yu, Wanggui He, Siming Fu, Haoyuan Li, Si Liu, Hongsheng Li, Hao Jiang |
| 2025 | ICLR | Rectified Diffusion: Straightness Is Not Your Need in Rectified Flow. | Fu-Yun Wang, Ling Yang, Zhaoyang Huang, Mengdi Wang, Hongsheng Li |
| 2025 | ICLR | Diffusion-NPO: Negative Preference Optimization for Better Preference Aligned Generation of Diffusion Models. | Fu-Yun Wang, Yunhao Shui, Jingtan Piao, Keqiang Sun, Hongsheng Li |
| 2025 | ICLR | Towards Realistic UAV Vision-Language Navigation: Platform, Benchmark, and Methodology. | Xiangyu Wang, Donglin Yang, Ziqin Wang, Hohin Kwan, Jinyu Chen, Wenjun Wu, Hongsheng Li, Yue Liao, Si Liu |
| 2025 | ICLR | MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine. | Renrui Zhang, Xinyu Wei, Dongzhi Jiang, Ziyu Guo, Yichi Zhang, Chengzhuo Tong, Jiaming Liu, Aojun Zhou, Shanghang Zhang, Peng Gao, Hongsheng Li |
| 2025 | ICLR | SmartPretrain: Model-Agnostic and Dataset-Agnostic Representation Learning for Motion Prediction. | Yang Zhou, Hao Shao, Letian Wang, Steven L. Waslander, Hongsheng Li, Yu Liu |
| 2025 | ICML | MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency. | Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanwei Li, Yu Qi, Xinyan Chen, Liuhui Wang, Jianhan Jin, Claire Guo, Shen Yan, Bo Zhang, Chaoyou Fu, Peng Gao, Hongsheng Li |
| 2025 | ICML | One Leaf Reveals the Season: Occlusion-Based Contrastive Learning with Semantic-Aware Views for Efficient Visual Representation. | Xiaoyu Yang, Lijian Xu, Hongsheng Li, Shaoting Zhang |
| 2025 | ICML | EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM. | Zhuofan Zong, Dongzhi Jiang, Bingqi Ma, Guanglu Song, Hao Shao, Dazhong Shen, Yu Liu, Hongsheng Li |
| 2025 | IROS | SKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation. | Xin Li, Siyuan Huang, Qiaojun Yu, Zhengkai Jiang, Ce Hao, Yimeng Zhu, Hongsheng Li, Peng Gao, Cewu Lu |
| 2025 | ICRA | UniAff: A Unified Representation of Affordances for Tool Usage and Articulation with Vision-Language Models. | Qiaojun Yu, Siyuan Huang, Xibin Yuan, Zhengkai Jiang, Ce Hao, Xin Li, Haonan Chang, Junbo Wang, Liu Liu, Hongsheng Li, Peng Gao, Cewu Lu |
| 2025 | MICCAI | VBCD: A Voxel-Based Framework for Personalized Dental Crown Design. | Linda Wei, Chang Liu, Wenran Zhang, Zengji Zhang, Shaoting Zhang, Hongsheng Li |
| 2024 | ACL | Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models. | Xudong Lu, Qi Liu, Yuhui Xu, Aojun Zhou, Siyuan Huang, Bo Zhang, Junchi Yan, Hongsheng Li |
| 2024 | ACL | MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs. | Zimu Lu, Aojun Zhou, Houxing Ren, Ke Wang, Weikang Shi, Junting Pan, Mingjie Zhan, Hongsheng Li |
| 2024 | ACL | Empowering Character-level Text Infilling by Eliminating Sub-Tokens. | Houxing Ren, Mingjie Zhan, Zhongyuan Wu, Hongsheng Li |
| 2024 | CoRL | A3VLM: Actionable Articulation-Aware Vision Language Model. | Siyuan Huang, Haonan Chang, Yuhan Liu, Yimeng Zhu, Hao Dong, Abdeslam Boularias, Peng Gao, Hongsheng Li |
| 2024 | CVPR | DiffInDScene: Diffusion-Based High-Quality 3D Indoor Scene Generation. | Xiaoliang Ju, Zhaoyang Huang, Yijiin Li, Guofeng Zhang, Yu Qiao, Hongsheng Li |
| 2024 | CVPR | Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft. | Hao Li, Xue Yang, Zhaokai Wang, Xizhou Zhu, Jie Zhou, Yu Qiao, Xiaogang Wang, Hongsheng Li, Lewei Lu, Jifeng Dai |
| 2024 | CVPR | GLID: Pre-training a Generalist Encoder-Decoder Vision Model. | Jihao Liu, Jinliang Zheng, Yu Liu, Hongsheng Li |
| 2024 | CVPR | LMDrive: Closed-Loop End-to-End Driving with Large Language Models. | Hao Shao, Yuxuan Hu, Letian Wang, Guanglu Song, Steven L. Waslander, Yu Liu, Hongsheng Li |
| 2024 | CVPR | Efficient Deformable ConvNets: Rethinking Dynamic and Sparse Operator for Vision Applications. | Yuwen Xiong, Zhiqi Li, Yuntao Chen, Feng Wang, Xizhou Zhu, Jiapeng Luo, Wenhai Wang, Tong Lu, Hongsheng Li, Yu Qiao, Lewei Lu, Jie Zhou, Jifeng Dai |
| 2024 | CVPR | SmartRefine: A Scenario-Adaptive Refinement Framework for Efficient Motion Prediction. | Yang Zhou, Hao Shao, Letian Wang, Steven L. Waslander, Hongsheng Li, Yu Liu |
| 2024 | ECCV | FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis. | Linjiang Huang, Rongyao Fang, Aiping Zhang, Guanglu Song, Si Liu, Yu Liu, Hongsheng Li |
| 2024 | ECCV | Delving Deep into Engagement Prediction of Short Videos. | Dasong Li, Wenjie Li, Baili Lu, Hongsheng Li, Sizhuo Ma, Gurunandan Krishnan, Jian Wang |
| 2024 | ECCV | SPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models. | Ziyi Lin, Dongyang Liu, Renrui Zhang, Peng Gao, Longtian Qiu, Han Xiao, Han Qiu, Wenqi Shao, Keqin Chen, Jiaming Han, Siyuan Huang, Yichi Zhang, Xuming He, Yu Qiao, Hongsheng Li |
| 2024 | ECCV | BlinkVision: A Benchmark for Optical Flow, Scene Flow and Point Tracking Estimation Using RGB Frames and Events. | Yijin Li, Yichen Shen, Zhaoyang Huang, Shuo Chen, Weikang Bian, Xiaoyu Shi, Fu-Yun Wang, Keqiang Sun, Hujun Bao, Zhaopeng Cui, Guofeng Zhang, Hongsheng Li |
| 2024 | ECCV | Ponymation: Learning Articulated 3D Animal Motions from Unlabeled Online Videos. | Keqiang Sun, Dor Litvak, Yunzhi Zhang, Hongsheng Li, Jiajun Wu, Shangzhe Wu |
| 2024 | ECCV | Any2Point: Empowering Any-Modality Large Models for Efficient 3D Understanding. | Yiwen Tang, Ray Zhang, Jiaming Liu, Zoey Guo, Bin Zhao, Zhigang Wang, Peng Gao, Hongsheng Li, Dong Wang, Xuelong Li |
| 2024 | ECCV | ZoLA: Zero-Shot Creative Long Animation Generation with Short Video Model. | Fu-Yun Wang, Zhaoyang Huang, Qiang Ma, Guanglu Song, Xudong Lu, Weikang Bian, Yijin Li, Yu Liu, Hongsheng Li |
| 2024 | ECCV | GiT: Towards Generalist Vision Transformer Through Universal Language Interface. | Haiyang Wang, Hao Tang, Li Jiang, Shaoshuai Shi, Muhammad Ferjad Naeem, Hongsheng Li, Bernt Schiele, Liwei Wang |
| 2024 | ECCV | Be-Your-Outpainter: Mastering Video Outpainting Through Input-Specific Adaptation. | Fu-Yun Wang, Xiaoshi Wu, Zhaoyang Huang, Xiaoyu Shi, Dazhong Shen, Guanglu Song, Yu Liu, Hongsheng Li |
| 2024 | ECCV | DailyDVS-200: A Comprehensive Benchmark Dataset for Event-Based Action Recognition. | Qi Wang, Zhou Xu, Yuming Lin, Jingtao Ye, Hongsheng Li, Guangming Zhu, Syed Afaq Ali Shah, Mohammed Bennamoun, Liang Zhang |
| 2024 | ECCV | Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models. | Xiaoshi Wu, Yiming Hao, Manyuan Zhang, Keqiang Sun, Zhaoyang Huang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2024 | ECCV | Unmasking Bias in Diffusion Model Training. | Hu Yu, Li Shen, Jie Huang, Hongsheng Li, Feng Zhao |
| 2024 | ECCV | MATHVERSE: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems? | Renrui Zhang, Dongzhi Jiang, Yichi Zhang, Haokun Lin, Ziyu Guo, Pengshuo Qiu, Aojun Zhou, Pan Lu, Kai-Wei Chang, Yu Qiao, Peng Gao, Hongsheng Li |
| 2024 | ECCV | Three Things We Need to Know About Transferring Stable Diffusion to Visual Dense Prediction Tasks. | Manyuan Zhang, Guanglu Song, Xiaoyu Shi, Yu Liu, Hongsheng Li |
| 2024 | ECCV | nuCraft: Crafting High Resolution 3D Semantic Occupancy for Unified 3D Scene Understanding. | Benjin Zhu, Zhe Wang, Hongsheng Li |
| 2024 | ICLR | ADDP: Learning General Representations for Image Recognition and Generation with Alternating Denoising Diffusion Process. | Changyao Tian, Chenxin Tao, Jifeng Dai, Hao Li, Ziheng Li, Lewei Lu, Xiaogang Wang, Hongsheng Li, Gao Huang, Xizhou Zhu |
| 2024 | ICLR | MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning. | Ke Wang, Houxing Ren, Aojun Zhou, Zimu Lu, Sichun Luo, Weikang Shi, Renrui Zhang, Linqi Song, Mingjie Zhan, Hongsheng Li |
| 2024 | ICLR | Personalize Segment Anything Model with One Shot. | Renrui Zhang, Zhengkai Jiang, Ziyu Guo, Shilin Yan, Junting Pan, Hao Dong, Yu Qiao, Peng Gao, Hongsheng Li |
| 2024 | ICLR | LLaMA-Adapter: Efficient Fine-tuning of Large Language Models with Zero-initialized Attention. | Renrui Zhang, Jiaming Han, Chris Liu, Aojun Zhou, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao |
| 2024 | ICLR | Solving Challenging Math Word Problems Using GPT-4 Code Interpreter with Code-based Self-Verification. | Aojun Zhou, Ke Wang, Zimu Lu, Weikang Shi, Sichun Luo, Zipeng Qin, Shaoqing Lu, Anya Jia, Linqi Song, Mingjie Zhan, Hongsheng Li |
| 2024 | ICML | SPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models. | Dongyang Liu, Renrui Zhang, Longtian Qiu, Siyuan Huang, Weifeng Lin, Shitian Zhao, Shijie Geng, Ziyi Lin, Peng Jin, Kaipeng Zhang, Wenqi Shao, Chao Xu, Conghui He, Junjun He, Hao Shao, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao |
| 2024 | ICML | SPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models. | Xudong Lu, Aojun Zhou, Yuhui Xu, Renrui Zhang, Peng Gao, Hongsheng Li |
| 2024 | ICRA | VeloVox: A Low-Cost and Accurate 4D Object Detector with Single-Frame Point Cloud of Livox LiDAR. | Tao Ma, Zhiwei Zheng, Hongbin Zhou, Xinyu Cai, Xuemeng Yang, Yikang Li, Botian Shi, Hongsheng Li |
| 2024 | IROS | ManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models. | Siyuan Huang, Iaroslav Ponomarenko, Zhengkai Jiang, Xiaoqi Li, Xiaobin Hu, Peng Gao, Hongsheng Li, Hao Dong |
| 2024 | SIGGRAPH | Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling. | Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li |
| 2024 | SiggraphA | AnimateLCM: Computation-Efficient Personalized Style Video Generation without Personalized Video Data. | Fu-Yun Wang, Zhaoyang Huang, Weikang Bian, Xiaoyu Shi, Keqiang Sun, Guanglu Song, Yu Liu, Hongsheng Li |
| 2023 | CVPR | Adaptive Zone-aware Hierarchical Planner for Vision-Language Navigation. | Chen Gao, Xingyu Peng, Mi Yan, He Wang, Lirong Yang, Haibing Ren, Hongsheng Li, Si Liu |
| 2023 | CVPR | A Simple Baseline for Video Restoration with Grouped Spatial-Temporal Shift. | Dasong Li, Xiaoyu Shi, Yi Zhang, Ka Chun Cheung, Simon See, Xiaogang Wang, Hongwei Qin, Hongsheng Li |
| 2023 | CVPR | MixMAE: Mixed and Masked Autoencoder for Efficient Pretraining of Hierarchical Vision Transformers. | Jihao Liu, Xin Huang, Jinliang Zheng, Yu Liu, Hongsheng Li |
| 2023 | CVPR | Uni-Perceiver v2: A Generalist Model for Large-Scale Vision and Vision-Language Tasks. | Hao Li, Jinguo Zhu, Xiaohu Jiang, Xizhou Zhu, Hongsheng Li, Chun Yuan, Xiaohua Wang, Yu Qiao, Xiaogang Wang, Wenhai Wang, Jifeng Dai |
| 2023 | CVPR | PATS: Patch Area Transportation with Subdivision for Local Feature Matching. | Junjie Ni, Yijin Li, Zhaoyang Huang, Hongsheng Li, Hujun Bao, Zhaopeng Cui, Guofeng Zhang |
| 2023 | CVPR | ReasonNet: End-to-End Driving with Temporal and Global Reasoning. | Hao Shao, Letian Wang, Ruobing Chen, Steven L. Waslander, Hongsheng Li, Yu Liu |
| 2023 | CVPR | FlowFormer++: Masked Cost Volume Autoencoding for Pretraining Optical Flow Estimation. | Xiaoyu Shi, Zhaoyang Huang, Dasong Li, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li |
| 2023 | CVPR | InternImage: Exploring Large-Scale Vision Foundation Models with Deformable Convolutions. | Wenhai Wang, Jifeng Dai, Zhe Chen, Zhenhang Huang, Zhiqi Li, Xizhou Zhu, Xiaowei Hu, Tong Lu, Lewei Lu, Hongsheng Li, Xiaogang Wang, Yu Qiao |
| 2023 | CVPR | CORA: Adapting CLIP for Open-Vocabulary Detection with Region Prompting and Anchor Pre-Matching. | Xiaoshi Wu, Feng Zhu, Rui Zhao, Hongsheng Li |
| 2023 | CVPR | Prompt, Generate, Then Cache: Cascade of Foundation Models Makes Strong Few-Shot Learners. | Renrui Zhang, Xiangfei Hu, Bohao Li, Siyuan Huang, Hanqiu Deng, Yu Qiao, Peng Gao, Hongsheng Li |
| 2023 | CVPR | Learning 3D Representations from 2D Pre-Trained Models via Image-to-Point Masked Autoencoders. | Renrui Zhang, Liuhui Wang, Yu Qiao, Peng Gao, Hongsheng Li |
| 2023 | CVPR | Starting from Non-Parametric Networks for 3D Point Cloud Analysis. | Renrui Zhang, Liuhui Wang, Yali Wang, Peng Gao, Hongsheng Li, Jianbo Shi |
| 2023 | CVPR | Improving Weakly Supervised Temporal Action Localization by Bridging Train-Test Gap in Pseudo Labels. | Jingqiu Zhou, Linjiang Huang, Liang Wang, Si Liu, Hongsheng Li |
| 2023 | CVPR | ConQueR: Query Contrast Voxel-DETR for 3D Object Detection. | Benjin Zhu, Zhe Wang, Shaoshuai Shi, Hang Xu, Lanqing Hong, Hongsheng Li |
| 2023 | ICCV | TrajectoryFormer: 3D Object Tracking Transformer with Predictive Trajectory Hypotheses. | Xuesong Chen, Shaoshuai Shi, Chao Zhang, Benjin Zhu, Qiang Wang, Ka Chun Cheung, Simon See, Hongsheng Li |
| 2023 | ICCV | Omnidirectional Information Gathering for Knowledge Transfer-based Audio-Visual Navigation. | Jinyu Chen, Wenguan Wang, Si Liu, Hongsheng Li, Yi Yang |
| 2023 | ICCV | Simulating Fluids in Real-World Still Images. | Siming Fan, Jingtan Piao, Chen Qian, Hongsheng Li, Kwan-Yee Lin |
| 2023 | ICCV | GeoMIM: Towards Better 3D Knowledge Transfer via Masked Image Modeling for Multi-view 3D Understanding. | Jihao Liu, Tai Wang, Boxiao Liu, Qihang Zhang, Yu Liu, Hongsheng Li |
| 2023 | ICCV | Urban Radiance Field Representation with Deformable Neural Mesh Primitives. | Fan Lu, Yan Xu, Guang Chen, Hongsheng Li, Kwan-Yee Lin, Changjun Jiang |
| 2023 | ICCV | DetZero: Rethinking Offboard 3D Object Detection with Long-term Sequential Point Clouds. | Tao Ma, Xuemeng Yang, Hongbin Zhou, Xin Li, Botian Shi, Junjie Liu, Yuchen Yang, Zhizheng Liu, Liang He, Yu Qiao, Yikang Li, Hongsheng Li |
| 2023 | ICCV | VideoFlow: Exploiting Temporal Cues for Multi-frame Optical Flow Estimation. | Xiaoyu Shi, Zhaoyang Huang, Weikang Bian, Dasong Li, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li |
| 2023 | ICCV | Human Preference Score: Better Aligning Text-to-image Models with Human Preference. | Xiaoshi Wu, Keqiang Sun, Feng Zhu, Rui Zhao, Hongsheng Li |
| 2023 | ICCV | NDC-Scene: Boost Monocular 3D Semantic Scene Completion in Normalized Device Coordinates Space. | Jiawei Yao, Chuming Li, Keqiang Sun, Yingjie Cai, Hao Li, Wanli Ouyang, Hongsheng Li |
| 2023 | ICCV | MonoDETR: Depth-guided Transformer for Monocular 3D Object Detection. | Renrui Zhang, Han Qiu, Tai Wang, Ziyu Guo, Ziteng Cui, Yu Qiao, Hongsheng Li, Peng Gao |
| 2023 | ICCV | Decoupled DETR: Spatially Disentangling Localization and Classification for Improved End-to-End Object Detection. | Manyuan Zhang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2023 | ICCV | SparseMAE: Sparse Training Meets Masked Autoencoders. | Aojun Zhou, Yang Li, Zipeng Qin, Jianbo Liu, Junting Pan, Renrui Zhang, Rui Zhao, Peng Gao, Hongsheng Li |
| 2023 | ICCV | Temporal Enhanced Training of Multi-view 3D Object Detector via Historical Object Prediction. | Zhuofan Zong, Dongzhi Jiang, Guanglu Song, Zeyue Xue, Jingyong Su, Hongsheng Li, Yu Liu |
| 2023 | IROS | BlinkFlow: A Dataset to Push the Limits of Event-Based Optical Flow Estimation. | Yijin Li, Zhaoyang Huang, Shuo Chen, Xiaoyu Shi, Hongsheng Li, Hujun Bao, Zhaopeng Cui, Guofeng Zhang |
| 2022 | BMVC | Task Generalizable Spatial and Texture Aware Image Downsizing Network. | Lin Ma, Weiming Li, Hongsheng Li, Qiang Wang, Ji-Yeon Kim |
| 2022 | BMVC | Unleashing the Potential of Vision-Language Models for Long-Tailed Visual Recognition. | Teli Ma, Shijie Geng, Mengmeng Wang, Sheng Xu, Hongsheng Li, Baochang Zhang, Peng Gao, Yu Qiao |
| 2022 | CoRL | Safety-Enhanced Autonomous Driving Using Interpretable Sensor Fusion Transformer. | Hao Shao, Letian Wang, Ruobing Chen, Hongsheng Li, Yu Liu |
| 2022 | CVPR | Learning a Structured Latent Space for Unsupervised Point Cloud Completion. | Yingjie Cai, Kwan-Yee Lin, Chao Zhang, Qiang Wang, Xiaogang Wang, Hongsheng Li |
| 2022 | CVPR | Weakly Supervised Temporal Action Localization via Representative Snippet Knowledge Propagation. | Linjiang Huang, Liang Wang, Hongsheng Li |
| 2022 | CVPR | AutoLoss-Zero: Searching Loss Functions from Scratch for Generic Tasks. | Hao Li, Tianwen Fu, Jifeng Dai, Hongsheng Li, Gao Huang, Xizhou Zhu |
| 2022 | CVPR | RBGNet: Ray-based Grouping for 3D Object Detection. | Haiyang Wang, Shaoshuai Shi, Ze Yang, Rongyao Fang, Qi Qian, Hongsheng Li, Bernt Schiele, Liwei Wang |
| 2022 | CVPR | RNNPose: Recurrent 6-DoF Object Pose Refinement with Robust Correspondence Field Estimation and Pose Optimization. | Yan Xu, Kwan-Yee Lin, Guofeng Zhang, Xiaogang Wang, Hongsheng Li |
| 2022 | CVPR | PointCLIP: Point Cloud Understanding by CLIP. | Renrui Zhang, Ziyu Guo, Wei Zhang, Kunchang Li, Xupeng Miao, Bin Cui, Yu Qiao, Peng Gao, Hongsheng Li |
| 2022 | CVPR | IDR: Self-Supervised Image Denoising via Iterative Data Refinement. | Yi Zhang, Dasong Li, Ka Lung Law, Xiaogang Wang, Hongwei Qin, Hongsheng Li |
| 2022 | CVPR | Uni-Perceiver: Pre-training Unified Architecture for Generic Perception for Zero-shot and Few-shot Tasks. | Xizhou Zhu, Jinguo Zhu, Hao Li, Xiaoshi Wu, Hongsheng Li, Xiaohua Wang, Jifeng Dai |
| 2022 | ECCV | MPPNet: Multi-frame Feature Intertwining with Proxy Points for 3D Temporal Object Detection. | Xuesong Chen, Shaoshuai Shi, Benjin Zhu, Ka Chun Cheung, Hang Xu, Hongsheng Li |
| 2022 | ECCV | FlowFormer: A Transformer Architecture for Optical Flow. | Zhaoyang Huang, Xiaoyu Shi, Chao Zhang, Qiang Wang, Ka Chun Cheung, Hongwei Qin, Jifeng Dai, Hongsheng Li |
| 2022 | ECCV | Frozen CLIP Models are Efficient Video Learners. | Ziyi Lin, Shijie Geng, Renrui Zhang, Peng Gao, Gerard de Melo, Xiaogang Wang, Jifeng Dai, Yu Qiao, Hongsheng Li |
| 2022 | ECCV | UniNet: Unified Architecture Search with Convolution, Transformer, and MLP. | Jihao Liu, Xin Huang, Guanglu Song, Hongsheng Li, Yu Liu |
| 2022 | ECCV | TokenMix: Rethinking Image Mixing for Data Augmentation in Vision Transformers. | Jihao Liu, Boxiao Liu, Hang Zhou, Hongsheng Li, Yu Liu |
| 2022 | ECCV | Learning Degradation Representations for Image Deblurring. | Dasong Li, Yi Zhang, Ka Chun Cheung, Xiaogang Wang, Hongwei Qin, Hongsheng Li |
| 2022 | ECCV | EdgeViTs: Competing Light-Weight CNNs on Mobile Devices with Vision Transformers. | Junting Pan, Adrian Bulat, Fuwen Tan, Xiatian Zhu, Lukasz Dudziak, Hongsheng Li, Georgios Tzimiropoulos, Brais Martnez |
| 2022 | ECCV | Towards Robust Face Recognition with Comprehensive Search. | Manyuan Zhang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2022 | ECCV | Tip-Adapter: Training-Free Adaption of CLIP for Few-Shot Classification. | Renrui Zhang, Wei Zhang, Rongyao Fang, Peng Gao, Kunchang Li, Jifeng Dai, Yu Qiao, Hongsheng Li |
| 2022 | ICLR | UniFormer: Unified Transformer for Efficient Spatial-Temporal Representation Learning. | Kunchang Li, Yali Wang, Peng Gao, Guanglu Song, Yu Liu, Hongsheng Li, Yu Qiao |
| 2022 | IJCNN | Spatial Parsing and Dynamic Temporal Pooling networks for Human-Object Interaction detection. | Hongsheng Li, Guangming Zhu, Wu Zhen, Lan Ni, Peiyi Shen, Liang Zhang, Ning Wang, Cong Hua |
| 2021 | AAAI | A Unified Multi-Scenario Attacking Network for Visual Object Tracking. | Xuesong Chen, Canmiao Fu, Feng Zheng, Yong Zhao, Hongsheng Li, Ping Luo, Guo-Jun Qi |
| 2021 | AAAI | Dynamic Graph Representation Learning for Video Dialog via Multi-Modal Shuffled Transformers. | Shijie Geng, Peng Gao, Moitreya Chatterjee, Chiori Hori, Jonathan Le Roux, Yongfeng Zhang, Hongsheng Li, Anoop Cherian |
| 2021 | AAAI | REFINE: Prediction Fusion Network for Panoptic Segmentation. | Jiawei Ren, Cunjun Yu, Zhongang Cai, Mingyuan Zhang, Chongsong Chen, Haiyu Zhao, Shuai Yi, Hongsheng Li |
| 2021 | BMVC | End-to-End Object Detection with Adaptive Clustering Transformer. | Minghang Zheng, Peng Gao, Renrui Zhang, Kunchang Li, Hongsheng Li, Hao Dong |
| 2021 | CVPR | DivCo: Diverse Conditional Image Synthesis via Contrastive Generative Adversarial Network. | Rui Liu, Yixiao Ge, Ching Lam Choi, Xiaogang Wang, Hongsheng Li |
| 2021 | CVPR | Semantic Scene Completion via Integrating Instances and Scene In-the-Loop. | Yingjie Cai, Xuesong Chen, Chao Zhang, Kwan-Yee Lin, Xiaogang Wang, Hongsheng Li |
| 2021 | CVPR | LiDAR-Based Panoptic Segmentation via Dynamic Shifting Network. | Fangzhou Hong, Hui Zhou, Xinge Zhu, Hongsheng Li, Ziwei Liu |
| 2021 | CVPR | VS-Net: Voting With Segmentation for Visual Localization. | Zhaoyang Huang, Han Zhou, Yijin Li, Bangbang Yang, Yan Xu, Xiaowei Zhou, Hujun Bao, Guofeng Zhang, Hongsheng Li |
| 2021 | CVPR | Actor-Context-Actor Relation Network for Spatio-Temporal Action Localization. | Junting Pan, Siyu Chen, Mike Zheng Shou, Yu Liu, Jing Shao, Hongsheng Li |
| 2021 | CVPR | Inverting Generative Adversarial Renderer for Face Reconstruction. | Jingtan Piao, Keqiang Sun, Quan Wang, Kwan-Yee Lin, Hongsheng Li |
| 2021 | CVPR | ST3D: Self-Training for Unsupervised Domain Adaptation on 3D Object Detection. | Jihan Yang, Shaoshuai Shi, Zhe Wang, Hongsheng Li, Xiaojuan Qi |
| 2021 | CVPR | Refining Pseudo Labels With Clustering Consensus Over Generations for Unsupervised Object Re-Identification. | Xiao Zhang, Yixiao Ge, Yu Qiao, Hongsheng Li |
| 2021 | CVPR | Cylindrical and Asymmetrical 3D Convolution Networks for LiDAR Segmentation. | Xinge Zhu, Hui Zhou, Tai Wang, Fangzhou Hong, Yuexin Ma, Wei Li, Hongsheng Li, Dahua Lin |
| 2021 | ICCV | Fast Convergence of DETR with Spatially Modulated Co-Attention. | Peng Gao, Minghang Zheng, Xiaogang Wang, Jifeng Dai, Hongsheng Li |
| 2021 | ICCV | FuseFormer: Fusing Fine-Grained Information in Transformers for Video Inpainting. | Rui Liu, Hanming Deng, Yangyi Huang, Xiaoyu Shi, Lewei Lu, Wenxiu Sun, Xiaogang Wang, Jifeng Dai, Hongsheng Li |
| 2021 | ICCV | LIGA-Stereo: Learning LiDAR Geometry Aware Representations for Stereo-based 3D Detector. | Xiaoyang Guo, Shaoshuai Shi, Xiaogang Wang, Hongsheng Li |
| 2021 | ICCV | Foreground-Action Consistency Network for Weakly Supervised Temporal Action Localization. | Linjiang Huang, Liang Wang, Hongsheng Li |
| 2021 | ICCV | Unsupervised Domain Adaptive 3D Detection with Multi-Level Consistency. | Zhipeng Luo, Zhongang Cai, Changqing Zhou, Gongjie Zhang, Haiyu Zhao, Shuai Yi, Shijian Lu, Hongsheng Li, Shanghang Zhang, Ziwei Liu |
| 2021 | ICCV | Encoder-decoder with Multi-level Attention for 3D Human Shape and Pose Estimation. | Ziniu Wan, Zhengjia Li, Maoqing Tian, Jianbo Liu, Shuai Yi, Hongsheng Li |
| 2021 | ICCV | Rethinking Noise Synthesis and Modeling in Raw Denoising. | Yi Zhang, Hongwei Qin, Xiaogang Wang, Hongsheng Li |
| 2021 | ICCV | Progressive Correspondence Pruning by Consensus Learning. | Chen Zhao, Yixiao Ge, Feng Zhu, Rui Zhao, Hongsheng Li, Mathieu Salzmann |
| 2021 | ICLR | Learning N: M Fine-grained Structured Sparse Neural Networks From Scratch. | Aojun Zhou, Yukun Ma, Junnan Zhu, Jianbo Liu, Zhijie Zhang, Kun Yuan, Wenxiu Sun, Hongsheng Li |
| 2021 | MICCAI | Hybrid Supervision Learning for Pathology Whole Slide Image Classification. | Jiahui Li, Wen Chen, Xiaodi Huang, Shuang Yang, Zhiqiang Hu, Qi Duan, Dimitris N. Metaxas, Hongsheng Li, Shaoting Zhang |
| 2021 | MICCAI | Categorical Relation-Preserving Contrastive Knowledge Distillation for Medical Image Classification. | Xiaohan Xing, Yuenan Hou, Hang Li, Yixuan Yuan, Hongsheng Li, Max Q.-H. Meng |
| 2021 | WACV | Efficient Attention: Attention with Linear Complexities. | Zhuoran Shen, Mingyuan Zhang, Haiyu Zhao, Shuai Yi, Hongsheng Li |
| 2020 | AAAI | Monocular 3D Object Detection with Decoupled Structured Polygon Estimation and Height-Guided Depth Estimation. | Yingjie Cai, Buyu Li, Zeyu Jiao, Hongsheng Li, Xingyu Zeng, Xiaogang Wang |
| 2020 | BMVC | MagnifierNet: Towards Semantic Adversary and Fusion for Person Re-identification. | Yushi Lan, Yuan Liu, Xinchi Zhou, Maoqing Tian, Xuesen Zhang, Shuai Yi, Hongsheng Li |
| 2020 | CoRL | SelfVoxeLO: Self-supervised LiDAR Odometry with Voxel-based Deep Neural Networks. | Yan Xu, Zhaoyang Huang, Kwan-Yee Lin, Xinge Zhu, Jianping Shi, Hujun Bao, Guofeng Zhang, Hongsheng Li |
| 2020 | CVPR | 3D Sketch-Aware Semantic Scene Completion via Semi-Supervised Structure Prior. | Xiaokang Chen, Kwan-Yee Lin, Chen Qian, Gang Zeng, Hongsheng Li |
| 2020 | CVPR | Robust Superpixel-Guided Attentional Adversarial Attack. | Xiaoyi Dong, Jiangfan Han, Dongdong Chen, Jiayang Liu, Huanyu Bian, Zehua Ma, Hongsheng Li, Xiaogang Wang, Weiming Zhang, Nenghai Yu |
| 2020 | CVPR | StereoGAN: Bridging Synthetic-to-Real Domain Gap by Joint Optimization of Domain Translation and Stereo Matching. | Rui Liu, Chengxi Yang, Wenxiu Sun, Xiaogang Wang, Hongsheng Li |
| 2020 | CVPR | PV-RCNN: Point-Voxel Feature Set Abstraction for 3D Object Detection. | Shaoshuai Shi, Chaoxu Guo, Li Jiang, Zhe Wang, Jianping Shi, Xiaogang Wang, Hongsheng Li |
| 2020 | ECCV | Bi-directional Cross-Modality Feature Propagation with Separation-and-Aggregation Gate for RGB-D Semantic Segmentation. | Xiaokang Chen, Kwan-Yee Lin, Jingbo Wang, Wayne Wu, Chen Qian, Hongsheng Li, Gang Zeng |
| 2020 | ECCV | Self-supervising Fine-Grained Region Similarities for Large-Scale Image Localization. | Yixiao Ge, Haibo Wang, Feng Zhu, Rui Zhao, Hongsheng Li |
| 2020 | ECCV | Learning to Predict Context-Adaptive Convolution for Semantic Segmentation. | Jianbo Liu, Junjun He, Yu Qiao, Jimmy S. Ren, Hongsheng Li |
| 2020 | ECCV | EfficientFCN: Holistically-Guided Decoding for Semantic Segmentation. | Jianbo Liu, Junjun He, Jiawei Zhang, Jimmy S. Ren, Hongsheng Li |
| 2020 | ECCV | Open-Edit: Open-Domain Image Manipulation with Open-Vocabulary Instructions. | Xihui Liu, Zhe Lin, Jianming Zhang, Handong Zhao, Quan Tran, Xiaogang Wang, Hongsheng Li |
| 2020 | ECCV | RBF-Softmax: Learning Deep Representative Prototypes with Radial Basis Function Softmax. | Xiao Zhang, Rui Zhao, Yu Qiao, Hongsheng Li |
| 2020 | ICLR | Mutual Mean-Teaching: Pseudo Label Refinery for Unsupervised Domain Adaptation on Person Re-identification. | Yixiao Ge, Dapeng Chen, Hongsheng Li |
| 2020 | ICPR | Nonlinear Temporal Correlation Based Network for Action Recognition. | Hongsheng Li, Weiwei Zhang, Guangming Zhu, Liang Zhang, Peiyi Shen, Juan Song |
| 2020 | MICCAI | Multi-organ Segmentation via Co-training Weight-Averaged Models from Few-Organ Datasets. | Rui Huang, Yuanjie Zheng, Zhiqiang Hu, Shaoting Zhang, Hongsheng Li |
| 2020 | WWW | Structure-Feature based Graph Self-adaptive Pooling. | Liang Zhang, Xudong Wang, Hongsheng Li, Guangming Zhu, Peiyi Shen, Ping Li, Xiaoyuan Lu, Syed Afaq Ali Shah, Mohammed Bennamoun |
| 2019 | AAAI | Unsupervised Cross-Spectral Stereo Matching by Learning to Synthesize. | Mingyang Liang, Xiaoyang Guo, Hongsheng Li, Xiaogang Wang, You Song |
| 2019 | AAAI | A2-Net: Molecular Structure Estimation from Cryo-EM Density Volumes. | Kui Xu, Zhe Wang, Jianping Shi, Hongsheng Li, Qiangfeng Cliff Zhang |
| 2019 | CVPR | Dynamic Fusion With Intra- and Inter-Modality Attention Flow for Visual Question Answering. | Peng Gao, Zhengkai Jiang, Haoxuan You, Pan Lu, Steven C. H. Hoi, Xiaogang Wang, Hongsheng Li |
| 2019 | CVPR | Group-Wise Correlation Stereo Network. | Xiaoyang Guo, Kai Yang, Wukui Yang, Xiaogang Wang, Hongsheng Li |
| 2019 | CVPR | Conditional Adversarial Generative Flow for Controllable Image Synthesis. | Rui Liu, Yu Liu, Xinyu Gong, Xiaogang Wang, Hongsheng Li |
| 2019 | CVPR | Improving Referring Expression Grounding With Cross-Modal Attention-Guided Erasing. | Xihui Liu, Zihao Wang, Jing Shao, Xiaogang Wang, Hongsheng Li |
| 2019 | CVPR | PointRCNN: 3D Object Proposal Generation and Detection From Point Cloud. | Shaoshuai Shi, Xiaogang Wang, Hongsheng Li |
| 2019 | CVPR | P2SGrad: Refined Gradients for Optimizing Deep Face Models. | Xiao Zhang, Rui Zhao, Junjie Yan, Mengya Gao, Yu Qiao, Xiaogang Wang, Hongsheng Li |
| 2019 | CVPR | AdaCos: Adaptively Scaling Cosine Logits for Effectively Learning Deep Face Representations. | Xiao Zhang, Rui Zhao, Yu Qiao, Xiaogang Wang, Hongsheng Li |
| 2019 | ICCV | Multi-Modality Latent Interaction Network for Visual Question Answering. | Peng Gao, Haoxuan You, Zhanpeng Zhang, Xiaogang Wang, Hongsheng Li |
| 2019 | ICCV | Interpolated Convolutional Networks for 3D Point Cloud Understanding. | Jiageng Mao, Xiaogang Wang, Hongsheng Li |
| 2019 | ICCV | Semi-Supervised Monocular 3D Face Reconstruction With End-to-End Shape-Preserved Domain Transfer. | Jingtan Piao, Chen Qian, Hongsheng Li |
| 2019 | ICCV | CAMP: Cross-Modal Adaptive Message Passing for Text-Image Retrieval. | Zihao Wang, Xihui Liu, Hongsheng Li, Lu Sheng, Junjie Yan, Xiaogang Wang, Jing Shao |
| 2019 | ICCV | Depth Completion From Sparse LiDAR Data With Depth-Normal Constraints. | Yan Xu, Xinge Zhu, Jianping Shi, Guofeng Zhang, Hujun Bao, Hongsheng Li |
| 2019 | MICCAI | FocusNet: Imbalanced Large and Small Organ Segmentation with an End-to-End Deep Neural Network for Head and Neck CT Images. | Yunhe Gao, Rui Huang, Ming Chen, Zhe Wang, Jincheng Deng, Yuanyuan Chen, Yiwei Yang, Jie Zhang, Chanjuan Tao, Hongsheng Li |
| 2018 | AAAI | Co-Attending Free-Form Regions and Detections With Multi-Modal Multiplicative Feature Embedding for Visual Question Answering. | Pan Lu, Hongsheng Li, Wei Zhang, Jianyong Wang, Xiaogang Wang |
| 2018 | CVPR | Group Consistent Similarity Learning via Deep CRF for Person Re-Identification. | Dapeng Chen, Dan Xu, Hongsheng Li, Nicu Sebe, Xiaogang Wang |
| 2018 | CVPR | Video Person Re-Identification With Competitive Snippet-Similarity Aggregation and Co-Attentive Snippet Embedding. | Dapeng Chen, Hongsheng Li, Tong Xiao, Shuai Yi, Xiaogang Wang |
| 2018 | CVPR | Single View Stereo Matching. | Yue Luo, Jimmy S. J. Ren, Mude Lin, Jiahao Pang, Wenxiu Sun, Hongsheng Li, Liang Lin |
| 2018 | CVPR | Deep Group-Shuffling Random Walk for Person Re-Identification. | Yantao Shen, Hongsheng Li, Tong Xiao, Shuai Yi, Dapeng Chen, Xiaogang Wang |
| 2018 | CVPR | End-to-End Deep Kronecker-Product Matching for Person Re-Identification. | Yantao Shen, Tong Xiao, Hongsheng Li, Shuai Yi, Xiaogang Wang |
| 2018 | CVPR | Eliminating Background-Bias for Robust Person Re-Identification. | Maoqing Tian, Shuai Yi, Hongsheng Li, Shihua Li, Xuesen Zhang, Jianping Shi, Junjie Yan, Xiaogang Wang |
| 2018 | CVPR | 3D Human Pose Estimation in the Wild by Adversarial Learning. | Wei Yang, Wanli Ouyang, Xiaolong Wang, Jimmy S. J. Ren, Hongsheng Li, Xiaogang Wang |
| 2018 | ECCV | Improving Deep Visual Representation for Person Re-identification by Global and Local Image-language Association. | Dapeng Chen, Hongsheng Li, Xihui Liu, Yantao Shen, Jing Shao, Zejian Yuan, Xiaogang Wang |
| 2018 | ECCV | Question-Guided Hybrid Convolution for Visual Question Answering. | Peng Gao, Hongsheng Li, Shuang Li, Pan Lu, Yikang Li, Steven C. H. Hoi, Xiaogang Wang |
| 2018 | ECCV | Learning Monocular Depth by Distilling Cross-Domain Stereo Networks. | Xiaoyang Guo, Hongsheng Li, Shuai Yi, Jimmy S. J. Ren, Xiaogang Wang |
| 2018 | ECCV | Show, Tell and Discriminate: Image Captioning by Self-retrieval with Partially Labeled Data. | Xihui Liu, Hongsheng Li, Jing Shao, Dapeng Chen, Xiaogang Wang |
| 2018 | ECCV | Person Re-identification with Deep Similarity-Guided Graph Neural Network. | Yantao Shen, Hongsheng Li, Shuai Yi, Dapeng Chen, Xiaogang Wang |
| 2018 | VTC | Latency-Aware In-Network Computing for Internet of Battery-Less Things. | Qianao Ju, Geng Sun, Hongsheng Li, Ying Zhang |
| 2017 | CVPR | Object Detection in Videos with Tubelet Proposal Networks. | Kai Kang, Hongsheng Li, Tong Xiao, Wanli Ouyang, Junjie Yan, Xihui Liu, Xiaogang Wang |
| 2017 | CVPR | Person Search with Natural Language Description. | Shuang Li, Tong Xiao, Hongsheng Li, Bolei Zhou, Dayu Yue, Xiaogang Wang |
| 2017 | CVPR | Learning Spatial Regularization with Image-Level Supervisions for Multi-label Image Classification. | Feng Zhu, Hongsheng Li, Wanli Ouyang, Nenghai Yu, Xiaogang Wang |
| 2017 | ICCV | Online Multi-object Tracking Using CNN-Based Single Object Tracker with Spatial-Temporal Attention Mechanism. | Qi Chu, Wanli Ouyang, Hongsheng Li, Xiaogang Wang, Bin Liu, Nenghai Yu |
| 2017 | ICCV | Identity-Aware Textual-Visual Matching with Latent Co-attention. | Shuang Li, Tong Xiao, Hongsheng Li, Wei Yang, Xiaogang Wang |
| 2017 | ICCV | Learning Deep Neural Networks for Vehicle Re-ID with Visual-spatio-Temporal Path Proposals. | Yantao Shen, Tong Xiao, Hongsheng Li, Shuai Yi, Xiaogang Wang |
| 2017 | ICCV | Orientation Invariant Feature Embedding and Spatial Temporal Regularization for Vehicle Re-identification. | Zhongdao Wang, Luming Tang, Xihui Liu, Zhuliang Yao, Shuai Yi, Jing Shao, Junjie Yan, Shengjin Wang, Hongsheng Li, Xiaogang Wang |
| 2017 | ICCV | Learning Feature Pyramids for Human Pose Estimation. | Wei Yang, Shuang Li, Wanli Ouyang, Hongsheng Li, Xiaogang Wang |
| 2017 | ICCV | StackGAN: Text to Photo-Realistic Image Synthesis with Stacked Generative Adversarial Networks. | Han Zhang, Tao Xu, Hongsheng Li |
| 2017 | MICCAI | Zoom-in-Net: Deep Mining Lesions for Diabetic Retinopathy Detection. | Zhe Wang, Yanxin Yin, Jianping Shi, Wei Fang, Hongsheng Li, Xiaogang Wang |
| 2016 | CVPR | Structured Feature Learning for Pose Estimation. | Xiao Chu, Wanli Ouyang, Hongsheng Li, Xiaogang Wang |
| 2016 | CVPR | Object Detection from Video Tubelets with Convolutional Neural Networks. | Kai Kang, Wanli Ouyang, Hongsheng Li, Xiaogang Wang |
| 2016 | CVPR | Learning Deep Feature Representations with Domain Guided Dropout for Person Re-identification. | Tong Xiao, Hongsheng Li, Wanli Ouyang, Xiaogang Wang |
| 2016 | CVPR | End-to-End Learning of Deformable Mixture of Parts and Deep Convolutional Neural Networks for Human Pose Estimation. | Wei Yang, Wanli Ouyang, Hongsheng Li, Xiaogang Wang |
| 2016 | ECCV | Learnable Histogram: Statistical Context Features for Deep Neural Networks. | Zhe Wang, Hongsheng Li, Wanli Ouyang, Xiaogang Wang |
| 2016 | ECCV | Pedestrian Behavior Understanding and Prediction with Deep Neural Networks. | Shuai Yi, Hongsheng Li, Xiaogang Wang |
| 2016 | ECCV | Crossing-Line Crowd Counting with Two-Phase Deep Neural Networks. | Zhuoyi Zhao, Hongsheng Li, Rui Zhao, Xiaogang Wang |
| 2015 | CVPR | DeepID-Net: Deformable deep convolutional neural networks for object detection. | Wanli Ouyang, Xiaogang Wang, Xingyu Zeng, Shi Qiu, Ping Luo, Yonglong Tian, Hongsheng Li, Shuo Yang, Zhe Wang, Chen Change Loy, Xiaoou Tang |
| 2015 | CVPR | Understanding pedestrian behaviors from stationary crowd groups. | Shuai Yi, Hongsheng Li, Xiaogang Wang |
| 2015 | CVPR | Cross-scene crowd counting via deep convolutional neural networks. | Cong Zhang, Hongsheng Li, Xiaogang Wang, Xiaokang Yang |
| 2015 | CVPR | Saliency detection by multi-context deep learning. | Rui Zhao, Wanli Ouyang, Hongsheng Li, Xiaogang Wang |
| 2015 | ICCV | Pedestrian Travel Time Estimation in Crowded Scenes. | Shuai Yi, Hongsheng Li, Xiaogang Wang |
| 2014 | CVPR | Preconditioning for Accelerated Iteratively Reweighted Least Squares in Structured Sparsity Reconstruction. | Chen Chen, Junzhou Huang, Lei He, Hongsheng Li |
| 2014 | SMC | A novel demodulation algorithm for MEMS gyroscope digital control system. | Cheng Yang, Hongsheng Li |
| 2012 | CVPR | A hierarchical image clustering cosegmentation framework. | Edward Kim, Hongsheng Li, Xiaolei Huang |
| 2012 | ICARCV | A robust algorithm for tracking object under occlusion and illumination change. | Hong Lu, Hongsheng Li, Wenlin Zou, Shumin Fei |
| 2011 | ICCV | Optimal object matching via convexification and composition. | Hongsheng Li, Junzhou Huang, Shaoting Zhang, Xiaolei Huang |
| 2011 | ICCV | A 3D Laplacian-driven parametric deformable model. | Tian Shen, Xiaolei Huang, Hongsheng Li, Edward Kim, Shaoting Zhang, Junzhou Huang |
| 2010 | CVPR | Object matching with a locally affine-invariant constraint. | Hongsheng Li, Edward Kim, Xiaolei Huang, Lei He |
| 2010 | CVPR | Automatic image annotation using group sparsity. | Shaoting Zhang, Junzhou Huang, Yuchi Huang, Yang Yu, Hongsheng Li, Dimitris N. Metaxas |
| 2010 | MICCAI | Actin Filament Segmentation Using Spatiotemporal Active-Surface and Active-Contour Models. | Hongsheng Li, Tian Shen, Dimitrios Vavylonis, Xiaolei Huang |
| 2009 | CVPR | Global optimization for alignment of generalized shapes. | Hongsheng Li, Tian Shen, Xiaolei Huang |
| 2009 | CVPR | Active volume models for 3D medical image segmentation. | Tian Shen, Hongsheng Li, Zhen Qian, Xiaolei Huang |
| 2009 | MICCAI | Actin Filament Tracking Based on Particle Filters and Stretching Open Active Contour Models. | Hongsheng Li, Tian Shen, Dimitrios Vavylonis, Xiaolei Huang |