Skip to content

Hongsheng Li

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

248

Venues

22

Active years

2009–2026

Best venue rank

A*

Where they publish

Papers

248 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIRethinking Long-tailed Dataset Distillation: A Uni-Level Framework with Unbiased Recovery and Relabeling.Xiao Cui, Yulei Qin, Xinyue Li, Wengang Zhou, Hongsheng Li, Houqiang Li
2026AAAITIDE: Temporal-Aware Sparse Autoencoders for Interpretable Diffusion Transformers in Image Generation.Victor Shea-Jay Huang, Le Zhuo, Yi Xin, Zhaokai Wang, Fu-Yun Wang, Yuchi Wang, Renrui Zhang, Peng Gao, Hongsheng Li
2026AAAIUI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning.Zhengxi Lu, Yuxiang Chai, Yaxuan Guo, Xi Yin, Liang Liu, Hao Wang, Han Xiao, Shuai Ren, Pengxiang Zhao, Guangyi Liu, Guanjing Xiong, Hongsheng Li
2026AAAIFrom Solver to Tutor: Evaluating the Pedagogical Intelligence of LLMs with KMP-Bench.Weikang Shi, Houxing Ren, Junting Pan, Aojun Zhou, Ke Wang, Zimu Lu, Yunqiao Yang, Yuxuan Hu, Linda Wei, Mingjie Zhan, Hongsheng Li
2026AAAISelf-NPO: Data-Free Diffusion Model Enhancement via Truncated Diffusion Fine-Tuning.Fu-Yun Wang, Keqiang Sun, Yao Teng, Xihui Liu, Jiale Yuan, Jiaming Song, Hongsheng Li
2026ACLA3: Android Agent Arena for Mobile GUI Agents with Essential-State Procedural Evaluation.Yuxiang Chai, Shunye Tang, Han Xiao, Weifeng Lin, Hanhao Li, Jiayu Zhang, Liang Liu, Pengxiang Zhao, Guangyi Liu, Guozhi Wang, Shuai Ren, Rongduo Han, Haining Zhang, Siyuan Huang, Hongsheng Li
2026ACLTowards Robust Real-World Spreadsheet Understanding with Multi-Agent Multi-Format Reasoning.Houxing Ren, Mingjie Zhan, Zimu Lu, Ke Wang, Yunqiao Yang, Haotian Hou, Hongsheng Li
2026ACLMathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning.Weikang Shi, Aldrich Yu, Rongyao Fang, Houxing Ren, Ke Wang, Aojun Zhou, Changyao Tian, Xinyu Fu, Yuxuan Hu, Zimu Lu, Linjiang Huang, Si Liu, Rui Liu, Hongsheng Li
2025AAAIM3Net: Multimodal Multi-task Learning for 3D Detection, Segmentation, and Occupancy Prediction in Autonomous Driving.Xuesong Chen, Shaoshuai Shi, Tao Ma, Jingqiu Zhou, Simon See, Ka Chun Cheung, Hongsheng Li
2025AAAILiDAR-LLM: Exploring the Potential of Large Language Models for 3D LiDAR Understanding.Senqiao Yang, Jiaming Liu, Renrui Zhang, Mingjie Pan, Ziyu Guo, Xiaoqi Li, Zehui Chen, Peng Gao, Hongsheng Li, Yandong Guo, Shanghang Zhang
2025AAAIGaussianPainter: Painting Point Cloud into 3D Gaussians with Normal Guidance.Jingqiu Zhou, Lue Fan, Xuesong Chen, Linjiang Huang, Si Liu, Hongsheng Li
2025ACLMathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning.Ke Wang, Junting Pan, Linda Wei, Aojun Zhou, Weikang Shi, Zimu Lu, Han Xiao, Yunqiao Yang, Houxing Ren, Mingjie Zhan, Hongsheng Li
2025ACLAMEX: Android Multi-annotation Expo Dataset for Mobile GUI Agents.Yuxiang Chai, Siyuan Huang, Yazhe Niu, Han Xiao, Liang Liu, Guozhi Wang, Dingyu Zhang, Shuai Ren, Hongsheng Li
2025ACLReflectionCoder: Learning from Reflection Sequence for Enhanced One-off Code Generation.Houxing Ren, Mingjie Zhan, Zhongyuan Wu, Aojun Zhou, Junting Pan, Hongsheng Li
2025ACLProbability-Consistent Preference Optimization for Enhanced LLM Reasoning.Yunqiao Yang, Houxing Ren, Zimu Lu, Ke Wang, Weikang Shi, Aojun Zhou, Junting Pan, Mingjie Zhan, Hongsheng Li
2025CVPRSOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving.Xuesong Chen, Linjiang Huang, Tao Ma, Rongyao Fang, Shaoshuai Shi, Hongsheng Li
2025CVPRAdaptive Markup Language Generation for Contextually-Grounded Visual Document Understanding.Han Xiao, Yina Xie, Guanxin Tan, Yinghao Chen, Rui Hu, Ke Wang, Aojun Zhou, Hao Li, Hao Shao, Xudong Lu, Peng Gao, Yafei Wen, Xiaoxin Chen, Shuai Ren, Hongsheng Li
2025CVPRGS-DiT: Advancing Video Generation with Dynamic 3D Gaussian Fields through Efficient Dense 3D Point Tracking.Weikang Bian, Zhaoyang Huang, Xiaoyu Shi, Yijin Li, Fu-Yun Wang, Hongsheng Li
2025CVPROPTICAL: Leveraging Optimal Transport for Contribution Allocation in Dataset Distillation.Xiao Cui, Yulei Qin, Wengang Zhou, Hongsheng Li, Houqiang Li
2025CVPRDocopilot: Improving Multimodal Models for Document-Level Understanding.Yuchen Duan, Zhe Chen, Yusong Hu, Weiyun Wang, Shenglong Ye, Botian Shi, Lewei Lu, Qibin Hou, Tong Lu, Hongsheng Li, Jifeng Dai, Wenhai Wang
2025CVPRFreeSim: Toward Free-viewpoint Camera Simulation in Driving Scenes.Lue Fan, Hao Zhang, Qitai Wang, Hongsheng Li, Zhaoxiang Zhang
2025CVPRDirectTriGS: Triplane-based Gaussian Splatting Field Representation for 3D Generation.Xiaoliang Ju, Hongsheng Li
2025CVPRSynerGen-VL: Towards Synergistic Image Understanding and Generation with Vision Experts and Token Folding.Hao Li, Changyao Tian, Jie Shao, Xizhou Zhu, Zhaokai Wang, Jinguo Zhu, Wenhan Dou, Xiao-Gang Wang, Hongsheng Li, Lewei Lu, Jifeng Dai
2025CVPRBlueLM-V-3B: Algorithm and System Co-Design for Multimodal Large Language Models on Mobile Devices.Xudong Lu, Yinghao Chen, Cheng Chen, Hui Tan, Boheng Chen, Yina Xie, Rui Hu, Guanxin Tan, Renshou Wu, Yan Hu, Yi Zeng, Lei Wu, Liuyang Bian, Zhaoxiong Wang, Long Liu, Yanzhou Yang, Han Xiao, Aojun Zhou, Yafei Wen, Xiaoxin Chen, Shuai Ren, Hongsheng Li
2025CVPRLet's Verify and Reinforce Image Generation Step by Step.Renrui Zhang, Chengzhuo Tong, Zhizheng Zhao, Ziyu Guo, Haoquan Zhang, Manyuan Zhang, Jiaming Liu, Peng Gao, Hongsheng Li
2025CVPRFlexDrive: Toward Trajectory Flexibility in Driving Scene Gaussian Splatting Reconstruction and Rendering.Jingqiu Zhou, Lue Fan, Linjiang Huang, Xiaoyu Shi, Si Liu, Zhaoxiang Zhang, Hongsheng Li
2025EMNLPLM-Searcher: Cross-domain Neural Architecture Search with LLMs via Unified Numerical Encoding.Yuxuan Hu, Jihao Liu, Ke Wang, Jinliang Zheng, Weikang Shi, Manyuan Zhang, Qi Dou, Rui Liu, Aojun Zhou, Hongsheng Li
2025EMNLPSmartBench: Is Your LLM Truly a Good Chinese Smartphone Assistant?Xudong Lu, Haohao Gao, Renshou Wu, Shuai Ren, Xiaoxin Chen, Hongsheng Li, Fangyuan Li
2025EMNLPAlignment with Fill-In-the-Middle for Enhancing Code Generation.Houxing Ren, Zimu Lu, Weikang Shi, Haotian Hou, Yunqiao Yang, Ke Wang, Aojun Zhou, Junting Pan, Mingjie Zhan, Hongsheng Li
2025ICCVPUMA: Empowering Unified MLLM with Multi-Granular Visual Generation.Rongyao Fang, Chengqi Duan, Kun Wang, Hao Li, Linjiang Huang, Hao Tian, Xingyu Zeng, Rui Zhao, Jifeng Dai, Hongsheng Li, Xihui Liu
2025ICCVCameraCtrl II: Dynamic Scene Exploration via Camera-Controlled Video Diffusion Models.Hao He, Ceyuan Yang, Shanchuan Lin, Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li
2025ICCVGenieBlue: Integrating Both Linguistic and Multimodal Capabilities for Large Language Models on Mobile Devices.Xudong Lu, Yinghao Chen, Renshou Wu, Haohao Gao, Xi Chen, Xue Yang, Xiangyu Zhao, Aojun Zhou, Fangyuan Li, Yafei Wen, Xiaoxin Chen, Shuai Ren, Hongsheng Li
2025ICCVHPSv3: Towards Wide-Spectrum Human Preference Score.Yuhang Ma, Xiaoshi Wu, Keqiang Sun, Hongsheng Li
2025ICCVLumina-Image 2.0: a Unified and Efficient Image Generative Framework.Qi Qin, Le Zhuo, Yi Xin, Ruoyi Du, Zhen Li, Bin Fu, Yiting Lu, Xinyue Li, Dongyang Liu, Xiangyang Zhu, Will Beddow, Erwann Millon, Victor Perez, Wenhai Wang, Yu Qiao, Bo Zhang, Xiaohong Liu, Hongsheng Li, Chang Xu, Peng Gao
2025ICCVFrom Reflection to Perfection: Scaling Inference-Time Optimization for Text-to-Image Diffusion Models via Reflection Tuning.Le Zhuo, Liangbing Zhao, Sayak Paul, Yue Liao, Renrui Zhang, Yi Xin, Peng Gao, Mohamed Elhoseiny, Hongsheng Li
2025ICCVConsistentCity: Semantic Flow-Guided Occupancy DiT for Temporally Consistent Driving Scene Synthesis.Benjin Zhu, Xiaogang Wang, Hongsheng Li
2025ICLRPoint Cluster: A Compact Message Unit for Communication-Efficient Collaborative Perception.Zihan Ding, Jiahui Fu, Si Liu, Hongyu Li, Siheng Chen, Hongsheng Li, Shifeng Zhang, Xu Zhou
2025ICLRVision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures.Yuchen Duan, Weiyun Wang, Zhe Chen, Xizhou Zhu, Lewei Lu, Tong Lu, Yu Qiao, Hongsheng Li, Jifeng Dai, Wenhai Wang
2025ICLRLumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation.Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xie, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, Tong He, Jingwen He, Junjun He, Yu Qiao, Hongsheng Li
2025ICLRCameraCtrl: Enabling Camera Control for Video Diffusion Models.Hao He, Yinghao Xu, Yuwei Guo, Gordon Wetzstein, Bo Dai, Hongsheng Li, Ceyuan Yang
2025ICLRMixture Compressor for Mixture-of-Experts LLMs Gains More.Wei Huang, Yue Liao, Jianhui Liu, Ruifei He, Haoru Tan, Shiming Zhang, Hongsheng Li, Si Liu, Xiaojuan Qi
2025ICLRMMSearch: Unveiling the Potential of Large Models as Multi-modal Search Engines.Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanmin Wu, Jiayi Lei, Pengshuo Qiu, Pan Lu, Zehui Chen, Guanglu Song, Peng Gao, Yu Liu, Chunyuan Li, Hongsheng Li
2025ICLRDraw-and-Understand: Leveraging Visual Prompts to Enable MLLMs to Comprehend What You Want.Weifeng Lin, Xinyu Wei, Ruichuan An, Peng Gao, Bocheng Zou, Yulin Luo, Siyuan Huang, Shanghang Zhang, Hongsheng Li
2025ICLRPixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions.Weifeng Lin, Xinyu Wei, Renrui Zhang, Le Zhuo, Shitian Zhao, Siyuan Huang, Junlin Xie, Peng Gao, Hongsheng Li
2025ICLRMathCoder2: Better Math Reasoning from Continued Pretraining on Model-translated Mathematical Code.Zimu Lu, Aojun Zhou, Ke Wang, Houxing Ren, Weikang Shi, Junting Pan, Mingjie Zhan, Hongsheng Li
2025ICLRLLaVA-MoD: Making LLaVA Tiny via MoE-Knowledge Distillation.Fangxun Shu, Yue Liao, Lei Zhang, Le Zhuo, Chenning Xu, Guanghao Zhang, Haonan Shi, Long Chan, Tao Zhong, Zhelun Yu, Wanggui He, Siming Fu, Haoyuan Li, Si Liu, Hongsheng Li, Hao Jiang
2025ICLRRectified Diffusion: Straightness Is Not Your Need in Rectified Flow.Fu-Yun Wang, Ling Yang, Zhaoyang Huang, Mengdi Wang, Hongsheng Li
2025ICLRDiffusion-NPO: Negative Preference Optimization for Better Preference Aligned Generation of Diffusion Models.Fu-Yun Wang, Yunhao Shui, Jingtan Piao, Keqiang Sun, Hongsheng Li
2025ICLRTowards Realistic UAV Vision-Language Navigation: Platform, Benchmark, and Methodology.Xiangyu Wang, Donglin Yang, Ziqin Wang, Hohin Kwan, Jinyu Chen, Wenjun Wu, Hongsheng Li, Yue Liao, Si Liu
2025ICLRMAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine.Renrui Zhang, Xinyu Wei, Dongzhi Jiang, Ziyu Guo, Yichi Zhang, Chengzhuo Tong, Jiaming Liu, Aojun Zhou, Shanghang Zhang, Peng Gao, Hongsheng Li
2025ICLRSmartPretrain: Model-Agnostic and Dataset-Agnostic Representation Learning for Motion Prediction.Yang Zhou, Hao Shao, Letian Wang, Steven L. Waslander, Hongsheng Li, Yu Liu
2025ICMLMME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency.Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanwei Li, Yu Qi, Xinyan Chen, Liuhui Wang, Jianhan Jin, Claire Guo, Shen Yan, Bo Zhang, Chaoyou Fu, Peng Gao, Hongsheng Li
2025ICMLOne Leaf Reveals the Season: Occlusion-Based Contrastive Learning with Semantic-Aware Views for Efficient Visual Representation.Xiaoyu Yang, Lijian Xu, Hongsheng Li, Shaoting Zhang
2025ICMLEasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM.Zhuofan Zong, Dongzhi Jiang, Bingqi Ma, Guanglu Song, Hao Shao, Dazhong Shen, Yu Liu, Hongsheng Li
2025IROSSKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation.Xin Li, Siyuan Huang, Qiaojun Yu, Zhengkai Jiang, Ce Hao, Yimeng Zhu, Hongsheng Li, Peng Gao, Cewu Lu
2025ICRAUniAff: A Unified Representation of Affordances for Tool Usage and Articulation with Vision-Language Models.Qiaojun Yu, Siyuan Huang, Xibin Yuan, Zhengkai Jiang, Ce Hao, Xin Li, Haonan Chang, Junbo Wang, Liu Liu, Hongsheng Li, Peng Gao, Cewu Lu
2025MICCAIVBCD: A Voxel-Based Framework for Personalized Dental Crown Design.Linda Wei, Chang Liu, Wenran Zhang, Zengji Zhang, Shaoting Zhang, Hongsheng Li
2024ACLNot All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models.Xudong Lu, Qi Liu, Yuhui Xu, Aojun Zhou, Siyuan Huang, Bo Zhang, Junchi Yan, Hongsheng Li
2024ACLMathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs.Zimu Lu, Aojun Zhou, Houxing Ren, Ke Wang, Weikang Shi, Junting Pan, Mingjie Zhan, Hongsheng Li
2024ACLEmpowering Character-level Text Infilling by Eliminating Sub-Tokens.Houxing Ren, Mingjie Zhan, Zhongyuan Wu, Hongsheng Li
2024CoRLA3VLM: Actionable Articulation-Aware Vision Language Model.Siyuan Huang, Haonan Chang, Yuhan Liu, Yimeng Zhu, Hao Dong, Abdeslam Boularias, Peng Gao, Hongsheng Li
2024CVPRDiffInDScene: Diffusion-Based High-Quality 3D Indoor Scene Generation.Xiaoliang Ju, Zhaoyang Huang, Yijiin Li, Guofeng Zhang, Yu Qiao, Hongsheng Li
2024CVPRAuto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft.Hao Li, Xue Yang, Zhaokai Wang, Xizhou Zhu, Jie Zhou, Yu Qiao, Xiaogang Wang, Hongsheng Li, Lewei Lu, Jifeng Dai
2024CVPRGLID: Pre-training a Generalist Encoder-Decoder Vision Model.Jihao Liu, Jinliang Zheng, Yu Liu, Hongsheng Li
2024CVPRLMDrive: Closed-Loop End-to-End Driving with Large Language Models.Hao Shao, Yuxuan Hu, Letian Wang, Guanglu Song, Steven L. Waslander, Yu Liu, Hongsheng Li
2024CVPREfficient Deformable ConvNets: Rethinking Dynamic and Sparse Operator for Vision Applications.Yuwen Xiong, Zhiqi Li, Yuntao Chen, Feng Wang, Xizhou Zhu, Jiapeng Luo, Wenhai Wang, Tong Lu, Hongsheng Li, Yu Qiao, Lewei Lu, Jie Zhou, Jifeng Dai
2024CVPRSmartRefine: A Scenario-Adaptive Refinement Framework for Efficient Motion Prediction.Yang Zhou, Hao Shao, Letian Wang, Steven L. Waslander, Hongsheng Li, Yu Liu
2024ECCVFouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis.Linjiang Huang, Rongyao Fang, Aiping Zhang, Guanglu Song, Si Liu, Yu Liu, Hongsheng Li
2024ECCVDelving Deep into Engagement Prediction of Short Videos.Dasong Li, Wenjie Li, Baili Lu, Hongsheng Li, Sizhuo Ma, Gurunandan Krishnan, Jian Wang
2024ECCVSPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models.Ziyi Lin, Dongyang Liu, Renrui Zhang, Peng Gao, Longtian Qiu, Han Xiao, Han Qiu, Wenqi Shao, Keqin Chen, Jiaming Han, Siyuan Huang, Yichi Zhang, Xuming He, Yu Qiao, Hongsheng Li
2024ECCVBlinkVision: A Benchmark for Optical Flow, Scene Flow and Point Tracking Estimation Using RGB Frames and Events.Yijin Li, Yichen Shen, Zhaoyang Huang, Shuo Chen, Weikang Bian, Xiaoyu Shi, Fu-Yun Wang, Keqiang Sun, Hujun Bao, Zhaopeng Cui, Guofeng Zhang, Hongsheng Li
2024ECCVPonymation: Learning Articulated 3D Animal Motions from Unlabeled Online Videos.Keqiang Sun, Dor Litvak, Yunzhi Zhang, Hongsheng Li, Jiajun Wu, Shangzhe Wu
2024ECCVAny2Point: Empowering Any-Modality Large Models for Efficient 3D Understanding.Yiwen Tang, Ray Zhang, Jiaming Liu, Zoey Guo, Bin Zhao, Zhigang Wang, Peng Gao, Hongsheng Li, Dong Wang, Xuelong Li
2024ECCVZoLA: Zero-Shot Creative Long Animation Generation with Short Video Model.Fu-Yun Wang, Zhaoyang Huang, Qiang Ma, Guanglu Song, Xudong Lu, Weikang Bian, Yijin Li, Yu Liu, Hongsheng Li
2024ECCVGiT: Towards Generalist Vision Transformer Through Universal Language Interface.Haiyang Wang, Hao Tang, Li Jiang, Shaoshuai Shi, Muhammad Ferjad Naeem, Hongsheng Li, Bernt Schiele, Liwei Wang
2024ECCVBe-Your-Outpainter: Mastering Video Outpainting Through Input-Specific Adaptation.Fu-Yun Wang, Xiaoshi Wu, Zhaoyang Huang, Xiaoyu Shi, Dazhong Shen, Guanglu Song, Yu Liu, Hongsheng Li
2024ECCVDailyDVS-200: A Comprehensive Benchmark Dataset for Event-Based Action Recognition.Qi Wang, Zhou Xu, Yuming Lin, Jingtao Ye, Hongsheng Li, Guangming Zhu, Syed Afaq Ali Shah, Mohammed Bennamoun, Liang Zhang
2024ECCVDeep Reward Supervisions for Tuning Text-to-Image Diffusion Models.Xiaoshi Wu, Yiming Hao, Manyuan Zhang, Keqiang Sun, Zhaoyang Huang, Guanglu Song, Yu Liu, Hongsheng Li
2024ECCVUnmasking Bias in Diffusion Model Training.Hu Yu, Li Shen, Jie Huang, Hongsheng Li, Feng Zhao
2024ECCVMATHVERSE: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems?Renrui Zhang, Dongzhi Jiang, Yichi Zhang, Haokun Lin, Ziyu Guo, Pengshuo Qiu, Aojun Zhou, Pan Lu, Kai-Wei Chang, Yu Qiao, Peng Gao, Hongsheng Li
2024ECCVThree Things We Need to Know About Transferring Stable Diffusion to Visual Dense Prediction Tasks.Manyuan Zhang, Guanglu Song, Xiaoyu Shi, Yu Liu, Hongsheng Li
2024ECCVnuCraft: Crafting High Resolution 3D Semantic Occupancy for Unified 3D Scene Understanding.Benjin Zhu, Zhe Wang, Hongsheng Li
2024ICLRADDP: Learning General Representations for Image Recognition and Generation with Alternating Denoising Diffusion Process.Changyao Tian, Chenxin Tao, Jifeng Dai, Hao Li, Ziheng Li, Lewei Lu, Xiaogang Wang, Hongsheng Li, Gao Huang, Xizhou Zhu
2024ICLRMathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning.Ke Wang, Houxing Ren, Aojun Zhou, Zimu Lu, Sichun Luo, Weikang Shi, Renrui Zhang, Linqi Song, Mingjie Zhan, Hongsheng Li
2024ICLRPersonalize Segment Anything Model with One Shot.Renrui Zhang, Zhengkai Jiang, Ziyu Guo, Shilin Yan, Junting Pan, Hao Dong, Yu Qiao, Peng Gao, Hongsheng Li
2024ICLRLLaMA-Adapter: Efficient Fine-tuning of Large Language Models with Zero-initialized Attention.Renrui Zhang, Jiaming Han, Chris Liu, Aojun Zhou, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao
2024ICLRSolving Challenging Math Word Problems Using GPT-4 Code Interpreter with Code-based Self-Verification.Aojun Zhou, Ke Wang, Zimu Lu, Weikang Shi, Sichun Luo, Zipeng Qin, Shaoqing Lu, Anya Jia, Linqi Song, Mingjie Zhan, Hongsheng Li
2024ICMLSPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models.Dongyang Liu, Renrui Zhang, Longtian Qiu, Siyuan Huang, Weifeng Lin, Shitian Zhao, Shijie Geng, Ziyi Lin, Peng Jin, Kaipeng Zhang, Wenqi Shao, Chao Xu, Conghui He, Junjun He, Hao Shao, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao
2024ICMLSPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models.Xudong Lu, Aojun Zhou, Yuhui Xu, Renrui Zhang, Peng Gao, Hongsheng Li
2024ICRAVeloVox: A Low-Cost and Accurate 4D Object Detector with Single-Frame Point Cloud of Livox LiDAR.Tao Ma, Zhiwei Zheng, Hongbin Zhou, Xinyu Cai, Xuemeng Yang, Yikang Li, Botian Shi, Hongsheng Li
2024IROSManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models.Siyuan Huang, Iaroslav Ponomarenko, Zhengkai Jiang, Xiaoqi Li, Xiaobin Hu, Peng Gao, Hongsheng Li, Hao Dong
2024SIGGRAPHMotion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling.Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li
2024SiggraphAAnimateLCM: Computation-Efficient Personalized Style Video Generation without Personalized Video Data.Fu-Yun Wang, Zhaoyang Huang, Weikang Bian, Xiaoyu Shi, Keqiang Sun, Guanglu Song, Yu Liu, Hongsheng Li
2023CVPRAdaptive Zone-aware Hierarchical Planner for Vision-Language Navigation.Chen Gao, Xingyu Peng, Mi Yan, He Wang, Lirong Yang, Haibing Ren, Hongsheng Li, Si Liu
2023CVPRA Simple Baseline for Video Restoration with Grouped Spatial-Temporal Shift.Dasong Li, Xiaoyu Shi, Yi Zhang, Ka Chun Cheung, Simon See, Xiaogang Wang, Hongwei Qin, Hongsheng Li
2023CVPRMixMAE: Mixed and Masked Autoencoder for Efficient Pretraining of Hierarchical Vision Transformers.Jihao Liu, Xin Huang, Jinliang Zheng, Yu Liu, Hongsheng Li
2023CVPRUni-Perceiver v2: A Generalist Model for Large-Scale Vision and Vision-Language Tasks.Hao Li, Jinguo Zhu, Xiaohu Jiang, Xizhou Zhu, Hongsheng Li, Chun Yuan, Xiaohua Wang, Yu Qiao, Xiaogang Wang, Wenhai Wang, Jifeng Dai
2023CVPRPATS: Patch Area Transportation with Subdivision for Local Feature Matching.Junjie Ni, Yijin Li, Zhaoyang Huang, Hongsheng Li, Hujun Bao, Zhaopeng Cui, Guofeng Zhang
2023CVPRReasonNet: End-to-End Driving with Temporal and Global Reasoning.Hao Shao, Letian Wang, Ruobing Chen, Steven L. Waslander, Hongsheng Li, Yu Liu
2023CVPRFlowFormer++: Masked Cost Volume Autoencoding for Pretraining Optical Flow Estimation.Xiaoyu Shi, Zhaoyang Huang, Dasong Li, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li
2023CVPRInternImage: Exploring Large-Scale Vision Foundation Models with Deformable Convolutions.Wenhai Wang, Jifeng Dai, Zhe Chen, Zhenhang Huang, Zhiqi Li, Xizhou Zhu, Xiaowei Hu, Tong Lu, Lewei Lu, Hongsheng Li, Xiaogang Wang, Yu Qiao
2023CVPRCORA: Adapting CLIP for Open-Vocabulary Detection with Region Prompting and Anchor Pre-Matching.Xiaoshi Wu, Feng Zhu, Rui Zhao, Hongsheng Li
2023CVPRPrompt, Generate, Then Cache: Cascade of Foundation Models Makes Strong Few-Shot Learners.Renrui Zhang, Xiangfei Hu, Bohao Li, Siyuan Huang, Hanqiu Deng, Yu Qiao, Peng Gao, Hongsheng Li
2023CVPRLearning 3D Representations from 2D Pre-Trained Models via Image-to-Point Masked Autoencoders.Renrui Zhang, Liuhui Wang, Yu Qiao, Peng Gao, Hongsheng Li
2023CVPRStarting from Non-Parametric Networks for 3D Point Cloud Analysis.Renrui Zhang, Liuhui Wang, Yali Wang, Peng Gao, Hongsheng Li, Jianbo Shi
2023CVPRImproving Weakly Supervised Temporal Action Localization by Bridging Train-Test Gap in Pseudo Labels.Jingqiu Zhou, Linjiang Huang, Liang Wang, Si Liu, Hongsheng Li
2023CVPRConQueR: Query Contrast Voxel-DETR for 3D Object Detection.Benjin Zhu, Zhe Wang, Shaoshuai Shi, Hang Xu, Lanqing Hong, Hongsheng Li
2023ICCVTrajectoryFormer: 3D Object Tracking Transformer with Predictive Trajectory Hypotheses.Xuesong Chen, Shaoshuai Shi, Chao Zhang, Benjin Zhu, Qiang Wang, Ka Chun Cheung, Simon See, Hongsheng Li
2023ICCVOmnidirectional Information Gathering for Knowledge Transfer-based Audio-Visual Navigation.Jinyu Chen, Wenguan Wang, Si Liu, Hongsheng Li, Yi Yang
2023ICCVSimulating Fluids in Real-World Still Images.Siming Fan, Jingtan Piao, Chen Qian, Hongsheng Li, Kwan-Yee Lin
2023ICCVGeoMIM: Towards Better 3D Knowledge Transfer via Masked Image Modeling for Multi-view 3D Understanding.Jihao Liu, Tai Wang, Boxiao Liu, Qihang Zhang, Yu Liu, Hongsheng Li
2023ICCVUrban Radiance Field Representation with Deformable Neural Mesh Primitives.Fan Lu, Yan Xu, Guang Chen, Hongsheng Li, Kwan-Yee Lin, Changjun Jiang
2023ICCVDetZero: Rethinking Offboard 3D Object Detection with Long-term Sequential Point Clouds.Tao Ma, Xuemeng Yang, Hongbin Zhou, Xin Li, Botian Shi, Junjie Liu, Yuchen Yang, Zhizheng Liu, Liang He, Yu Qiao, Yikang Li, Hongsheng Li
2023ICCVVideoFlow: Exploiting Temporal Cues for Multi-frame Optical Flow Estimation.Xiaoyu Shi, Zhaoyang Huang, Weikang Bian, Dasong Li, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li
2023ICCVHuman Preference Score: Better Aligning Text-to-image Models with Human Preference.Xiaoshi Wu, Keqiang Sun, Feng Zhu, Rui Zhao, Hongsheng Li
2023ICCVNDC-Scene: Boost Monocular 3D Semantic Scene Completion in Normalized Device Coordinates Space.Jiawei Yao, Chuming Li, Keqiang Sun, Yingjie Cai, Hao Li, Wanli Ouyang, Hongsheng Li
2023ICCVMonoDETR: Depth-guided Transformer for Monocular 3D Object Detection.Renrui Zhang, Han Qiu, Tai Wang, Ziyu Guo, Ziteng Cui, Yu Qiao, Hongsheng Li, Peng Gao
2023ICCVDecoupled DETR: Spatially Disentangling Localization and Classification for Improved End-to-End Object Detection.Manyuan Zhang, Guanglu Song, Yu Liu, Hongsheng Li
2023ICCVSparseMAE: Sparse Training Meets Masked Autoencoders.Aojun Zhou, Yang Li, Zipeng Qin, Jianbo Liu, Junting Pan, Renrui Zhang, Rui Zhao, Peng Gao, Hongsheng Li
2023ICCVTemporal Enhanced Training of Multi-view 3D Object Detector via Historical Object Prediction.Zhuofan Zong, Dongzhi Jiang, Guanglu Song, Zeyue Xue, Jingyong Su, Hongsheng Li, Yu Liu
2023IROSBlinkFlow: A Dataset to Push the Limits of Event-Based Optical Flow Estimation.Yijin Li, Zhaoyang Huang, Shuo Chen, Xiaoyu Shi, Hongsheng Li, Hujun Bao, Zhaopeng Cui, Guofeng Zhang
2022BMVCTask Generalizable Spatial and Texture Aware Image Downsizing Network.Lin Ma, Weiming Li, Hongsheng Li, Qiang Wang, Ji-Yeon Kim
2022BMVCUnleashing the Potential of Vision-Language Models for Long-Tailed Visual Recognition.Teli Ma, Shijie Geng, Mengmeng Wang, Sheng Xu, Hongsheng Li, Baochang Zhang, Peng Gao, Yu Qiao
2022CoRLSafety-Enhanced Autonomous Driving Using Interpretable Sensor Fusion Transformer.Hao Shao, Letian Wang, Ruobing Chen, Hongsheng Li, Yu Liu
2022CVPRLearning a Structured Latent Space for Unsupervised Point Cloud Completion.Yingjie Cai, Kwan-Yee Lin, Chao Zhang, Qiang Wang, Xiaogang Wang, Hongsheng Li
2022CVPRWeakly Supervised Temporal Action Localization via Representative Snippet Knowledge Propagation.Linjiang Huang, Liang Wang, Hongsheng Li
2022CVPRAutoLoss-Zero: Searching Loss Functions from Scratch for Generic Tasks.Hao Li, Tianwen Fu, Jifeng Dai, Hongsheng Li, Gao Huang, Xizhou Zhu
2022CVPRRBGNet: Ray-based Grouping for 3D Object Detection.Haiyang Wang, Shaoshuai Shi, Ze Yang, Rongyao Fang, Qi Qian, Hongsheng Li, Bernt Schiele, Liwei Wang
2022CVPRRNNPose: Recurrent 6-DoF Object Pose Refinement with Robust Correspondence Field Estimation and Pose Optimization.Yan Xu, Kwan-Yee Lin, Guofeng Zhang, Xiaogang Wang, Hongsheng Li
2022CVPRPointCLIP: Point Cloud Understanding by CLIP.Renrui Zhang, Ziyu Guo, Wei Zhang, Kunchang Li, Xupeng Miao, Bin Cui, Yu Qiao, Peng Gao, Hongsheng Li
2022CVPRIDR: Self-Supervised Image Denoising via Iterative Data Refinement.Yi Zhang, Dasong Li, Ka Lung Law, Xiaogang Wang, Hongwei Qin, Hongsheng Li
2022CVPRUni-Perceiver: Pre-training Unified Architecture for Generic Perception for Zero-shot and Few-shot Tasks.Xizhou Zhu, Jinguo Zhu, Hao Li, Xiaoshi Wu, Hongsheng Li, Xiaohua Wang, Jifeng Dai
2022ECCVMPPNet: Multi-frame Feature Intertwining with Proxy Points for 3D Temporal Object Detection.Xuesong Chen, Shaoshuai Shi, Benjin Zhu, Ka Chun Cheung, Hang Xu, Hongsheng Li
2022ECCVFlowFormer: A Transformer Architecture for Optical Flow.Zhaoyang Huang, Xiaoyu Shi, Chao Zhang, Qiang Wang, Ka Chun Cheung, Hongwei Qin, Jifeng Dai, Hongsheng Li
2022ECCVFrozen CLIP Models are Efficient Video Learners.Ziyi Lin, Shijie Geng, Renrui Zhang, Peng Gao, Gerard de Melo, Xiaogang Wang, Jifeng Dai, Yu Qiao, Hongsheng Li
2022ECCVUniNet: Unified Architecture Search with Convolution, Transformer, and MLP.Jihao Liu, Xin Huang, Guanglu Song, Hongsheng Li, Yu Liu
2022ECCVTokenMix: Rethinking Image Mixing for Data Augmentation in Vision Transformers.Jihao Liu, Boxiao Liu, Hang Zhou, Hongsheng Li, Yu Liu
2022ECCVLearning Degradation Representations for Image Deblurring.Dasong Li, Yi Zhang, Ka Chun Cheung, Xiaogang Wang, Hongwei Qin, Hongsheng Li
2022ECCVEdgeViTs: Competing Light-Weight CNNs on Mobile Devices with Vision Transformers.Junting Pan, Adrian Bulat, Fuwen Tan, Xiatian Zhu, Lukasz Dudziak, Hongsheng Li, Georgios Tzimiropoulos, Brais Martnez
2022ECCVTowards Robust Face Recognition with Comprehensive Search.Manyuan Zhang, Guanglu Song, Yu Liu, Hongsheng Li
2022ECCVTip-Adapter: Training-Free Adaption of CLIP for Few-Shot Classification.Renrui Zhang, Wei Zhang, Rongyao Fang, Peng Gao, Kunchang Li, Jifeng Dai, Yu Qiao, Hongsheng Li
2022ICLRUniFormer: Unified Transformer for Efficient Spatial-Temporal Representation Learning.Kunchang Li, Yali Wang, Peng Gao, Guanglu Song, Yu Liu, Hongsheng Li, Yu Qiao
2022IJCNNSpatial Parsing and Dynamic Temporal Pooling networks for Human-Object Interaction detection.Hongsheng Li, Guangming Zhu, Wu Zhen, Lan Ni, Peiyi Shen, Liang Zhang, Ning Wang, Cong Hua
2021AAAIA Unified Multi-Scenario Attacking Network for Visual Object Tracking.Xuesong Chen, Canmiao Fu, Feng Zheng, Yong Zhao, Hongsheng Li, Ping Luo, Guo-Jun Qi
2021AAAIDynamic Graph Representation Learning for Video Dialog via Multi-Modal Shuffled Transformers.Shijie Geng, Peng Gao, Moitreya Chatterjee, Chiori Hori, Jonathan Le Roux, Yongfeng Zhang, Hongsheng Li, Anoop Cherian
2021AAAIREFINE: Prediction Fusion Network for Panoptic Segmentation.Jiawei Ren, Cunjun Yu, Zhongang Cai, Mingyuan Zhang, Chongsong Chen, Haiyu Zhao, Shuai Yi, Hongsheng Li
2021BMVCEnd-to-End Object Detection with Adaptive Clustering Transformer.Minghang Zheng, Peng Gao, Renrui Zhang, Kunchang Li, Hongsheng Li, Hao Dong
2021CVPRDivCo: Diverse Conditional Image Synthesis via Contrastive Generative Adversarial Network.Rui Liu, Yixiao Ge, Ching Lam Choi, Xiaogang Wang, Hongsheng Li
2021CVPRSemantic Scene Completion via Integrating Instances and Scene In-the-Loop.Yingjie Cai, Xuesong Chen, Chao Zhang, Kwan-Yee Lin, Xiaogang Wang, Hongsheng Li
2021CVPRLiDAR-Based Panoptic Segmentation via Dynamic Shifting Network.Fangzhou Hong, Hui Zhou, Xinge Zhu, Hongsheng Li, Ziwei Liu
2021CVPRVS-Net: Voting With Segmentation for Visual Localization.Zhaoyang Huang, Han Zhou, Yijin Li, Bangbang Yang, Yan Xu, Xiaowei Zhou, Hujun Bao, Guofeng Zhang, Hongsheng Li
2021CVPRActor-Context-Actor Relation Network for Spatio-Temporal Action Localization.Junting Pan, Siyu Chen, Mike Zheng Shou, Yu Liu, Jing Shao, Hongsheng Li
2021CVPRInverting Generative Adversarial Renderer for Face Reconstruction.Jingtan Piao, Keqiang Sun, Quan Wang, Kwan-Yee Lin, Hongsheng Li
2021CVPRST3D: Self-Training for Unsupervised Domain Adaptation on 3D Object Detection.Jihan Yang, Shaoshuai Shi, Zhe Wang, Hongsheng Li, Xiaojuan Qi
2021CVPRRefining Pseudo Labels With Clustering Consensus Over Generations for Unsupervised Object Re-Identification.Xiao Zhang, Yixiao Ge, Yu Qiao, Hongsheng Li
2021CVPRCylindrical and Asymmetrical 3D Convolution Networks for LiDAR Segmentation.Xinge Zhu, Hui Zhou, Tai Wang, Fangzhou Hong, Yuexin Ma, Wei Li, Hongsheng Li, Dahua Lin
2021ICCVFast Convergence of DETR with Spatially Modulated Co-Attention.Peng Gao, Minghang Zheng, Xiaogang Wang, Jifeng Dai, Hongsheng Li
2021ICCVFuseFormer: Fusing Fine-Grained Information in Transformers for Video Inpainting.Rui Liu, Hanming Deng, Yangyi Huang, Xiaoyu Shi, Lewei Lu, Wenxiu Sun, Xiaogang Wang, Jifeng Dai, Hongsheng Li
2021ICCVLIGA-Stereo: Learning LiDAR Geometry Aware Representations for Stereo-based 3D Detector.Xiaoyang Guo, Shaoshuai Shi, Xiaogang Wang, Hongsheng Li
2021ICCVForeground-Action Consistency Network for Weakly Supervised Temporal Action Localization.Linjiang Huang, Liang Wang, Hongsheng Li
2021ICCVUnsupervised Domain Adaptive 3D Detection with Multi-Level Consistency.Zhipeng Luo, Zhongang Cai, Changqing Zhou, Gongjie Zhang, Haiyu Zhao, Shuai Yi, Shijian Lu, Hongsheng Li, Shanghang Zhang, Ziwei Liu
2021ICCVEncoder-decoder with Multi-level Attention for 3D Human Shape and Pose Estimation.Ziniu Wan, Zhengjia Li, Maoqing Tian, Jianbo Liu, Shuai Yi, Hongsheng Li
2021ICCVRethinking Noise Synthesis and Modeling in Raw Denoising.Yi Zhang, Hongwei Qin, Xiaogang Wang, Hongsheng Li
2021ICCVProgressive Correspondence Pruning by Consensus Learning.Chen Zhao, Yixiao Ge, Feng Zhu, Rui Zhao, Hongsheng Li, Mathieu Salzmann
2021ICLRLearning N: M Fine-grained Structured Sparse Neural Networks From Scratch.Aojun Zhou, Yukun Ma, Junnan Zhu, Jianbo Liu, Zhijie Zhang, Kun Yuan, Wenxiu Sun, Hongsheng Li
2021MICCAIHybrid Supervision Learning for Pathology Whole Slide Image Classification.Jiahui Li, Wen Chen, Xiaodi Huang, Shuang Yang, Zhiqiang Hu, Qi Duan, Dimitris N. Metaxas, Hongsheng Li, Shaoting Zhang
2021MICCAICategorical Relation-Preserving Contrastive Knowledge Distillation for Medical Image Classification.Xiaohan Xing, Yuenan Hou, Hang Li, Yixuan Yuan, Hongsheng Li, Max Q.-H. Meng
2021WACVEfficient Attention: Attention with Linear Complexities.Zhuoran Shen, Mingyuan Zhang, Haiyu Zhao, Shuai Yi, Hongsheng Li
2020AAAIMonocular 3D Object Detection with Decoupled Structured Polygon Estimation and Height-Guided Depth Estimation.Yingjie Cai, Buyu Li, Zeyu Jiao, Hongsheng Li, Xingyu Zeng, Xiaogang Wang
2020BMVCMagnifierNet: Towards Semantic Adversary and Fusion for Person Re-identification.Yushi Lan, Yuan Liu, Xinchi Zhou, Maoqing Tian, Xuesen Zhang, Shuai Yi, Hongsheng Li
2020CoRLSelfVoxeLO: Self-supervised LiDAR Odometry with Voxel-based Deep Neural Networks.Yan Xu, Zhaoyang Huang, Kwan-Yee Lin, Xinge Zhu, Jianping Shi, Hujun Bao, Guofeng Zhang, Hongsheng Li
2020CVPR3D Sketch-Aware Semantic Scene Completion via Semi-Supervised Structure Prior.Xiaokang Chen, Kwan-Yee Lin, Chen Qian, Gang Zeng, Hongsheng Li
2020CVPRRobust Superpixel-Guided Attentional Adversarial Attack.Xiaoyi Dong, Jiangfan Han, Dongdong Chen, Jiayang Liu, Huanyu Bian, Zehua Ma, Hongsheng Li, Xiaogang Wang, Weiming Zhang, Nenghai Yu
2020CVPRStereoGAN: Bridging Synthetic-to-Real Domain Gap by Joint Optimization of Domain Translation and Stereo Matching.Rui Liu, Chengxi Yang, Wenxiu Sun, Xiaogang Wang, Hongsheng Li
2020CVPRPV-RCNN: Point-Voxel Feature Set Abstraction for 3D Object Detection.Shaoshuai Shi, Chaoxu Guo, Li Jiang, Zhe Wang, Jianping Shi, Xiaogang Wang, Hongsheng Li
2020ECCVBi-directional Cross-Modality Feature Propagation with Separation-and-Aggregation Gate for RGB-D Semantic Segmentation.Xiaokang Chen, Kwan-Yee Lin, Jingbo Wang, Wayne Wu, Chen Qian, Hongsheng Li, Gang Zeng
2020ECCVSelf-supervising Fine-Grained Region Similarities for Large-Scale Image Localization.Yixiao Ge, Haibo Wang, Feng Zhu, Rui Zhao, Hongsheng Li
2020ECCVLearning to Predict Context-Adaptive Convolution for Semantic Segmentation.Jianbo Liu, Junjun He, Yu Qiao, Jimmy S. Ren, Hongsheng Li
2020ECCVEfficientFCN: Holistically-Guided Decoding for Semantic Segmentation.Jianbo Liu, Junjun He, Jiawei Zhang, Jimmy S. Ren, Hongsheng Li
2020ECCVOpen-Edit: Open-Domain Image Manipulation with Open-Vocabulary Instructions.Xihui Liu, Zhe Lin, Jianming Zhang, Handong Zhao, Quan Tran, Xiaogang Wang, Hongsheng Li
2020ECCVRBF-Softmax: Learning Deep Representative Prototypes with Radial Basis Function Softmax.Xiao Zhang, Rui Zhao, Yu Qiao, Hongsheng Li
2020ICLRMutual Mean-Teaching: Pseudo Label Refinery for Unsupervised Domain Adaptation on Person Re-identification.Yixiao Ge, Dapeng Chen, Hongsheng Li
2020ICPRNonlinear Temporal Correlation Based Network for Action Recognition.Hongsheng Li, Weiwei Zhang, Guangming Zhu, Liang Zhang, Peiyi Shen, Juan Song
2020MICCAIMulti-organ Segmentation via Co-training Weight-Averaged Models from Few-Organ Datasets.Rui Huang, Yuanjie Zheng, Zhiqiang Hu, Shaoting Zhang, Hongsheng Li
2020WWWStructure-Feature based Graph Self-adaptive Pooling.Liang Zhang, Xudong Wang, Hongsheng Li, Guangming Zhu, Peiyi Shen, Ping Li, Xiaoyuan Lu, Syed Afaq Ali Shah, Mohammed Bennamoun
2019AAAIUnsupervised Cross-Spectral Stereo Matching by Learning to Synthesize.Mingyang Liang, Xiaoyang Guo, Hongsheng Li, Xiaogang Wang, You Song
2019AAAIA2-Net: Molecular Structure Estimation from Cryo-EM Density Volumes.Kui Xu, Zhe Wang, Jianping Shi, Hongsheng Li, Qiangfeng Cliff Zhang
2019CVPRDynamic Fusion With Intra- and Inter-Modality Attention Flow for Visual Question Answering.Peng Gao, Zhengkai Jiang, Haoxuan You, Pan Lu, Steven C. H. Hoi, Xiaogang Wang, Hongsheng Li
2019CVPRGroup-Wise Correlation Stereo Network.Xiaoyang Guo, Kai Yang, Wukui Yang, Xiaogang Wang, Hongsheng Li
2019CVPRConditional Adversarial Generative Flow for Controllable Image Synthesis.Rui Liu, Yu Liu, Xinyu Gong, Xiaogang Wang, Hongsheng Li
2019CVPRImproving Referring Expression Grounding With Cross-Modal Attention-Guided Erasing.Xihui Liu, Zihao Wang, Jing Shao, Xiaogang Wang, Hongsheng Li
2019CVPRPointRCNN: 3D Object Proposal Generation and Detection From Point Cloud.Shaoshuai Shi, Xiaogang Wang, Hongsheng Li
2019CVPRP2SGrad: Refined Gradients for Optimizing Deep Face Models.Xiao Zhang, Rui Zhao, Junjie Yan, Mengya Gao, Yu Qiao, Xiaogang Wang, Hongsheng Li
2019CVPRAdaCos: Adaptively Scaling Cosine Logits for Effectively Learning Deep Face Representations.Xiao Zhang, Rui Zhao, Yu Qiao, Xiaogang Wang, Hongsheng Li
2019ICCVMulti-Modality Latent Interaction Network for Visual Question Answering.Peng Gao, Haoxuan You, Zhanpeng Zhang, Xiaogang Wang, Hongsheng Li
2019ICCVInterpolated Convolutional Networks for 3D Point Cloud Understanding.Jiageng Mao, Xiaogang Wang, Hongsheng Li
2019ICCVSemi-Supervised Monocular 3D Face Reconstruction With End-to-End Shape-Preserved Domain Transfer.Jingtan Piao, Chen Qian, Hongsheng Li
2019ICCVCAMP: Cross-Modal Adaptive Message Passing for Text-Image Retrieval.Zihao Wang, Xihui Liu, Hongsheng Li, Lu Sheng, Junjie Yan, Xiaogang Wang, Jing Shao
2019ICCVDepth Completion From Sparse LiDAR Data With Depth-Normal Constraints.Yan Xu, Xinge Zhu, Jianping Shi, Guofeng Zhang, Hujun Bao, Hongsheng Li
2019MICCAIFocusNet: Imbalanced Large and Small Organ Segmentation with an End-to-End Deep Neural Network for Head and Neck CT Images.Yunhe Gao, Rui Huang, Ming Chen, Zhe Wang, Jincheng Deng, Yuanyuan Chen, Yiwei Yang, Jie Zhang, Chanjuan Tao, Hongsheng Li
2018AAAICo-Attending Free-Form Regions and Detections With Multi-Modal Multiplicative Feature Embedding for Visual Question Answering.Pan Lu, Hongsheng Li, Wei Zhang, Jianyong Wang, Xiaogang Wang
2018CVPRGroup Consistent Similarity Learning via Deep CRF for Person Re-Identification.Dapeng Chen, Dan Xu, Hongsheng Li, Nicu Sebe, Xiaogang Wang
2018CVPRVideo Person Re-Identification With Competitive Snippet-Similarity Aggregation and Co-Attentive Snippet Embedding.Dapeng Chen, Hongsheng Li, Tong Xiao, Shuai Yi, Xiaogang Wang
2018CVPRSingle View Stereo Matching.Yue Luo, Jimmy S. J. Ren, Mude Lin, Jiahao Pang, Wenxiu Sun, Hongsheng Li, Liang Lin
2018CVPRDeep Group-Shuffling Random Walk for Person Re-Identification.Yantao Shen, Hongsheng Li, Tong Xiao, Shuai Yi, Dapeng Chen, Xiaogang Wang
2018CVPREnd-to-End Deep Kronecker-Product Matching for Person Re-Identification.Yantao Shen, Tong Xiao, Hongsheng Li, Shuai Yi, Xiaogang Wang
2018CVPREliminating Background-Bias for Robust Person Re-Identification.Maoqing Tian, Shuai Yi, Hongsheng Li, Shihua Li, Xuesen Zhang, Jianping Shi, Junjie Yan, Xiaogang Wang
2018CVPR3D Human Pose Estimation in the Wild by Adversarial Learning.Wei Yang, Wanli Ouyang, Xiaolong Wang, Jimmy S. J. Ren, Hongsheng Li, Xiaogang Wang
2018ECCVImproving Deep Visual Representation for Person Re-identification by Global and Local Image-language Association.Dapeng Chen, Hongsheng Li, Xihui Liu, Yantao Shen, Jing Shao, Zejian Yuan, Xiaogang Wang
2018ECCVQuestion-Guided Hybrid Convolution for Visual Question Answering.Peng Gao, Hongsheng Li, Shuang Li, Pan Lu, Yikang Li, Steven C. H. Hoi, Xiaogang Wang
2018ECCVLearning Monocular Depth by Distilling Cross-Domain Stereo Networks.Xiaoyang Guo, Hongsheng Li, Shuai Yi, Jimmy S. J. Ren, Xiaogang Wang
2018ECCVShow, Tell and Discriminate: Image Captioning by Self-retrieval with Partially Labeled Data.Xihui Liu, Hongsheng Li, Jing Shao, Dapeng Chen, Xiaogang Wang
2018ECCVPerson Re-identification with Deep Similarity-Guided Graph Neural Network.Yantao Shen, Hongsheng Li, Shuai Yi, Dapeng Chen, Xiaogang Wang
2018VTCLatency-Aware In-Network Computing for Internet of Battery-Less Things.Qianao Ju, Geng Sun, Hongsheng Li, Ying Zhang
2017CVPRObject Detection in Videos with Tubelet Proposal Networks.Kai Kang, Hongsheng Li, Tong Xiao, Wanli Ouyang, Junjie Yan, Xihui Liu, Xiaogang Wang
2017CVPRPerson Search with Natural Language Description.Shuang Li, Tong Xiao, Hongsheng Li, Bolei Zhou, Dayu Yue, Xiaogang Wang
2017CVPRLearning Spatial Regularization with Image-Level Supervisions for Multi-label Image Classification.Feng Zhu, Hongsheng Li, Wanli Ouyang, Nenghai Yu, Xiaogang Wang
2017ICCVOnline Multi-object Tracking Using CNN-Based Single Object Tracker with Spatial-Temporal Attention Mechanism.Qi Chu, Wanli Ouyang, Hongsheng Li, Xiaogang Wang, Bin Liu, Nenghai Yu
2017ICCVIdentity-Aware Textual-Visual Matching with Latent Co-attention.Shuang Li, Tong Xiao, Hongsheng Li, Wei Yang, Xiaogang Wang
2017ICCVLearning Deep Neural Networks for Vehicle Re-ID with Visual-spatio-Temporal Path Proposals.Yantao Shen, Tong Xiao, Hongsheng Li, Shuai Yi, Xiaogang Wang
2017ICCVOrientation Invariant Feature Embedding and Spatial Temporal Regularization for Vehicle Re-identification.Zhongdao Wang, Luming Tang, Xihui Liu, Zhuliang Yao, Shuai Yi, Jing Shao, Junjie Yan, Shengjin Wang, Hongsheng Li, Xiaogang Wang
2017ICCVLearning Feature Pyramids for Human Pose Estimation.Wei Yang, Shuang Li, Wanli Ouyang, Hongsheng Li, Xiaogang Wang
2017ICCVStackGAN: Text to Photo-Realistic Image Synthesis with Stacked Generative Adversarial Networks.Han Zhang, Tao Xu, Hongsheng Li
2017MICCAIZoom-in-Net: Deep Mining Lesions for Diabetic Retinopathy Detection.Zhe Wang, Yanxin Yin, Jianping Shi, Wei Fang, Hongsheng Li, Xiaogang Wang
2016CVPRStructured Feature Learning for Pose Estimation.Xiao Chu, Wanli Ouyang, Hongsheng Li, Xiaogang Wang
2016CVPRObject Detection from Video Tubelets with Convolutional Neural Networks.Kai Kang, Wanli Ouyang, Hongsheng Li, Xiaogang Wang
2016CVPRLearning Deep Feature Representations with Domain Guided Dropout for Person Re-identification.Tong Xiao, Hongsheng Li, Wanli Ouyang, Xiaogang Wang
2016CVPREnd-to-End Learning of Deformable Mixture of Parts and Deep Convolutional Neural Networks for Human Pose Estimation.Wei Yang, Wanli Ouyang, Hongsheng Li, Xiaogang Wang
2016ECCVLearnable Histogram: Statistical Context Features for Deep Neural Networks.Zhe Wang, Hongsheng Li, Wanli Ouyang, Xiaogang Wang
2016ECCVPedestrian Behavior Understanding and Prediction with Deep Neural Networks.Shuai Yi, Hongsheng Li, Xiaogang Wang
2016ECCVCrossing-Line Crowd Counting with Two-Phase Deep Neural Networks.Zhuoyi Zhao, Hongsheng Li, Rui Zhao, Xiaogang Wang
2015CVPRDeepID-Net: Deformable deep convolutional neural networks for object detection.Wanli Ouyang, Xiaogang Wang, Xingyu Zeng, Shi Qiu, Ping Luo, Yonglong Tian, Hongsheng Li, Shuo Yang, Zhe Wang, Chen Change Loy, Xiaoou Tang
2015CVPRUnderstanding pedestrian behaviors from stationary crowd groups.Shuai Yi, Hongsheng Li, Xiaogang Wang
2015CVPRCross-scene crowd counting via deep convolutional neural networks.Cong Zhang, Hongsheng Li, Xiaogang Wang, Xiaokang Yang
2015CVPRSaliency detection by multi-context deep learning.Rui Zhao, Wanli Ouyang, Hongsheng Li, Xiaogang Wang
2015ICCVPedestrian Travel Time Estimation in Crowded Scenes.Shuai Yi, Hongsheng Li, Xiaogang Wang
2014CVPRPreconditioning for Accelerated Iteratively Reweighted Least Squares in Structured Sparsity Reconstruction.Chen Chen, Junzhou Huang, Lei He, Hongsheng Li
2014SMCA novel demodulation algorithm for MEMS gyroscope digital control system.Cheng Yang, Hongsheng Li
2012CVPRA hierarchical image clustering cosegmentation framework.Edward Kim, Hongsheng Li, Xiaolei Huang
2012ICARCVA robust algorithm for tracking object under occlusion and illumination change.Hong Lu, Hongsheng Li, Wenlin Zou, Shumin Fei
2011ICCVOptimal object matching via convexification and composition.Hongsheng Li, Junzhou Huang, Shaoting Zhang, Xiaolei Huang
2011ICCVA 3D Laplacian-driven parametric deformable model.Tian Shen, Xiaolei Huang, Hongsheng Li, Edward Kim, Shaoting Zhang, Junzhou Huang
2010CVPRObject matching with a locally affine-invariant constraint.Hongsheng Li, Edward Kim, Xiaolei Huang, Lei He
2010CVPRAutomatic image annotation using group sparsity.Shaoting Zhang, Junzhou Huang, Yuchi Huang, Yang Yu, Hongsheng Li, Dimitris N. Metaxas
2010MICCAIActin Filament Segmentation Using Spatiotemporal Active-Surface and Active-Contour Models.Hongsheng Li, Tian Shen, Dimitrios Vavylonis, Xiaolei Huang
2009CVPRGlobal optimization for alignment of generalized shapes.Hongsheng Li, Tian Shen, Xiaolei Huang
2009CVPRActive volume models for 3D medical image segmentation.Tian Shen, Hongsheng Li, Zhen Qian, Xiaolei Huang
2009MICCAIActin Filament Tracking Based on Particle Filters and Stretching Open Active Contour Models.Hongsheng Li, Tian Shen, Dimitrios Vavylonis, Xiaolei Huang