| 2026 | ACL | Comprehensive Benchmarking of Long-Form Speech Generation in Diverse Scenarios. | Changhao Pan, Rui Yang, Han Wang, Zhuan Zhou, Xuming He, Wenxiang Guo, Ziyue Jiang, Ruiqi Li, Yu Zhang, Chenyuhao Wen, Ke Lei, Xiang Yin, Jingyu Lu, Zhiyuan Zhu, Zhou Zhao |
| 2025 | AAAI | Relation-aware Hierarchical Prompt for Open-vocabulary Scene Graph Generation. | Tao Liu, Rongjie Li, Chongyu Wang, Xuming He |
| 2025 | DAC | LVM-MO: A Large Vision Model Pioneer on Full-Chip Mask Optimization. | Yiwen Wu, Yuyang Chen, Shuo Yin, Nan Wang, Tao Wu, Xuming He, Hao Geng, Jingyi Yu |
| 2025 | ICASSP | DiffSR: Learning Radar Reflectivity Synthesis via Diffusion Model from Satellite Observations. | Xuming He, Zhiwang Zhou, Wenlong Zhang, Xiangyu Zhao, Hao Chen, Shiqi Chen, Lei Bai |
| 2025 | ICCAD | LMLitho: A Large Vision Model-Driven Lithography Simulation Framework. | Zhen Wang, Hongquan He, Tao Wu, Xuming He, Qi Sun, Cheng Zhuo, Bei Yu, Jingyi Yu, Hao Geng |
| 2025 | ICCV | GeoDistill: Geometry-Guided Self-Distillation for Weakly Supervised Cross-View Localization. | Shaowen Tong, Zimin Xia, Alexandre Alahi, Xuming He, Yujiao Shi |
| 2024 | AAAI | Mining Fine-Grained Image-Text Alignment for Zero-Shot Captioning via Text-Only Training. | Longtian Qiu, Shan Ning, Xuming He |
| 2024 | CVPR | DSGG: Dense Relation Transformer for an End-to-End Scene Graph Generation. | Zeeshan Hayder, Xuming He |
| 2024 | CVPR | Learning by Correction: Efficient Tuning Task for Zero-Shot Generative Vision-Language Reasoning. | Rongjie Li, Yu Wu, Xuming He |
| 2024 | CVPR | From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models. | Rongjie Li, Songyang Zhang, Dahua Lin, Kai Chen, Xuming He |
| 2024 | DAC | LLM-HD: Layout Language Model for Hotspot Detection with GDS Semantic Encoding. | Yuyang Chen, Yiwen Wu, Jingya Wang, Tao Wu, Xuming He, Jingyi Yu, Hao Geng |
| 2024 | ECCV | SPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models. | Ziyi Lin, Dongyang Liu, Renrui Zhang, Peng Gao, Longtian Qiu, Han Xiao, Han Qiu, Wenqi Shao, Keqin Chen, Jiaming Han, Siyuan Huang, Yichi Zhang, Xuming He, Yu Qiao, Hongsheng Li |
| 2024 | ECCV | Dual-Level Adaptive Self-labeling for Novel Class Discovery in Point Cloud Segmentation. | Ruijie Xu, Chuyu Zhang, Hui Ren, Xuming He |
| 2024 | ICLR | P2OT: Progressive Partial Optimal Transport for Deep Imbalanced Clustering. | Chuyu Zhang, Hui Ren, Xuming He |
| 2024 | IJCAI | RealDex: Towards Human-like Grasping for Robotic Dexterous Hand. | Yumeng Liu, Yaxun Yang, Youzhuo Wang, Xiaofei Wu, Jiamin Wang, Yichen Yao, Sren Schwertfeger, Sibei Yang, Wenping Wang, Jingyi Yu, Xuming He, Yuexin Ma |
| 2024 | ICRA | Multi-Level Progressive Reinforcement Learning for Control Policy in Physical Simulations. | Kefei Wu, Xuming He, Yang Wang, Xiaopei Liu |
| 2023 | AAAI | CALIP: Zero-Shot Enhancement of CLIP with Parameter-Free Attention. | Ziyu Guo, Renrui Zhang, Longtian Qiu, Xianzheng Ma, Xupeng Miao, Xuming He, Bin Cui |
| 2023 | BMVC | Cascade Sparse Feature Propagation Network for Interactive Segmentation. | Chuyu Zhang, Hui Ren, Chuanyang Hu, Yongfei Liu, Xuming He |
| 2023 | CVPR | HOICLIP: Efficient Knowledge Transfer for HOI Detection with Vision-Language Models. | Shan Ning, Longtian Qiu, Yongfei Liu, Xuming He |
| 2023 | ICCV | Class-relation Knowledge Distillation for Novel Class Discovery. | Peiyan Gu, Chuyu Zhang, Ruijie Xu, Xuming He |
| 2023 | ICCV | Grounded Image Text Matching with Mismatched Relation Reasoning. | Yu Wu, Yana Wei, Haozhe Wang, Yongfei Liu, Sibei Yang, Xuming He |
| 2023 | ICCV | Human-centric Scene Understanding for 3D Large-scale Scenarios. | Yiteng Xu, Peishan Cong, Yichen Yao, Runnan Chen, Yuenan Hou, Xinge Zhu, Xuming He, Jingyi Yu, Yuexin Ma |
| 2023 | ICLR | Modeling Multimodal Aleatoric Uncertainty in Segmentation with Mixture of Stochastic Experts. | Zhitong Gao, Yucong Chen, Chuyu Zhang, Xuming He |
| 2023 | ICLR | Weakly-supervised HOI Detection via Prior-guided Bi-level Representation Learning. | Bo Wan, Yongfei Liu, Desen Zhou, Tinne Tuytelaars, Xuming He |
| 2023 | IJCAI | MILD: Modeling the Instance Learning Dynamics for Learning with Noisy Labels. | Chuanyang Hu, Shipeng Yan, Zhitong Gao, Xuming He |
| 2023 | IROS | Exploring Learning-Based Control Policy for Fish-Like Robots in Altered Background Flows. | Xiaozhu Lin, Wenbin Song, Xiaopei Liu, Xuming He, Yang Wang |
| 2023 | MICCAI | HC-Net: Hybrid Classification Network for Automatic Periodontal Disease Diagnosis. | Lanzhuju Mei, Yu Fang, Zhiming Cui, Ke Deng, Nizhuan Wang, Xuming He, Yiqiang Zhan, Xiang Zhou, Maurizio Tonetti, Dinggang Shen |
| 2022 | CVPR | SGTR: End-to-end Scene Graph Generation with Transformer. | Rongjie Li, Songyang Zhang, Xuming He |
| 2022 | CVPR | General Incremental Learning with Domain-aware Categorical Representations. | Jiangwei Xie, Shipeng Yan, Xuming He |
| 2022 | ECCV | Learning Semantic Correspondence with Sparse Annotations. | Shuaiyi Huang, Luyu Yang, Bo He, Songyang Zhang, Xuming He, Abhinav Shrivastava |
| 2022 | ECCV | Generative Negative Text Replay for Continual Vision-Language Pretraining. | Shipeng Yan, Lanqing Hong, Hang Xu, Jianhua Han, Tinne Tuytelaars, Zhenguo Li, Xuming He |
| 2022 | ICIP | Robust Temporally-Coherent Strategy for Few-shot Video Instance Segmentation. | Qiuyue Wang, Songyang Zhang, Xuming He |
| 2022 | ICRA | FishGym: A High-Performance Physics-based Simulation Framework for Underwater Robot Learning. | Wenji Liu, Kai Bai, Xuming He, Shuran Song, Changxi Zheng, Xiaopei Liu |
| 2022 | KDD | ROI-Constrained Bidding via Curriculum-Guided Bayesian Reinforcement Learning. | Haozhe Wang, Chao Du, Panyan Fang, Shuo Yuan, Xuming He, Liang Wang, Bo Zheng |
| 2022 | NAACL | KD-VLP: Improving End-to-End Vision-and-Language Pretraining with Object Knowledge Distillation. | Yongfei Liu, Chenfei Wu, Shao-Yen Tseng, Vasudev Lal, Xuming He, Nan Duan |
| 2021 | CVPR | Relation-aware Instance Refinement for Weakly Supervised Visual Grounding. | Yongfei Liu, Bo Wan, Lin Ma, Xuming He |
| 2021 | CVPR | Bipartite Graph Network With Adaptive Message Passing for Unbiased Scene Graph Generation. | Rongjie Li, Songyang Zhang, Bo Wan, Xuming He |
| 2021 | CVPR | DER: Dynamically Expandable Representation for Class Incremental Learning. | Shipeng Yan, Jiangwei Xie, Xuming He |
| 2021 | CVPR | Distribution Alignment: A Unified Framework for Long-Tail Visual Recognition. | Songyang Zhang, Zeming Li, Shipeng Yan, Xuming He, Jian Sun |
| 2021 | ICCV | GNeRF: GAN-based Neural Radiance Field without Posed Camera. | Quan Meng, Anpei Chen, Haimin Luo, Minye Wu, Hao Su, Lan Xu, Xuming He, Jingyi Yu |
| 2021 | IJCAI | Learning Implicit Temporal Alignment for Few-shot Video Classification. | Songyang Zhang, Jiale Zhou, Xuming He |
| 2021 | MICCAI | Superpixel-Guided Iterative Learning from Noisy Labels for Medical Image Segmentation. | Shuailin Li, Zhitong Gao, Xuming He |
| 2021 | PRICAI | Fixed-Price Diffusion Mechanism Design. | Tianyi Zhang, Dengji Zhao, Wen Zhang, Xuming He |
| 2020 | AAAI | Learning Cross-Modal Context Graph for Visual Grounding. | Yongfei Liu, Bo Wan, Xiaodan Zhu, Xuming He |
| 2020 | ECCV | Part-Aware Prototype Network for Few-Shot Semantic Segmentation. | Yongfei Liu, Xiangyi Zhang, Songyang Zhang, Xuming He |
| 2020 | ICPR | Disentangled Representation Learning for Controllable Image Synthesis: An Information-Theoretic Perspective. | Shichang Tang, Xu Zhou, Xuming He, Yi Ma |
| 2020 | MICCAI | Shape-Aware Semi-supervised 3D Semantic Segmentation for Medical Images. | Shuailin Li, Chuyu Zhang, Xuming He |
| 2019 | AAAI | A Dual Attention Network with Semantic Embedding for Few-Shot Learning. | Shipeng Yan, Songyang Zhang, Xuming He |
| 2019 | CVPR | A Dual Attention Network with Semantic Embedding for Few-shot Learning. | Shipeng Yan, Songyang Zhang, Xuming He |
| 2019 | ICCV | Dynamic Context Correspondence Network for Semantic Alignment. | Shuaiyi Huang, Qiuyue Wang, Songyang Zhang, Shipeng Yan, Xuming He |
| 2019 | ICCV | Pose-Aware Multi-Level Feature Network for Human Object Interaction Detection. | Bo Wan, Desen Zhou, Yongfei Liu, Rongjie Li, Xuming He |
| 2019 | ICML | LatentGNN: Learning Efficient Non-local Relations for Visual Recognition. | Songyang Zhang, Xuming He, Shipeng Yan |
| 2018 | AAAI | 3D Box Proposals From a Single Monocular Image of an Indoor Scene. | Wei Zhuo, Mathieu Salzmann, Xuming He, Miaomiao Liu |
| 2018 | BMVC | 3D Object Structure Recovery via Semi-supervised Learning on Videos. | Qian He, Desen Zhou, Xuming He |
| 2018 | CVPR | Geometry-Aware Deep Network for Single-Image Novel View Synthesis. | Miaomiao Liu, Xuming He, Mathieu Salzmann |
| 2018 | CVPR | SemStyle: Learning to Generate Stylised Image Captions Using Unaligned Text. | Alexander Patrick Mathews, Lexing Xie, Xuming He |
| 2018 | CVPR | One-Shot Action Localization by Learning Sequence Matching Network. | Hongtao Yang, Xuming He, Fatih Porikli |
| 2018 | WACV | Instance-Aware Detailed Action Labeling in Videos. | Hongtao Yang, Xuming He, Fatih Porikli |
| 2017 | CVPR | Boundary-Aware Instance Segmentation. | Zeeshan Hayder, Xuming He, Mathieu Salzmann |
| 2017 | CVPR | Predicting Salient Face in Multiple-Face Videos. | Yufan Liu, Songyang Zhang, Mai Xu, Xuming He |
| 2017 | CVPR | Efficient Scene Layout Aware Object Detection for Traffic Surveillance. | Tao Wang, Xuming He, Songzhi Su, Yin Guan |
| 2017 | CVPR | Indoor Scene Parsing with Instance Segmentation, Semantic Labeling and Support Relationship Inference. | Wei Zhuo, Mathieu Salzmann, Xuming He, Miaomiao Liu |
| 2017 | ICCV | Deep Free-Form Deformation Network for Object-Mask Registration. | Haoyang Zhang, Xuming He |
| 2017 | IJCAI | Learning deep structured network for weakly supervised change detection. | Salman Hameed Khan, Xuming He, Fatih Porikli, Mohammed Bennamoun, Ferdous Ahmed Sohel, Roberto Togneri |
| 2017 | WACV | Learning Spatial Transforms for Refining Object Segment Proposals. | Haoyang Zhang, Xuming He, Fatih Porikli |
| 2016 | AAAI | SentiCap: Generating Image Descriptions with Sentiments. | Alexander Patrick Mathews, Lexing Xie, Xuming He |
| 2016 | ACCV | Object-Aware Dictionary Learning with Deep Features. | Yurui Xie, Fatih Porikli, Xuming He |
| 2016 | ACCV | Learning to Generate Object Segment Proposals with Multi-modal Cues. | Haoyang Zhang, Xuming He, Fatih Porikli |
| 2016 | CVPR | Learning to Co-Generate Object Proposals with a Deep Structured Network. | Zeeshan Hayder, Xuming He, Mathieu Salzmann |
| 2016 | ECCV | Learning Dynamic Hierarchical Models for Anytime Scene Labeling. | Buyu Liu, Xuming He |
| 2016 | ECCV | Building Scene Models by Completing and Hallucinating Depth and Semantics. | Miaomiao Liu, Xuming He, Mathieu Salzmann |
| 2016 | ICIP | Semantic context and depth-aware object proposal generation. | Haoyang Zhang, Xuming He, Fatih Porikli, Laurent Kneip |
| 2016 | MMM | Learning Hough Transform with Latent Structures for Joint Object Detection and Pose Estimation. | Hanxi Li, Xuming He, Nick Barnes, Mingwen Wang |
| 2015 | CVPR | Separating objects and clutter in indoor scenes. | Salman Hameed Khan, Xuming He, Mohammed Bennamoun, Ferdous Ahmed Sohel, Roberto Togneri |
| 2015 | CVPR | Multiclass semantic video segmentation with object-level active inference. | Buyu Liu, Xuming He |
| 2015 | CVPR | Indoor scene structure analysis for single image depth estimation. | Wei Zhuo, Mathieu Salzmann, Xuming He, Miaomiao Liu |
| 2015 | ICCV | Structural Kernel Learning for Large Scale Multiclass Object Co-detection. | Zeeshan Hayder, Xuming He, Mathieu Salzmann |
| 2015 | WACV | Multi-class Semantic Video Segmentation with Exemplar-Based Object Reasoning. | Buyu Liu, Xuming He, Stephen Gould |
| 2015 | WACV | Choosing Basic-Level Concept Names Using Visual and Language Context. | Alexander Patrick Mathews, Lexing Xie, Xuming He |
| 2015 | WACV | Motion Segmentation of Truncated Signed Distance Function Based Volumetric Surfaces. | Samunda Perera, Nick Barnes, Xuming He, Shahram Izadi, Pushmeet Kohli, Ben Glocker |
| 2014 | CVPR | An Exemplar-Based CRF for Multi-instance Object Segmentation. | Xuming He, Stephen Gould |
| 2014 | CVPR | Discrete-Continuous Depth Estimation from a Single Image. | Miaomiao Liu, Mathieu Salzmann, Xuming He |
| 2014 | DICTA | Data-Driven Street Scene Layout Estimation for Distant Object Detection. | Donghao Zhang, Xuming He, Hanxi Li |
| 2014 | ECCV | Superpixel Graph Label Transfer with Learned Distance Metric. | Stephen Gould, Jiecheng Zhao, Xuming He, Yuhang Zhang |
| 2014 | ECCV | Object Co-detection via Efficient Inference in a Fully-Connected CRF. | Zeeshan Hayder, Mathieu Salzmann, Xuming He |
| 2014 | WACV | Joint semantic and geometric segmentation of videos with a stage model. | Buyu Liu, Xuming He, Stephen Gould |
| 2013 | CVPR | Winding Number for Region-Boundary Consistent Salient Contour Extraction. | Yansheng Ming, Hongdong Li, Xuming He |
| 2013 | CVPR | Learning Structured Hough Voting for Joint Object Detection and Occlusion Reasoning. | Tao Wang, Xuming He, Nick Barnes |
| 2013 | ICIP | Symmetry detection via contour grouping. | Yansheng Ming, Hongdong Li, Xuming He |
| 2013 | ICIP | Glass object segmentation by label transfer on joint depth and appearance manifolds. | Tao Wang, Xuming He, Nick Barnes |
| 2012 | CVPR | Connected contours: A new contour completion model that respects the closure effect. | Yansheng Ming, Hongdong Li, Xuming He |
| 2012 | DICTA | Learning Hough Forest with Depth-Encoded Context for Object Detection. | Tao Wang, Xuming He, Nick Barnes |
| 2012 | ICPR | Glass object localization by joint inference of boundary and depth. | Tao Wang, Xuming He, Nick Barnes |
| 2011 | DICTA | Analysis on Tree Structure Selection for MRF Inference in Low-level Vision. | Jun Sun, Hongdong Li, Xuming He |
| 2011 | DICTA | Laplacian Margin Distribution Boosting for Learning from Sparsely Labeled Data. | Tao Wang, Xuming He, Chunhua Shen, Nick Barnes |
| 2011 | ICIG | Efficient Image Denoising by MRF Approximation with Uniform-Sampled Multi-spanning-tree. | Jun Sun, Hongdong Li, Xuming He |
| 2010 | ECCV | Occlusion Boundary Detection Using Pseudo-depth. | Xuming He, Alan L. Yuille |
| 2008 | CVPR | Latent topic random fields: Learning using a taxonomy of labels. | Xuming He, Richard S. Zemel |
| 2008 | Interspeech | Using latent Dirichlet allocation to incorporate domain knowledge for topic transition detection. | Xiaodan Zhu, Xuming He, Cosmin Munteanu, Gerald Penn |
| 2006 | ECCV | Learning and Incorporating Top-Down Cues in Image Segmentation. | Xuming He, Richard S. Zemel, Debajyoti Ray |
| 2004 | CVPR | Multiscale Conditional Random Fields for Image Labeling. | Xuming He, Richard S. Zemel, Miguel . Carreira-Perpin |