Skip to content

Enze Xie

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

48

Venues

11

Active years

2019–2025

Best venue rank

A*

Where they publish

Papers

48 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRSplatMesh: Interactive 3D Segmentation and Editing Using Mesh-Based Gaussian Splatting.Kaichen Zhou, Lanqing Hong, Xinhai Chang, Yingji Zhong, Enze Xie, Hao Dong, Zhihao Li, Yongxin Yang, Zhenguo Li, Wei Zhang
2025ICASSPChar-SAM: Turning Segment Anything Model into Scene Text Segmentation Annotator with Character-level Visual Prompts.Enze Xie, Jiahao Lyu, Daiqing Wu, Huawen Shen, Yu Zhou
2025ICCVSANA-Sprint: One-Step Diffusion with Continuous-Time Consistency Distillation.Junsong Chen, Shuchen Xue, Yuyang Zhao, Jincheng Yu, Sayak Paul, Junyu Chen, Han Cai, Song Han, Enze Xie
2025ICCVDC-AE 1.5: Accelerating Diffusion Model Convergence with Structured Latent Space.Junyu Chen, Dongyun Zou, Wenkun He, Junsong Chen, Enze Xie, Song Han, Han Cai
2025ICCVDC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer.Yecheng Wu, Junyu Chen, Zhuoyang Zhang, Enze Xie, Jincheng Yu, Junsong Chen, Jinyi Hu, Yao Lu, Song Han, Han Cai
2025ICLRDeep Compression Autoencoder for Efficient High-Resolution Diffusion Models.Junyu Chen, Han Cai, Junsong Chen, Enze Xie, Shang Yang, Haotian Tang, Muyang Li, Song Han
2025ICLRSVDQuant: Absorbing Outliers by Low-Rank Component for 4-Bit Diffusion Models.Muyang Li, Yujun Lin, Zhekai Zhang, Tianle Cai, Xiuyu Li, Junxian Guo, Enze Xie, Chenlin Meng, Jun-Yan Zhu, Song Han
2025ICLRHART: Efficient Visual Generation with Hybrid Autoregressive Transformer.Haotian Tang, Yecheng Wu, Shang Yang, Enze Xie, Junsong Chen, Junyu Chen, Zhuoyang Zhang, Han Cai, Yao Lu, Song Han
2025ICLRVILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation.Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu
2025ICLRSANA: Efficient High-Resolution Text-to-Image Synthesis with Linear Diffusion Transformers.Enze Xie, Junsong Chen, Junyu Chen, Han Cai, Haotian Tang, Yujun Lin, Zhekai Zhang, Muyang Li, Ligeng Zhu, Yao Lu, Song Han
2025ICMLSANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer.Enze Xie, Junsong Chen, Yuyang Zhao, Jincheng Yu, Ligeng Zhu, Yujun Lin, Zhekai Zhang, Muyang Li, Junyu Chen, Han Cai, Bingchen Liu, Daquan Zhou, Song Han
2024AAAIDeepAccident: A Motion and Accident Prediction Benchmark for V2X Autonomous Driving.Tianqi Wang, Sukmin Kim, Wenxuan Ji, Enze Xie, Chongjian Ge, Junsong Chen, Zhenguo Li, Ping Luo
2024CVPRAccelerating Diffusion Sampling with Optimized Time Steps.Shuchen Xue, Zhaoqiang Liu, Fei Chen, Shifeng Zhang, Tianyang Hu, Enze Xie, Zhenguo Li
2024ECCVPIXART-Σ: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation.Junsong Chen, Chongjian Ge, Enze Xie, Yue Wu, Lewei Yao, Xiaozhe Ren, Zhongdao Wang, Ping Luo, Huchuan Lu, Zhenguo Li
2024ECCVSegment, Lift and Fit: Automatic 3D Shape Labeling from 2D Prompts.Jianhao Li, Tianyu Sun, Zhongdao Wang, Enze Xie, Bailan Feng, Hongbo Zhang, Ze Yuan, Ke Xu, Jiaheng Liu, Ping Luo
2024ECCVFast Training of Diffusion Transformer with Extreme Masking for 3D Point Clouds Generation.Shentong Mo, Enze Xie, Yue Wu, Junsong Chen, Matthias Niener, Zhenguo Li
2024ICLRMagicDrive: Street View Generation with Diverse 3D Geometry Control.Ruiyuan Gao, Kai Chen, Enze Xie, Lanqing Hong, Zhenguo Li, Dit-Yan Yeung, Qiang Xu
2024ICLRGeoDiffusion: Text-Prompted Geometric Control for Object Detection Data Generation.Kai Chen, Enze Xie, Zhe Chen, Yibo Wang, Lanqing Hong, Zhenguo Li, Dit-Yan Yeung
2024ICLRPixArt-α: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis.Junsong Chen, Jincheng Yu, Chongjian Ge, Lewei Yao, Enze Xie, Zhongdao Wang, James T. Kwok, Ping Luo, Huchuan Lu, Zhenguo Li
2024ICLRLarge Language Models as Automated Aligners for benchmarking Vision-Language Models.Yuanfeng Ji, Chongjian Ge, Weikai Kong, Enze Xie, Zhengying Liu, Zhenguo Li, Ping Luo
2024ICLRLEGO-Prover: Neural Theorem Proving with Growing Libraries.Haiming Wang, Huajian Xin, Chuanyang Zheng, Zhengying Liu, Qingxing Cao, Yinya Huang, Jing Xiong, Han Shi, Enze Xie, Jian Yin, Zhenguo Li, Xiaodan Liang
2024ICLRDQ-LoRe: Dual Queries with Low Rank Approximation Re-ranking for In-Context Learning.Jing Xiong, Zixuan Li, Chuanyang Zheng, Zhijiang Guo, Yichun Yin, Enze Xie, Zhicheng Yang, Qingxing Cao, Haiming Wang, Xiongwei Han, Jing Tang, Chengming Li, Xiaodan Liang
2023ACLDT-Solver: Automated Theorem Proving with Dynamic-Tree Sampling Guided by Proof-level Value Function.Haiming Wang, Ye Yuan, Zhengying Liu, Jianhao Shen, Yichun Yin, Jing Xiong, Enze Xie, Han Shi, Yujun Li, Lin Li, Jian Yin, Zhenguo Li, Xiaodan Liang
2023ICCVMetaBEV: Solving Sensor Failures for 3D Detection and Map Segmentation.Chongjian Ge, Junsong Chen, Enze Xie, Zhongdao Wang, Lanqing Hong, Huchuan Lu, Zhenguo Li, Ping Luo
2023ICCVBeyond One-to-One: Rethinking the Referring Image Segmentation.Yutao Hu, Qixiong Wang, Wenqi Shao, Enze Xie, Zhenguo Li, Jungong Han, Ping Luo
2023ICCVDDP: Diffusion Model for Dense Visual Prediction.Yuanfeng Ji, Zhe Chen, Enze Xie, Lanqing Hong, Xihui Liu, Zhaoqiang Liu, Tong Lu, Zhenguo Li, Ping Luo
2023ICCVDiffFit: Unlocking Transferability of Large Diffusion Models via Simple Parameter-Efficient Fine-Tuning.Enze Xie, Lewei Yao, Han Shi, Zhili Liu, Daquan Zhou, Zhaoqiang Liu, Jiawei Li, Zhenguo Li
2023ICCVParametric Depth Based Feature Representation Learning for Object Detection and Segmentation in Bird's-Eye View.Jiayu Yang, Enze Xie, Miaomiao Liu, Jos M. lvarez
2022AAAITowards Ultra-Resolution Neural Style Transfer via Thumbnail Instance Normalization.Zhe Chen, Wenhai Wang, Enze Xie, Tong Lu, Ping Luo
2022CVPRPanoptic SegFormer: Delving Deeper into Panoptic Segmentation with Transformers.Zhiqi Li, Wenhai Wang, Enze Xie, Zhiding Yu, Anima Anandkumar, Jos M. lvarez, Ping Luo, Tong Lu
2022ECCVBEVFormer: Learning Bird's-Eye-View Representation from Multi-camera Images via Spatiotemporal Transformers.Zhiqi Li, Wenhai Wang, Hongyang Li, Enze Xie, Chonghao Sima, Tong Lu, Yu Qiao, Jifeng Dai
2022ICIPPolygon-Free: Unconstrained Scene Text Detection with Box Annotations.Weijia Wu, Enze Xie, Ruimao Zhang, Wenhai Wang, Ping Luo, Hong Zhou
2022ICLRCycleMLP: A MLP-like Architecture for Dense Prediction.Shoufa Chen, Enze Xie, Chongjian Ge, Runjian Chen, Ding Liang, Ping Luo
2022ICMLUnderstanding The Robustness in Vision Transformers.Daquan Zhou, Zhiding Yu, Enze Xie, Chaowei Xiao, Animashree Anandkumar, Jiashi Feng, Jos M. lvarez
2021ICCVWatch Only Once: An End-to-End Video Action Detection Framework.Shoufa Chen, Peize Sun, Enze Xie, Chongjian Ge, Jiannan Wu, Lan Ma, Jiajun Shen, Ping Luo
2021ICCVPyramid Vision Transformer: A Versatile Backbone for Dense Prediction without Convolutions.Wenhai Wang, Enze Xie, Xiang Li, Deng-Ping Fan, Kaitao Song, Ding Liang, Tong Lu, Ping Luo, Ling Shao
2021ICCVDetCo: Unsupervised Contrastive Learning for Object Detection.Enze Xie, Jian Ding, Wenhai Wang, Xiaohang Zhan, Hang Xu, Peize Sun, Zhenguo Li, Ping Luo
2021ICMLWhat Makes for End-to-End Object Detection?Peize Sun, Yi Jiang, Enze Xie, Wenqi Shao, Zehuan Yuan, Changhu Wang, Ping Luo
2021IJCAISegmenting Transparent Objects in the Wild with Transformer.Enze Xie, Wenjia Wang, Wenhai Wang, Peize Sun, Hang Xu, Ding Liang, Ping Luo
2020ACCVSynthetic-to-Real Unsupervised Domain Adaptation for Scene Text Detection in the Wild.Weijia Wu, Ning Lu, Enze Xie, Yuxing Wang, Wenwen Yu, Cheng Yang, Hong Zhou
2020CVPRPolarMask: Single Shot Instance Segmentation With Polar Representation.Enze Xie, Peize Sun, Xiaoge Song, Wenhai Wang, Xuebo Liu, Ding Liang, Chunhua Shen, Ping Luo
2020ECCVDifferentiable Hierarchical Graph Grouping for Multi-person Pose Estimation.Sheng Jin, Wentao Liu, Enze Xie, Wenhai Wang, Chen Qian, Wanli Ouyang, Ping Luo
2020ECCVAE TextSpotter: Learning Visual and Linguistic Representation for Ambiguous Text Spotting.Wenhai Wang, Xuebo Liu, Xiaozhong Ji, Enze Xie, Ding Liang, Zhibo Yang, Tong Lu, Chunhua Shen, Ping Luo
2020ECCVScene Text Image Super-Resolution in the Wild.Wenjia Wang, Enze Xie, Xuebo Liu, Wenhai Wang, Ding Liang, Chunhua Shen, Xiang Bai
2020ECCVSegmenting Transparent Objects in the Wild.Enze Xie, Wenjia Wang, Wenhai Wang, Mingyu Ding, Chunhua Shen, Ping Luo
2019AAAIScene Text Detection with Supervised Pyramid Context Network.Enze Xie, Yuhang Zang, Shuai Shao, Gang Yu, Cong Yao, Guangyao Li
2019CVPRShape Robust Text Detection With Progressive Scale Expansion Network.Wenhai Wang, Enze Xie, Xiang Li, Wenbo Hou, Tong Lu, Gang Yu, Shuai Shao
2019ICCVEfficient and Accurate Arbitrary-Shaped Text Detection With Pixel Aggregation Network.Wenhai Wang, Enze Xie, Xiaoge Song, Yuhang Zang, Wenjia Wang, Tong Lu, Gang Yu, Chunhua Shen