Enze Xie
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
48
Venues
11
Active years
2019–2025
Best venue rank
A*
Where they publish
Papers
48 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | CVPR | SplatMesh: Interactive 3D Segmentation and Editing Using Mesh-Based Gaussian Splatting. | Kaichen Zhou, Lanqing Hong, Xinhai Chang, Yingji Zhong, Enze Xie, Hao Dong, Zhihao Li, Yongxin Yang, Zhenguo Li, Wei Zhang |
| 2025 | ICASSP | Char-SAM: Turning Segment Anything Model into Scene Text Segmentation Annotator with Character-level Visual Prompts. | Enze Xie, Jiahao Lyu, Daiqing Wu, Huawen Shen, Yu Zhou |
| 2025 | ICCV | SANA-Sprint: One-Step Diffusion with Continuous-Time Consistency Distillation. | Junsong Chen, Shuchen Xue, Yuyang Zhao, Jincheng Yu, Sayak Paul, Junyu Chen, Han Cai, Song Han, Enze Xie |
| 2025 | ICCV | DC-AE 1.5: Accelerating Diffusion Model Convergence with Structured Latent Space. | Junyu Chen, Dongyun Zou, Wenkun He, Junsong Chen, Enze Xie, Song Han, Han Cai |
| 2025 | ICCV | DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer. | Yecheng Wu, Junyu Chen, Zhuoyang Zhang, Enze Xie, Jincheng Yu, Junsong Chen, Jinyi Hu, Yao Lu, Song Han, Han Cai |
| 2025 | ICLR | Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models. | Junyu Chen, Han Cai, Junsong Chen, Enze Xie, Shang Yang, Haotian Tang, Muyang Li, Song Han |
| 2025 | ICLR | SVDQuant: Absorbing Outliers by Low-Rank Component for 4-Bit Diffusion Models. | Muyang Li, Yujun Lin, Zhekai Zhang, Tianle Cai, Xiuyu Li, Junxian Guo, Enze Xie, Chenlin Meng, Jun-Yan Zhu, Song Han |
| 2025 | ICLR | HART: Efficient Visual Generation with Hybrid Autoregressive Transformer. | Haotian Tang, Yecheng Wu, Shang Yang, Enze Xie, Junsong Chen, Junyu Chen, Zhuoyang Zhang, Han Cai, Yao Lu, Song Han |
| 2025 | ICLR | VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation. | Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu |
| 2025 | ICLR | SANA: Efficient High-Resolution Text-to-Image Synthesis with Linear Diffusion Transformers. | Enze Xie, Junsong Chen, Junyu Chen, Han Cai, Haotian Tang, Yujun Lin, Zhekai Zhang, Muyang Li, Ligeng Zhu, Yao Lu, Song Han |
| 2025 | ICML | SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer. | Enze Xie, Junsong Chen, Yuyang Zhao, Jincheng Yu, Ligeng Zhu, Yujun Lin, Zhekai Zhang, Muyang Li, Junyu Chen, Han Cai, Bingchen Liu, Daquan Zhou, Song Han |
| 2024 | AAAI | DeepAccident: A Motion and Accident Prediction Benchmark for V2X Autonomous Driving. | Tianqi Wang, Sukmin Kim, Wenxuan Ji, Enze Xie, Chongjian Ge, Junsong Chen, Zhenguo Li, Ping Luo |
| 2024 | CVPR | Accelerating Diffusion Sampling with Optimized Time Steps. | Shuchen Xue, Zhaoqiang Liu, Fei Chen, Shifeng Zhang, Tianyang Hu, Enze Xie, Zhenguo Li |
| 2024 | ECCV | PIXART-Σ: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation. | Junsong Chen, Chongjian Ge, Enze Xie, Yue Wu, Lewei Yao, Xiaozhe Ren, Zhongdao Wang, Ping Luo, Huchuan Lu, Zhenguo Li |
| 2024 | ECCV | Segment, Lift and Fit: Automatic 3D Shape Labeling from 2D Prompts. | Jianhao Li, Tianyu Sun, Zhongdao Wang, Enze Xie, Bailan Feng, Hongbo Zhang, Ze Yuan, Ke Xu, Jiaheng Liu, Ping Luo |
| 2024 | ECCV | Fast Training of Diffusion Transformer with Extreme Masking for 3D Point Clouds Generation. | Shentong Mo, Enze Xie, Yue Wu, Junsong Chen, Matthias Niener, Zhenguo Li |
| 2024 | ICLR | MagicDrive: Street View Generation with Diverse 3D Geometry Control. | Ruiyuan Gao, Kai Chen, Enze Xie, Lanqing Hong, Zhenguo Li, Dit-Yan Yeung, Qiang Xu |
| 2024 | ICLR | GeoDiffusion: Text-Prompted Geometric Control for Object Detection Data Generation. | Kai Chen, Enze Xie, Zhe Chen, Yibo Wang, Lanqing Hong, Zhenguo Li, Dit-Yan Yeung |
| 2024 | ICLR | PixArt-α: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis. | Junsong Chen, Jincheng Yu, Chongjian Ge, Lewei Yao, Enze Xie, Zhongdao Wang, James T. Kwok, Ping Luo, Huchuan Lu, Zhenguo Li |
| 2024 | ICLR | Large Language Models as Automated Aligners for benchmarking Vision-Language Models. | Yuanfeng Ji, Chongjian Ge, Weikai Kong, Enze Xie, Zhengying Liu, Zhenguo Li, Ping Luo |
| 2024 | ICLR | LEGO-Prover: Neural Theorem Proving with Growing Libraries. | Haiming Wang, Huajian Xin, Chuanyang Zheng, Zhengying Liu, Qingxing Cao, Yinya Huang, Jing Xiong, Han Shi, Enze Xie, Jian Yin, Zhenguo Li, Xiaodan Liang |
| 2024 | ICLR | DQ-LoRe: Dual Queries with Low Rank Approximation Re-ranking for In-Context Learning. | Jing Xiong, Zixuan Li, Chuanyang Zheng, Zhijiang Guo, Yichun Yin, Enze Xie, Zhicheng Yang, Qingxing Cao, Haiming Wang, Xiongwei Han, Jing Tang, Chengming Li, Xiaodan Liang |
| 2023 | ACL | DT-Solver: Automated Theorem Proving with Dynamic-Tree Sampling Guided by Proof-level Value Function. | Haiming Wang, Ye Yuan, Zhengying Liu, Jianhao Shen, Yichun Yin, Jing Xiong, Enze Xie, Han Shi, Yujun Li, Lin Li, Jian Yin, Zhenguo Li, Xiaodan Liang |
| 2023 | ICCV | MetaBEV: Solving Sensor Failures for 3D Detection and Map Segmentation. | Chongjian Ge, Junsong Chen, Enze Xie, Zhongdao Wang, Lanqing Hong, Huchuan Lu, Zhenguo Li, Ping Luo |
| 2023 | ICCV | Beyond One-to-One: Rethinking the Referring Image Segmentation. | Yutao Hu, Qixiong Wang, Wenqi Shao, Enze Xie, Zhenguo Li, Jungong Han, Ping Luo |
| 2023 | ICCV | DDP: Diffusion Model for Dense Visual Prediction. | Yuanfeng Ji, Zhe Chen, Enze Xie, Lanqing Hong, Xihui Liu, Zhaoqiang Liu, Tong Lu, Zhenguo Li, Ping Luo |
| 2023 | ICCV | DiffFit: Unlocking Transferability of Large Diffusion Models via Simple Parameter-Efficient Fine-Tuning. | Enze Xie, Lewei Yao, Han Shi, Zhili Liu, Daquan Zhou, Zhaoqiang Liu, Jiawei Li, Zhenguo Li |
| 2023 | ICCV | Parametric Depth Based Feature Representation Learning for Object Detection and Segmentation in Bird's-Eye View. | Jiayu Yang, Enze Xie, Miaomiao Liu, Jos M. lvarez |
| 2022 | AAAI | Towards Ultra-Resolution Neural Style Transfer via Thumbnail Instance Normalization. | Zhe Chen, Wenhai Wang, Enze Xie, Tong Lu, Ping Luo |
| 2022 | CVPR | Panoptic SegFormer: Delving Deeper into Panoptic Segmentation with Transformers. | Zhiqi Li, Wenhai Wang, Enze Xie, Zhiding Yu, Anima Anandkumar, Jos M. lvarez, Ping Luo, Tong Lu |
| 2022 | ECCV | BEVFormer: Learning Bird's-Eye-View Representation from Multi-camera Images via Spatiotemporal Transformers. | Zhiqi Li, Wenhai Wang, Hongyang Li, Enze Xie, Chonghao Sima, Tong Lu, Yu Qiao, Jifeng Dai |
| 2022 | ICIP | Polygon-Free: Unconstrained Scene Text Detection with Box Annotations. | Weijia Wu, Enze Xie, Ruimao Zhang, Wenhai Wang, Ping Luo, Hong Zhou |
| 2022 | ICLR | CycleMLP: A MLP-like Architecture for Dense Prediction. | Shoufa Chen, Enze Xie, Chongjian Ge, Runjian Chen, Ding Liang, Ping Luo |
| 2022 | ICML | Understanding The Robustness in Vision Transformers. | Daquan Zhou, Zhiding Yu, Enze Xie, Chaowei Xiao, Animashree Anandkumar, Jiashi Feng, Jos M. lvarez |
| 2021 | ICCV | Watch Only Once: An End-to-End Video Action Detection Framework. | Shoufa Chen, Peize Sun, Enze Xie, Chongjian Ge, Jiannan Wu, Lan Ma, Jiajun Shen, Ping Luo |
| 2021 | ICCV | Pyramid Vision Transformer: A Versatile Backbone for Dense Prediction without Convolutions. | Wenhai Wang, Enze Xie, Xiang Li, Deng-Ping Fan, Kaitao Song, Ding Liang, Tong Lu, Ping Luo, Ling Shao |
| 2021 | ICCV | DetCo: Unsupervised Contrastive Learning for Object Detection. | Enze Xie, Jian Ding, Wenhai Wang, Xiaohang Zhan, Hang Xu, Peize Sun, Zhenguo Li, Ping Luo |
| 2021 | ICML | What Makes for End-to-End Object Detection? | Peize Sun, Yi Jiang, Enze Xie, Wenqi Shao, Zehuan Yuan, Changhu Wang, Ping Luo |
| 2021 | IJCAI | Segmenting Transparent Objects in the Wild with Transformer. | Enze Xie, Wenjia Wang, Wenhai Wang, Peize Sun, Hang Xu, Ding Liang, Ping Luo |
| 2020 | ACCV | Synthetic-to-Real Unsupervised Domain Adaptation for Scene Text Detection in the Wild. | Weijia Wu, Ning Lu, Enze Xie, Yuxing Wang, Wenwen Yu, Cheng Yang, Hong Zhou |
| 2020 | CVPR | PolarMask: Single Shot Instance Segmentation With Polar Representation. | Enze Xie, Peize Sun, Xiaoge Song, Wenhai Wang, Xuebo Liu, Ding Liang, Chunhua Shen, Ping Luo |
| 2020 | ECCV | Differentiable Hierarchical Graph Grouping for Multi-person Pose Estimation. | Sheng Jin, Wentao Liu, Enze Xie, Wenhai Wang, Chen Qian, Wanli Ouyang, Ping Luo |
| 2020 | ECCV | AE TextSpotter: Learning Visual and Linguistic Representation for Ambiguous Text Spotting. | Wenhai Wang, Xuebo Liu, Xiaozhong Ji, Enze Xie, Ding Liang, Zhibo Yang, Tong Lu, Chunhua Shen, Ping Luo |
| 2020 | ECCV | Scene Text Image Super-Resolution in the Wild. | Wenjia Wang, Enze Xie, Xuebo Liu, Wenhai Wang, Ding Liang, Chunhua Shen, Xiang Bai |
| 2020 | ECCV | Segmenting Transparent Objects in the Wild. | Enze Xie, Wenjia Wang, Wenhai Wang, Mingyu Ding, Chunhua Shen, Ping Luo |
| 2019 | AAAI | Scene Text Detection with Supervised Pyramid Context Network. | Enze Xie, Yuhang Zang, Shuai Shao, Gang Yu, Cong Yao, Guangyao Li |
| 2019 | CVPR | Shape Robust Text Detection With Progressive Scale Expansion Network. | Wenhai Wang, Enze Xie, Xiang Li, Wenbo Hou, Tong Lu, Gang Yu, Shuai Shao |
| 2019 | ICCV | Efficient and Accurate Arbitrary-Shaped Text Detection With Pixel Aggregation Network. | Wenhai Wang, Enze Xie, Xiaoge Song, Yuhang Zang, Wenjia Wang, Tong Lu, Gang Yu, Chunhua Shen |