Skip to content

Saining Xie

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

55

Venues

10

Active years

2012–2026

Best venue rank

A*

Where they publish

Papers

55 indexed papers, newest first.

YearVenueTitleAuthors
2026ASPLOSCLM: Removing the GPU Memory Barrier for 3D Gaussian Splatting.Hexu Zhao, Xiwen Min, Xiaoteng Liu, Moonjun Gong, Yiming Li, Ang Li, Saining Xie, Jinyang Li, Aurojit Panda
2025CVPRScience-T2I: Addressing Scientific Illusions in Image Synthesis.Jialuo Li, Wenhao Chai, Xingyu Fu, Haiyang Xu, Saining Xie
2025CVPRScaling Inference Time Compute for Diffusion Models.Nanye Ma, Shangyuan Tong, Haolin Jia, Hexiang Hu, Yu-Chuan Su, Mingda Zhang, Xuan Yang, Yandong Li, Tommi S. Jaakkola, Xuhui Jia, Saining Xie
2025CVPRExploring the Deep Fusion of Large Language Models and Diffusion Transformers for Text-to-Image Synthesis.Bingda Tang, Boyang Zheng, Sayak Paul, Saining Xie
2025CVPRThinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces.Jihan Yang, Shusheng Yang, Anjali W. Gupta, Rilyn Han, Li Fei-Fei, Saining Xie
2025ICCVScaling Language-Free Visual Representation Learning.David Fan, Shengbang Tong, Jiachen Zhu, Koustuv Sinha, Zhuang Liu, Xinlei Chen, Michael Rabbat, Nicolas Ballas, Yann LeCun, Amir Bar, Saining Xie
2025ICCVREPA-E: Unlocking VAE for End-to-End Tuning with Latent Diffusion Transformers.Xingjian Leng, Jaskirat Singh, Yunzhong Hou, Zhenchang Xing, Saining Xie, Liang Zheng
2025ICCVMetaMorph: Multimodal Understanding and Generation via Instruction Tuning.Shengbang Tong, David Fan, Jiachen Zhu, Yunyang Xiong, Xinlei Chen, Koustuv Sinha, Michael Rabbat, Yann LeCun, Saining Xie, Zhuang Liu
2025ICLRAuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark.Wenhao Chai, Enxin Song, Yilun Du, Chenlin Meng, Vashisht Madhavan, Omer Bar-Tal, Jenq-Neng Hwang, Saining Xie, Christopher D. Manning
2025ICLRDeconstructing Denoising Diffusion Models for Self-Supervised Learning.Xinlei Chen, Zhuang Liu, Saining Xie, Kaiming He
2025ICLRDiffusionGuard: A Robust Defense Against Malicious Diffusion-based Image Editing.June Suk Choi, Kyungmin Lee, Jongheon Jeong, Saining Xie, Jinwoo Shin, Kimin Lee
2025ICLRRepresentation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think.Sihyun Yu, Sangkyung Kwak, Huiwon Jang, Jongheon Jeong, Jonathan Huang, Jinwoo Shin, Saining Xie
2025ICLROn Scaling Up 3D Gaussian Splatting Training.Hexu Zhao, Haoyang Weng, Daohan Lu, Ang Li, Jinyang Li, Aurojit Panda, Saining Xie
2025ICMLSFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training.Tianzhe Chu, Yuexiang Zhai, Jihan Yang, Shengbang Tong, Saining Xie, Dale Schuurmans, Quoc V. Le, Sergey Levine, Yi Ma
2025ICMLPISA Experiments: Exploring Physics Post-Training for Video Diffusion Models by Watching Stuff Drop.Chenyu Li, Oscar Michel, Xichen Pan, Sainan Liu, Mike Roberts, Saining Xie
2024CVPRMoDE: CLIP Data Experts via Clustering.Jiawei Ma, Po-Yao Huang, Saining Xie, Shang-Wen Li, Luke Zettlemoyer, Shih-Fu Chang, Wen-Tau Yih, Hu Xu
2024CVPREyes Wide Shut? Exploring the Visual Shortcomings of Multimodal LLMs.Shengbang Tong, Zhuang Liu, Yuexiang Zhai, Yi Ma, Yann LeCun, Saining Xie
2024CVPRV*: Guided Visual Search as a Core Mechanism in Multimodal LLMs.Penghao Wu, Saining Xie
2024CVPRImage Sculpting: Precise Object Editing with 3D Geometry Control.Jiraphon Yenphraphai, Xichen Pan, Sainan Liu, Daniele Panozzo, Saining Xie
2024ECCVFast Encoding and Decoding for Implicit Video Representation.Hao Chen, Saining Xie, Ser-Nam Lim, Abhinav Shrivastava
2024ECCVSiT: Exploring Flow and Diffusion-Based Generative Models with Scalable Interpolant Transformers.Nanye Ma, Mark Goldstein, Michael S. Albergo, Nicholas M. Boffi, Eric Vanden-Eijnden, Saining Xie
2024ECCVV-IRL: Grounding Virtual Intelligence in Real Life.Jihan Yang, Runyu Ding, Ellis Brown, Xiaojuan Qi, Saining Xie
2024ECCVOn Scaling Up 3D Gaussian Splatting Training.Hexu Zhao, Haoyang Weng, Daohan Lu, Ang Li, Jinyang Li, Aurojit Panda, Saining Xie
2024EMNLPAltogether: Image Captioning via Re-aligning Alt-text.Hu Xu, Po-Yao Huang, Xiaoqing Ellen Tan, Ching-Feng Yeh, Jacob Kahn, Christine Jou, Gargi Ghosh, Omer Levy, Luke Zettlemoyer, Wen-tau Yih, Shang-Wen Li, Saining Xie, Christoph Feichtenhofer
2024ICLRDemystifying CLIP Data.Hu Xu, Saining Xie, Xiaoqing Ellen Tan, Po-Yao Huang, Russell Howes, Vasu Sharma, Shang-Wen Li, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer
2024ICLRWhat Does a Visual Formal Analysis of the World's 500 Most Famous Paintings Tell Us About Multimodal LLMs?Muzi Tao, Saining Xie
2023CVPRConvNeXt V2: Co-designing and Scaling ConvNets with Masked Autoencoders.Sanghyun Woo, Shoubhik Debnath, Ronghang Hu, Xinlei Chen, Zhuang Liu, In So Kweon, Saining Xie
2023ICCVCiT: Curation in Training for Effective Vision-Language Data.Hu Xu, Saining Xie, Po-Yao Huang, Licheng Yu, Russell Howes, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer
2023ICCVScalable Diffusion Models with Transformers.William Peebles, Saining Xie
2023ICCVGoing Denser with Open-Vocabulary Part Segmentation.Peize Sun, Shoufa Chen, Chenchen Zhu, Fanyi Xiao, Ping Luo, Saining Xie, Zhicheng Yan
2022CVPRA ConvNet for the 2020s.Zhuang Liu, Hanzi Mao, Chao-Yuan Wu, Christoph Feichtenhofer, Trevor Darrell, Saining Xie
2022CVPRMasked Feature Prediction for Self-Supervised Visual Pre-Training.Chen Wei, Haoqi Fan, Saining Xie, Chao-Yuan Wu, Alan L. Yuille, Christoph Feichtenhofer
2022CVPRMasked Autoencoders Are Scalable Vision Learners.Kaiming He, Xinlei Chen, Saining Xie, Yanghao Li, Piotr Dollr, Ross B. Girshick
2022ECCVSLIP: Self-supervision Meets Language-Image Pre-training.Norman Mu, Alexander Kirillov, David A. Wagner, Saining Xie
2021CVPRExploring Data-Efficient 3D Scene Understanding With Contrastive Scene Contexts.Ji Hou, Benjamin Graham, Matthias Niener, Saining Xie
2021ICCVAn Empirical Study of Training Self-Supervised Vision Transformers.Xinlei Chen, Saining Xie, Kaiming He
2021ICCVPri3D: Can 3D Priors Help 2D Representation Learning?Ji Hou, Saining Xie, Benjamin Graham, Angela Dai, Matthias Niener
2020CVPRMomentum Contrast for Unsupervised Visual Representation Learning.Kaiming He, Haoqi Fan, Yuxin Wu, Saining Xie, Ross B. Girshick
2020CVPRFBNetV2: Differentiable Neural Architecture Search for Spatial and Channel Dimensions.Alvin Wan, Xiaoliang Dai, Peizhao Zhang, Zijian He, Yuandong Tian, Saining Xie, Bichen Wu, Matthew Yu, Tao Xu, Kan Chen, Peter Vajda, Joseph E. Gonzalez
2020ECCVAre Labels Necessary for Neural Architecture Search?Chenxi Liu, Piotr Dollr, Kaiming He, Ross B. Girshick, Alan L. Yuille, Saining Xie
2020ECCVPointContrast: Unsupervised Pre-training for 3D Point Cloud Understanding.Saining Xie, Jiatao Gu, Demi Guo, Charles R. Qi, Leonidas J. Guibas, Or Litany
2020ICLRDecoupling Representation and Classifier for Long-Tailed Recognition.Bingyi Kang, Saining Xie, Marcus Rohrbach, Zhicheng Yan, Albert Gordo, Jiashi Feng, Yannis Kalantidis
2020ICMLGraph Structure of Neural Networks.Jiaxuan You, Jure Leskovec, Kaiming He, Saining Xie
2019ICCVOrder-Aware Generative Modeling Using the 3D-Craft Dataset.Zhuoyuan Chen, Kavya Srinet, Charles R. Qi, Haoqi Fan, Jerry Ma, Larry Zitnick, Demi Guo, Tong Xiao, Saining Xie, Xinlei Chen, Arthur Szlam, Shubham Tulsiani, Haonan Yu, Jonathan Gray
2019ICCVOn Network Design Spaces for Visual Recognition.Ilija Radosavovic, Justin Johnson, Saining Xie, Wan-Yen Lo, Piotr Dollr
2019ICCVExploring Randomly Wired Neural Networks for Image Recognition.Saining Xie, Alexander Kirillov, Ross B. Girshick, Kaiming He
2018CVPRAttentional ShapeContextNet for Point Cloud Recognition.Saining Xie, Sainan Liu, Zeyu Chen, Zhuowen Tu
2018ECCVRethinking Spatiotemporal Feature Learning: Speed-Accuracy Trade-offs in Video Classification.Saining Xie, Chen Sun, Jonathan Huang, Zhuowen Tu, Kevin Murphy
2017CVPRAggregated Residual Transformations for Deep Neural Networks.Saining Xie, Ross B. Girshick, Piotr Dollr, Zhuowen Tu, Kaiming He
2016ECCVTop-Down Learning for Structured Labeling with Convolutional Pseudoprior.Saining Xie, Xun Huang, Zhuowen Tu
2015AISTATSDeeply-Supervised Nets.Chen-Yu Lee, Saining Xie, Patrick W. Gallagher, Zhengyou Zhang, Zhuowen Tu
2015CVPRHyper-class augmented and regularized deep learning for fine-grained image classification.Saining Xie, Tianbao Yang, Xiaoyu Wang, Yuanqing Lin
2015ICCVHolistically-Nested Edge Detection.Saining Xie, Zhuowen Tu
2013BMVCPerception Preserving Projections.Saining Xie, Jiashi Feng, Shuicheng Yan, Hongtao Lu
2012ICPRMulti-task co-clustering via nonnegative matrix factorization.Saining Xie, Hongtao Lu, Yangcheng He