Xihui Liu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
56
Venues
11
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
56 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | GENMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration. | Kaiyi Huang, Yukun Huang, Xuefei Ning, Zinan Lin, Yu Wang, Xihui Liu |
| 2026 | AAAI | Self-NPO: Data-Free Diffusion Model Enhancement via Truncated Diffusion Fine-Tuning. | Fu-Yun Wang, Keqiang Sun, Yao Teng, Xihui Liu, Jiale Yuan, Jiaming Song, Hongsheng Li |
| 2026 | ACL | GRPO-CARE: Consistency-Aware Reinforcement Learning for Multimodal Reasoning. | Yi Chen, Yuying Ge, Rui Wang, Yixiao Ge, Junhao Cheng, Ying Shan, Xihui Liu |
| 2026 | ACL | T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation. | Kaiyue Sun, Rongyao Fang, Chengqi Duan, Xian Liu, Aoxue Li, Xihui Liu |
| 2025 | CVPR | MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation. | Zehuan Huang, Yuan-Chen Guo, Xingqiao An, Yunhan Yang, Yangguang Li, Zi-Xin Zou, Ding Liang, Xihui Liu, Yan-Pei Cao, Lu Sheng |
| 2025 | CVPR | HMAR: Efficient Hierarchical Masked Auto-Regressive Image Generation. | Hermann Kumbong, Xian Liu, Tsung-Yi Lin, Ming-Yu Liu, Xihui Liu, Ziwei Liu, Daniel Y. Fu, Christopher R, David W. Romero |
| 2025 | CVPR | MBQ: Modality-Balanced Quantization for Large Vision-Language Models. | Shiyao Li, Yingchun Hu, Xuefei Ning, Xihui Liu, Ke Hong, Xiaotao Jia, Xiuhong Li, Yaqi Yan, Pei Ran, Guohao Dai, Shengen Yan, Huazhong Yang, Yu Wang |
| 2025 | CVPR | T2ISafety: Benchmark for Assessing Fairness, Toxicity, and Privacy in Image Generation. | Lijun Li, Zhelun Shi, Xuhao Hu, Bowen Dong, Yiran Qin, Xihui Liu, Lu Sheng, Jing Shao |
| 2025 | CVPR | T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation. | Kaiyue Sun, Kaiyi Huang, Xian Liu, Yue Wu, Zihan Xu, Zhenguo Li, Xihui Liu |
| 2025 | CVPR | Parallelized Autoregressive Visual Generation. | Yuqing Wang, Shuhuai Ren, Zhijie Lin, Yujin Han, Haoyuan Guo, Zhenheng Yang, Difan Zou, Jiashi Feng, Xihui Liu |
| 2025 | ICCV | Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos. | Yi Chen, Yuying Ge, Weiliang Tang, Yizhuo Li, Yixiao Ge, Mingyu Ding, Ying Shan, Xihui Liu |
| 2025 | ICCV | PUMA: Empowering Unified MLLM with Multi-Granular Visual Generation. | Rongyao Fang, Chengqi Duan, Kun Wang, Hao Li, Linjiang Huang, Hao Tian, Xingyu Zeng, Rui Zhao, Jifeng Dai, Hongsheng Li, Xihui Liu |
| 2025 | ICCV | V2PE: Improving Multimodal Long-Context Capability of Vision-Language Models with Variable Visual Position Encoding. | Junqi Ge, Ziyi Chen, Jintao Lin, Jinguo Zhu, Xihui Liu, Jifeng Dai, Xizhou Zhu |
| 2025 | ICCV | DreamCube: RGB-D Panorama Generation via Multi-Plane Synchronization. | Yukun Huang, Yanning Zhou, Jianan Wang, Kaiyi Huang, Xihui Liu |
| 2025 | ICCV | RoboFactory: Exploring Embodied Agent Collaboration with Compositional Constraints. | Yiran Qin, Li Kang, Xiufeng Song, Zhenfei Yin, Xiaohong Liu, Xihui Liu, Ruimao Zhang, Lei Bai |
| 2025 | ICCV | LiT: Delving into a Simple Linear Diffusion Transformer for Image Generation. | Jiahao Wang, Ning Kang, Lewei Yao, Mengzhao Chen, Chengyue Wu, Songyang Zhang, Shuchen Xue, Yong Liu, Taiqiang Wu, Xihui Liu, Kaipeng Zhang, Shifeng Zhang, Wenqi Shao, Zhenguo Li, Ping Luo |
| 2025 | ICCV | Bridging Continuous and Discrete Tokens for Autoregressive Visual Generation. | Yuqing Wang, Zhijie Lin, Yao Teng, Yuanzhi Zhu, Shuhuai Ren, Jiashi Feng, Xihui Liu |
| 2025 | ICCV | GigaTok: Scaling Visual Tokenizers to 3 Billion Parameters for Autoregressive Image Generation. | Tianwei Xiong, Jun Hao Liew, Zilong Huang, Jiashi Feng, Xihui Liu |
| 2025 | ICCV | GameFactorly: Creating New Games with Generative Interactive Videos. | Jiwen Yu, Yiran Qin, Xintao Wang, Pengfei Wan, Di Zhang, Xihui Liu |
| 2025 | ICCV | LLaVA-3D: A Simple Yet Effective Pathway to Empowering LMMs with 3D Capabilities. | Chenming Zhu, Tai Wang, Wenwei Zhang, Jiangmiao Pang, Xihui Liu |
| 2025 | ICLR | Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding. | Yao Teng, Han Shi, Xian Liu, Xuefei Ning, Guohao Dai, Yu Wang, Zhenguo Li, Xihui Liu |
| 2025 | ICML | UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation. | Qin Guo, Ailing Zeng, Dongxu Yue, Ceyuan Yang, Yang Cao, Hanzhong Guo, Fei Shen, Wei Liu, Xihui Liu, Dan Xu |
| 2025 | ICML | WorldSimBench: Towards Video Generation Models as World Simulators. | Yiran Qin, Zhelun Shi, Jiwen Yu, Xijun Wang, Enshen Zhou, Lijun Li, Zhenfei Yin, Xihui Liu, Lu Sheng, Jing Shao, Lei Bai, Ruimao Zhang |
| 2025 | SiggraphA | OmniPart: Part-Aware 3D Generation with Semantic Decoupling and Structural Cohesion. | Yunhan Yang, Yufan Zhou, Yuan-Chen Guo, Zi-Xin Zou, Yukun Huang, Ying-Tian Liu, Hao Xu, Ding Liang, Yan-Pei Cao, Xihui Liu |
| 2025 | SiggraphA | Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval. | Jiwen Yu, Jianhong Bai, Yiran Qin, Quande Liu, Xintao Wang, Pengfei Wan, Di Zhang, Xihui Liu |
| 2024 | CVPR | Point Transformer V3: Simpler, Faster, Stronger. | Xiaoyang Wu, Li Jiang, Peng-Shuai Wang, Zhijian Liu, Xihui Liu, Yu Qiao, Wanli Ouyang, Tong He, Hengshuang Zhao |
| 2024 | CVPR | HumanGaussian: Text-Driven 3D Human Generation with Gaussian Splatting. | Xian Liu, Xiaohang Zhan, Jiaxiang Tang, Ying Shan, Gang Zeng, Dahua Lin, Xihui Liu, Ziwei Liu |
| 2024 | CVPR | EmbodiedScan: A Holistic Multi-Modal 3D Perception Suite Towards Embodied AI. | Tai Wang, Xiaohan Mao, Chenming Zhu, Runsen Xu, Ruiyuan Lyu, Peisen Li, Xiao Chen, Wenwei Zhang, Kai Chen, Tianfan Xue, Xihui Liu, Cewu Lu, Dahua Lin, Jiangmiao Pang |
| 2024 | CVPR | Towards Large-Scale 3D Representation Learning with Multi-Dataset Point Prompt Training. | Xiaoyang Wu, Zhuotao Tian, Xin Wen, Bohao Peng, Xihui Liu, Kaicheng Yu, Hengshuang Zhao |
| 2024 | CVPR | DreamComposer: Controllable 3D Object Generation via Multi-View Conditions. | Yunhan Yang, Yukun Huang, Xiaoyang Wu, Yuan-Chen Guo, Song-Hai Zhang, Hengshuang Zhao, Tong He, Xihui Liu |
| 2024 | ECCV | TC4D: Trajectory-Conditioned Text-to-4D Generation. | Sherwin Bahmani, Xian Liu, Wang Yifan, Ivan Skorokhodov, Victor Rong, Ziwei Liu, Xihui Liu, Jeong Joon Park, Sergey Tulyakov, Gordon Wetzstein, Andrea Tagliasacchi, David B. Lindell |
| 2024 | ECCV | PredBench: Benchmarking Spatio-Temporal Prediction Across Diverse Disciplines. | Zidong Wang, Zeyu Lu, Di Huang, Tong He, Xihui Liu, Wanli Ouyang, Lei Bai |
| 2024 | ECCV | ScanReason: Empowering 3D Visual Grounding with Reasoning Capabilities. | Chenming Zhu, Tai Wang, Wenwei Zhang, Kai Chen, Xihui Liu |
| 2024 | ICLR | HyperHuman: Hyper-Realistic Human Generation with Latent Structural Diffusion. | Xian Liu, Jian Ren, Aliaksandr Siarohin, Ivan Skorokhodov, Yanyu Li, Dahua Lin, Xihui Liu, Ziwei Liu, Sergey Tulyakov |
| 2024 | ICML | FiT: Flexible Vision Transformer for Diffusion Model. | Zeyu Lu, Zidong Wang, Di Huang, Chengyue Wu, Xihui Liu, Wanli Ouyang, Lei Bai |
| 2024 | WACV | Hierarchical Diffusion Autoencoders and Disentangled Image Manipulation. | Zeyu Lu, Chengyue Wu, Xinyuan Chen, Yaohui Wang, Lei Bai, Yu Qiao, Xihui Liu |
| 2024 | WACV | Shape-Guided Diffusion with Inside-Outside Attention. | Dong Huk Park, Grace Luo, Clayton Toste, Samaneh Azadi, Xihui Liu, Maka Karalashvili, Anna Rohrbach, Trevor Darrell |
| 2023 | CVPR | Masked Scene Contrast: A Scalable Framework for Unsupervised 3D Representation Learning. | Xiaoyang Wu, Xin Wen, Xihui Liu, Hengshuang Zhao |
| 2023 | CVPR | GLeaD: Improving GANs with A Generator-Leading Task. | Qingyan Bai, Ceyuan Yang, Yinghao Xu, Xihui Liu, Yujiu Yang, Yujun Shen |
| 2023 | CVPR | Back to the Source: Diffusion-Driven Adaptation to Test-Time Corruption. | Jin Gao, Jialing Zhang, Xihui Liu, Trevor Darrell, Evan Shelhamer, Dequan Wang |
| 2023 | CVPR | RIFormer: Keep Your Vision Backbone Effective But Removing Token Mixer. | Jiahao Wang, Songyang Zhang, Yong Liu, Taiqiang Wu, Yujiu Yang, Xihui Liu, Kai Chen, Ping Luo, Dahua Lin |
| 2023 | CVPR | Learning Transferable Spatiotemporal Representations from Natural Script Knowledge. | Ziyun Zeng, Yuying Ge, Xihui Liu, Bin Chen, Ping Luo, Shu-Tao Xia, Yixiao Ge |
| 2023 | ICCV | DDP: Diffusion Model for Dense Visual Prediction. | Yuanfeng Ji, Zhe Chen, Enze Xie, Lanqing Hong, Xihui Liu, Zhaoqiang Liu, Tong Lu, Zhenguo Li, Ping Luo |
| 2023 | WACV | More Control for Free! Image Synthesis with Semantic Diffusion Guidance. | Xihui Liu, Dong Huk Park, Samaneh Azadi, Gong Zhang, Arman Chopikyan, Yuxiao Hu, Humphrey Shi, Anna Rohrbach, Trevor Darrell |
| 2022 | CVPR | Bridging Video-text Retrieval with Multiple Choice Questions. | Yuying Ge, Yixiao Ge, Xihui Liu, Dian Li, Ying Shan, Xiaohu Qie, Ping Luo |
| 2022 | ECCV | MILES: Visual BERT Pre-training with Injected Language Semantics for Video-Text Retrieval. | Yuying Ge, Yixiao Ge, Xihui Liu, Jinpeng Wang, Jianping Wu, Ying Shan, Xiaohu Qie, Ping Luo |
| 2020 | ECCV | Open-Edit: Open-Domain Image Manipulation with Open-Vocabulary Instructions. | Xihui Liu, Zhe Lin, Jianming Zhang, Handong Zhao, Quan Tran, Xiaogang Wang, Hongsheng Li |
| 2019 | CVPR | Improving Referring Expression Grounding With Cross-Modal Attention-Guided Erasing. | Xihui Liu, Zihao Wang, Jing Shao, Xiaogang Wang, Hongsheng Li |
| 2019 | ICCV | CAMP: Cross-Modal Adaptive Message Passing for Text-Image Retrieval. | Zihao Wang, Xihui Liu, Hongsheng Li, Lu Sheng, Junjie Yan, Xiaogang Wang, Jing Shao |
| 2018 | BMVC | Localization Guided Learning for Pedestrian Attribute Recognition. | Pengze Liu, Xihui Liu, Junjie Yan, Jing Shao |
| 2018 | ECCV | Improving Deep Visual Representation for Person Re-identification by Global and Local Image-language Association. | Dapeng Chen, Hongsheng Li, Xihui Liu, Yantao Shen, Jing Shao, Zejian Yuan, Xiaogang Wang |
| 2018 | ECCV | Show, Tell and Discriminate: Image Captioning by Self-retrieval with Partially Labeled Data. | Xihui Liu, Hongsheng Li, Jing Shao, Dapeng Chen, Xiaogang Wang |
| 2017 | CVPR | Object Detection in Videos with Tubelet Proposal Networks. | Kai Kang, Hongsheng Li, Tong Xiao, Wanli Ouyang, Junjie Yan, Xihui Liu, Xiaogang Wang |
| 2017 | ICCV | HydraPlus-Net: Attentive Deep Features for Pedestrian Analysis. | Xihui Liu, Haiyu Zhao, Maoqing Tian, Lu Sheng, Jing Shao, Shuai Yi, Junjie Yan, Xiaogang Wang |
| 2017 | ICCV | Orientation Invariant Feature Embedding and Spatial Temporal Regularization for Vehicle Re-identification. | Zhongdao Wang, Luming Tang, Xihui Liu, Zhuliang Yao, Shuai Yi, Jing Shao, Junjie Yan, Shengjin Wang, Hongsheng Li, Xiaogang Wang |
| 2016 | MASS | Measurement-Driven Capability Modeling for Mobile Network in Large-Scale Urban Environment. | Jingtao Ding, Xihui Liu, Yong Li, Di Wu, Depeng Jin, Sheng Chen |