| 2025 | ICCV | UniVG: A Generalist Diffusion Model for Unified Image Generation and Editing. | Tsu-Jui Fu, Yusu Qian, Chen Chen, Wenze Hu, Zhe Gan, Yinfei Yang |
| 2025 | ICCV | STIV: Scalable Text and Image Conditioned Video Generation. | Zongyu Lin, Wei Liu, Chen Chen, Jiasen Lu, Wenze Hu, Tsu-Jui Fu, Jesse Allardice, Zhengfeng Lai, Liangchen Song, Bowen Zhang, Cha Chen, Yiran Fei, Lezhi Li, Yinfei Yang, Yizhou Sun, Kai-Wei Chang |
| 2025 | ICLR | Revisit Large-Scale Image-Caption Data in Pre-training Multimodal Foundation Models. | Zhengfeng Lai, Vasileios Saveris, Chen Chen, Hong-You Chen, Haotian Zhang, Bowen Zhang, Wenze Hu, Juan Lao Tebar, Zhe Gan, Peter Grasch, Meng Cao, Yinfei Yang |
| 2024 | ICLR | Guiding Instruction-based Image Editing via Multimodal Large Language Models. | Tsu-Jui Fu, Wenze Hu, Xianzhi Du, William Yang Wang, Yinfei Yang, Zhe Gan |
| 2023 | CVPR | NAR-Former: Neural Architecture Representation Learning Towards Holistic Attributes Prediction. | Yun Yi, Haokui Zhang, Wenze Hu, Nannan Wang, Xiaoyu Wang |
| 2023 | ICCV | ParCNetV2: Oversized Kernel with Enhanced Attention | Ruihan Xu, Haokui Zhang, Wenze Hu, Shiliang Zhang, Xiaoyu Wang |
| 2023 | ICCV | Fcaformer: Forward Cross Attention in Hybrid Vision Transformer. | Haokui Zhang, Wenze Hu, Xiaoyu Wang |
| 2022 | ECCV | ParC-Net: Position Aware Circular Convolution with Merits from ConvNets and Transformer. | Haokui Zhang, Wenze Hu, Xiaoyu Wang |
| 2022 | ECCV | Connecting Compression Spaces with Transformer for Approximate Nearest Neighbor Search. | Haokui Zhang, Buzhou Tang, Wenze Hu, Xiaoyu Wang |
| 2014 | CVPR | Unsupervised Learning of Dictionaries of Hierarchical Compositional Models. | Jifeng Dai, Yi Hong, Wenze Hu, Song-Chun Zhu, Ying Nian Wu |
| 2014 | CVPR | Learning Inhomogeneous FRAME Models for Object Patterns. | Jianwen Xie, Wenze Hu, Song-Chun Zhu, Ying Nian Wu |
| 2013 | ICCV | Modeling Occlusion by Discriminative AND-OR Structures. | Bo Li, Wenze Hu, Tianfu Wu, Song-Chun Zhu |
| 2012 | ACCV | Coupling-and-Decoupling: A Hierarchical Model for Occlusion-Free Car Detection. | Bo Li, Tianfu Wu, Wenze Hu, Mingtao Pei |
| 2012 | CVPR | Learning 3D object templates by hierarchical quantization of geometry and appearance spaces. | Wenze Hu |
| 2011 | ICCV | Image representation by active curves. | Wenze Hu, Ying Nian Wu, Song-Chun Zhu |
| 2010 | CVPR | Learning a probabilistic model mixing 3D and 2D primitives for view invariant object recognition. | Wenze Hu, Song Chun Zhu |
| 2009 | ICIP | Generative model for abandoned object detection. | Jianting Wen, Haifeng Gong, Xia Zhang, Wenze Hu |
| 2008 | CVPR | An integrated background model for video surveillance based on primal sketch and 3D scene geometry. | Wenze Hu, Haifeng Gong, Song Chun Zhu, Yongtian Wang |
| 2008 | ICPR | An interactive scene annotation tool for video surveillance. | Wenze Hu, Jianting Wen, Haifeng Gong, Yongtian Wang |