| 2026 | AAAI | History-Enhanced Two-Stage Transformer for Aerial Vision-and-Language Navigation. | Xichen Ding, Jianzhe Gao, Cong Pan, Wenguan Wang, Jie Qin |
| 2025 | CVPR | DiffVsgg: Diffusion-Driven Online Video Scene Graph Generation. | Mu Chen, Liulei Li, Wenguan Wang, Yi Yang |
| 2025 | CVPR | Scene Map-based Prompt Tuning for Navigation Instruction Generation. | Sheng Fan, Rui Liu, Wenguan Wang, Yi Yang |
| 2025 | CVPR | Multi-view Reconstruction via SfM-guided Monocular Depth Estimation. | Haoyu Guo, He Zhu, Sida Peng, Haotong Lin, Yunzhi Yan, Tao Xie, Wenguan Wang, Xiaowei Zhou, Hujun Bao |
| 2025 | CVPR | LOGICZSL: Exploring Logic-induced Representation for Compositional Zero-shot Learning. | Peng Wu, Xiankai Lu, Hao Hu, Yongqin Xian, Jianbing Shen, Wenguan Wang |
| 2025 | CVPR | TAGA: Self-supervised Learning for Template-free Animatable Gaussian Articulated Model. | Zhichao Zhai, Guikun Chen, Wenguan Wang, Dong Zheng, Jun Xiao |
| 2025 | CVPR | UNIALIGN: Scaling Multimodal Alignment within One Unified Model. | Bo Zhou, Liulei Li, Yujia Wang, Huafeng Liu, Yazhou Yao, Wenguan Wang |
| 2025 | ICCV | Cycle-Consistent Learning for Joint Layout-to-Image Generation and Object Detection. | Xinhao Cai, Qiuxia Lai, Gensheng Pei, Xiangbo Shu, Yazhou Yao, Wenguan Wang |
| 2025 | ICCV | Gaussian-Based World Model: Gaussian Priors for Voxel-Based Occupancy Prediction and Future Motion Prediction. | Tuo Feng, Wenguan Wang, Yi Yang |
| 2025 | ICCV | 3D Gaussian Map with Open-Set Semantic Grouping for Vision-Language Navigation. | Jianzhe Gao, Rui Liu, Wenguan Wang |
| 2025 | ICCV | Dual Reciprocal Learning of Language-based Human Motion Understanding and Generation. | Chen Liang, Zhicheng Shi, Wenguan Wang, Yi Yang |
| 2025 | ICCV | Towards Human-Like Virtual Beings: Simulating Human Behavior in 3D Scenes. | Chen Liang, Wenguan Wang, Yi Yang |
| 2025 | ICCV | Underwater Visual SLAM with Depth Uncertainty and Medium Modeling. | Rui Liu, Sheng Fan, Wenguan Wang, Yi Yang |
| 2025 | ICCV | A Conditional Probability Framework for Compositional Zero-Shot Learning. | Peng Wu, Qiuxia Lai, Hao Fang, Guo-Sen Xie, Yilong Yin, Xiankai Lu, Wenguan Wang |
| 2025 | ICLR | Hydra-SGG: Hybrid Relation Assignment for One-stage Scene Graph Generation. | Minghan Chen, Guikun Chen, Wenguan Wang, Yi Yang |
| 2025 | ICLR | Learning Clustering-based Prototypes for Compositional Zero-Shot Learning. | Hongyu Qu, Jianan Wei, Xiangbo Shu, Wenguan Wang |
| 2025 | ICLR | Do as We Do, Not as You Think: the Conformity of Large Language Models. | Zhiyuan Weng, Guikun Chen, Wenguan Wang |
| 2024 | AAAI | Interpretable3D: An Ad-Hoc Interpretable Classifier for 3D Point Clouds. | Tuo Feng, Ruijie Quan, Xiaohan Wang, Wenguan Wang, Yi Yang |
| 2024 | ACL | MS2SL: Multimodal Spoken Data-Driven Continuous Sign Language Production. | Jian Ma, Wenguan Wang, Yi Yang, Feng Zheng |
| 2024 | CVPR | LSK3DNet: Towards Effective and Efficient 3D Perception with Large Sparse Kernels. | Tuo Feng, Wenguan Wang, Fan Ma, Yi Yang |
| 2024 | CVPR | Poly Kernel Inception Network for Remote Sensing Detection. | Xinhao Cai, Qiuxia Lai, Yuwei Wang, Wenguan Wang, Zeren Sun, Yazhou Yao |
| 2024 | CVPR | Neural Clustering Based Visual Representation Learning. | Guikun Chen, Xia Li, Yi Yang, Wenguan Wang |
| 2024 | CVPR | Clustering Propagation for Universal Medical Image Segmentation. | Yuhang Ding, Liulei Li, Wenguan Wang, Yi Yang |
| 2024 | CVPR | Volumetric Environment Representation for Vision-Language Navigation. | Rui Liu, Wenguan Wang, Yi Yang |
| 2024 | CVPR | Clustering for Protein Representation Learning. | Ruijie Quan, Wenguan Wang, Fan Ma, Hehe Fan, Yi Yang |
| 2024 | CVPR | Psychometry: An Omnifit Model for Image Reconstruction from Human Brain Activity. | Ruijie Quan, Wenguan Wang, Zhibo Tian, Fan Ma, Yi Yang |
| 2024 | CVPR | IS-Fusion: Instance-Scene Collaborative Fusion for Multimodal 3D Object Detection. | Junbo Yin, Jianbing Shen, Runnan Chen, Wei Li, Ruigang Yang, Pascal Frossard, Wenguan Wang |
| 2024 | ECCV | General and Task-Oriented Video Segmentation. | Mu Chen, Liulei Li, Wenguan Wang, Ruijie Quan, Yi Yang |
| 2024 | ECCV | Navigation Instruction Generation with BEV Perception and Large Language Models. | Sheng Fan, Rui Liu, Wenguan Wang, Yi Yang |
| 2024 | ECCV | Shape2Scene: 3D Scene Representation Learning Through Pre-training on Shape Data. | Tuo Feng, Wenguan Wang, Ruijie Quan, Yi Yang |
| 2024 | ECCV | Controllable Navigation Instruction Generation with Chain of Thought Prompting. | Xianghao Kong, Jinyu Chen, Wenguan Wang, Hang Su, Xiaolin Hu, Yi Yang, Si Liu |
| 2024 | ECCV | Mutual Learning for Acoustic Matching and Dereverberation via Visual Scene-Driven Diffusion. | Jian Ma, Wenguan Wang, Yi Yang, Feng Zheng |
| 2024 | ECCV | Nonverbal Interaction Detection. | Jianan Wei, Tianfei Zhou, Yi Yang, Wenguan Wang |
| 2024 | ICLR | Facing the Elephant in the Room: Visual Prompt Tuning or Full finetuning? | Cheng Han, Qifan Wang, Yiming Cui, Wenguan Wang, Lifu Huang, Siyuan Qi, Dongfang Liu |
| 2024 | ICML | DoraemonGPT: Toward Understanding Dynamic Scenes with Large Language Models (Exemplified as A Video Agent). | Zongxin Yang, Guikun Chen, Xiaodi Li, Wenguan Wang, Yi Yang |
| 2023 | CVPR | Unified Mask Embedding and Correspondence Learning for Self-Supervised Video Segmentation. | Liulei Li, Wenguan Wang, Tianfei Zhou, Jianwu Li, Yi Yang |
| 2023 | CVPR | LANA: A Language-Capable Navigator for Instruction Following and Generation. | Xiaohan Wang, Wenguan Wang, Jiayi Shao, Yi Yang |
| 2023 | CVPR | Boosting Video Object Segmentation via Space-Time Correspondence Learning. | Yurong Zhang, Liulei Li, Wenguan Wang, Rong Xie, Li Song, Wenjun Zhang |
| 2023 | ICCV | Clustering based Point Cloud Representation Learning for 3D Analysis. | Tuo Feng, Wenguan Wang, Xiaohan Wang, Yi Yang, Qinghua Zheng |
| 2023 | ICCV | Omnidirectional Information Gathering for Knowledge Transfer-based Audio-Visual Navigation. | Jinyu Chen, Wenguan Wang, Si Liu, Hongsheng Li, Yi Yang |
| 2023 | ICCV | E | Cheng Han, Qifan Wang, Yiming Cui, Zhiwen Cao, Wenguan Wang, Siyuan Qi, Dongfang Liu |
| 2023 | ICCV | Logic-induced Diagnostic Reasoning for Semi-supervised Semantic Segmentation. | Chen Liang, Wenguan Wang, Jiaxu Miao, Yi Yang |
| 2023 | ICCV | Bird's-Eye-View Scene Graph for Vision-Language Navigation. | Rui Liu, Xiaohan Wang, Wenguan Wang, Yi Yang |
| 2023 | ICCV | LogicSeg: Parsing Visual Semantics with Neural Logic Learning and Reasoning. | Liulei Li, Wenguan Wang, Yang Yi |
| 2023 | ICCV | Dreamwalker: Mental Planning for Continuous Vision-Language Navigation. | Hanqing Wang, Wei Liang, Luc Van Gool, Wenguan Wang |
| 2023 | ICCV | Large-Scale Person Detection and Localization using Overhead Fisheye Cameras. | Lu Yang, Liulei Li, Xueshi Xin, Yifan Sun, Qing Song, Wenguan Wang |
| 2023 | ICLR | Visual Recognition with Deep Nearest Centroids. | Wenguan Wang, Cheng Han, Tianfei Zhou, Dongfang Liu |
| 2023 | ICML | CLUSTSEG: Clustering for Universal Segmentation. | James Chenhao Liang, Tianfei Zhou, Dongfang Liu, Wenguan Wang |
| 2022 | CVPR | Visual Abductive Reasoning. | Chen Liang, Wenguan Wang, Tianfei Zhou, Yi Yang |
| 2022 | CVPR | Deep Hierarchical Semantic Segmentation. | Liulei Li, Tianfei Zhou, Wenguan Wang, Jianwu Li, Yi Yang |
| 2022 | CVPR | Locality-Aware Inter-and Intra-Video Reconstruction for Self-Supervised Correspondence Learning. | Liulei Li, Tianfei Zhou, Wenguan Wang, Lu Yang, Jianwu Li, Yi Yang |
| 2022 | CVPR | Counterfactual Cycle-Consistent Learning for Instruction Following and Generation in Vision-Language Navigation. | Hanqing Wang, Wei Liang, Jianbing Shen, Luc Van Gool, Wenguan Wang |
| 2022 | CVPR | Rethinking Semantic Segmentation: A Prototype View. | Tianfei Zhou, Wenguan Wang, Ender Konukoglu, Luc Van Gool |
| 2022 | ECCV | Reference-Based Image Super-Resolution with Deformable Attention Transformer. | Jiezhang Cao, Jingyun Liang, Kai Zhang, Yawei Li, Yulun Zhang, Wenguan Wang, Luc Van Gool |
| 2022 | ECCV | Towards Interpretable Video Super-Resolution via Alternating Optimization. | Jiezhang Cao, Jingyun Liang, Kai Zhang, Wenguan Wang, Qin Wang, Yulun Zhang, Hao Tang, Luc Van Gool |
| 2022 | ECCV | Semi-supervised 3D Object Detection with Proficient Teachers. | Junbo Yin, Jin Fang, Dingfu Zhou, Liangjun Zhang, Cheng-Zhong Xu, Jianbing Shen, Wenguan Wang |
| 2022 | ECCV | ProposalContrast: Unsupervised Pre-training for LiDAR-Based 3D Object Detection. | Junbo Yin, Dingfu Zhou, Liangjun Zhang, Jin Fang, Cheng-Zhong Xu, Jianbing Shen, Wenguan Wang |
| 2021 | CVPR | Collaborative Spatial-Temporal Modeling for Language-Queried Video Actor Segmentation. | Tianrui Hui, Shaofei Huang, Si Liu, Zihan Ding, Guanbin Li, Wenguan Wang, Jizhong Han, Fei Wang |
| 2021 | CVPR | Structured Scene Memory for Vision-Language Navigation. | Hanqing Wang, Wenguan Wang, Wei Liang, Caiming Xiong, Jianbing Shen |
| 2021 | CVPR | Differentiable Multi-Granularity Human Representation Learning for Instance-Aware Human Semantic Parsing. | Tianfei Zhou, Wenguan Wang, Si Liu, Yi Yang, Luc Van Gool |
| 2021 | CVPR | Face Forensics in the Wild. | Tianfei Zhou, Wenguan Wang, Zhiyuan Liang, Jianbing Shen |
| 2021 | ICCV | Exploring Cross-Image Pixel Contrast for Semantic Segmentation. | Wenguan Wang, Tianfei Zhou, Fisher Yu, Jifeng Dai, Ender Konukoglu, Luc Van Gool |
| 2020 | CVPR | Learning Video Object Segmentation From Unlabeled Videos. | Xiankai Lu, Wenguan Wang, Jianbing Shen, Yu-Wing Tai, David J. Crandall, Steven C. H. Hoi |
| 2020 | CVPR | Hierarchical Human Parsing With Typed Part-Relation Reasoning. | Wenguan Wang, Hailong Zhu, Jifeng Dai, Yanwei Pang, Jianbing Shen, Ling Shao |
| 2020 | CVPR | A Unified Object Motion and Affinity Model for Online Multi-Object Tracking. | Junbo Yin, Wenguan Wang, Qinghao Meng, Ruigang Yang, Jianbing Shen |
| 2020 | CVPR | Cascaded Human-Object Interaction Recognition. | Tianfei Zhou, Wenguan Wang, Siyuan Qi, Haibin Ling, Jianbing Shen |
| 2020 | ECCV | Video Object Segmentation with Episodic Graph Memory Networks. | Xiankai Lu, Wenguan Wang, Martin Danelljan, Tianfei Zhou, Jianbing Shen, Luc Van Gool |
| 2020 | ECCV | Weakly Supervised 3D Object Detection from Lidar Point Cloud. | Qinghao Meng, Wenguan Wang, Tianfei Zhou, Jianbing Shen, Luc Van Gool, Dengxin Dai |
| 2020 | ECCV | Mining Cross-Image Semantics for Weakly Supervised Semantic Segmentation. | Guolei Sun, Wenguan Wang, Jifeng Dai, Luc Van Gool |
| 2020 | ECCV | Active Visual Information Gathering for Vision-Language Navigation. | Hanqing Wang, Wenguan Wang, Tianmin Shu, Wei Liang, Jianbing Shen |
| 2019 | CoNLL | Improving Neural Machine Translation by Achieving Knowledge Transfer with Sentence Alignment Learning. | Xuewen Shi, Heyan Huang, Wenguan Wang, Ping Jian, Yi-Kun Tang |
| 2019 | CVPR | Shifting More Attention to Video Salient Object Detection. | Deng-Ping Fan, Wenguan Wang, Ming-Ming Cheng, Jianbing Shen |
| 2019 | CVPR | See More, Know More: Unsupervised Video Object Segmentation With Co-Attention Siamese Networks. | Xiankai Lu, Wenguan Wang, Chao Ma, Jianbing Shen, Ling Shao, Fatih Porikli |
| 2019 | CVPR | An Iterative and Cooperative Top-Down and Bottom-Up Inference Network for Salient Object Detection. | Wenguan Wang, Jianbing Shen, Ming-Ming Cheng, Ling Shao |
| 2019 | CVPR | Learning Unsupervised Video Object Segmentation Through Visual Attention. | Wenguan Wang, Hongmei Song, Shuyang Zhao, Jianbing Shen, Sanyuan Zhao, Steven C. H. Hoi, Haibin Ling |
| 2019 | CVPR | Salient Object Detection With Pyramid Attention and Salient Edges. | Wenguan Wang, Shuyang Zhao, Jianbing Shen, Steven C. H. Hoi, Ali Borji |
| 2019 | CVPR | Reasoning Visual Dialogs With Structural and Partial Observations. | Zilong Zheng, Wenguan Wang, Siyuan Qi, Song-Chun Zhu |
| 2019 | ICCV | Understanding Human Gaze Communication by Spatio-Temporal Graph Reasoning. | Lifeng Fan, Wenguan Wang, Song-Chun Zhu, Xinyu Tang, Siyuan Huang |
| 2019 | ICCV | Human-Aware Motion Deblurring. | Ziyi Shen, Wenguan Wang, Xiankai Lu, Jianbing Shen, Haibin Ling, Tingfa Xu, Ling Shao |
| 2019 | ICCV | Zero-Shot Video Object Segmentation via Attentive Graph Neural Networks. | Wenguan Wang, Xiankai Lu, Jianbing Shen, David J. Crandall, Ling Shao |
| 2019 | ICCV | Learning Compositional Neural Information Fusion for Human Parsing. | Wenguan Wang, Zhijie Zhang, Siyuan Qi, Jianbing Shen, Yanwei Pang, Ling Shao |
| 2019 | ICCV | Optimizing the F-Measure for Threshold-Free Salient Object Detection. | Kai Zhao, Shanghua Gao, Wenguan Wang, Ming-Ming Cheng |
| 2018 | AAAI | Learning Pose Grammar to Encode Human Body Configuration for 3D Pose Estimation. | Haoshu Fang, Yuanlu Xu, Wenguan Wang, Xiaobai Liu, Song-Chun Zhu |
| 2018 | AAAI | Examining CNN Representations With Respect to Dataset Bias. | Quanshi Zhang, Wenguan Wang, Song-Chun Zhu |
| 2018 | CVPR | Hyperparameter Optimization for Tracking With Continuous Deep Q-Learning. | Xingping Dong, Jianbing Shen, Wenguan Wang, Yu Liu, Ling Shao, Fatih Porikli |
| 2018 | CVPR | Inferring Shared Attention in Social Scene Videos. | Lifeng Fan, Yixin Chen, Ping Wei, Wenguan Wang, Song-Chun Zhu |
| 2018 | CVPR | Salient Object Detection Driven by Fixation Prediction. | Wenguan Wang, Jianbing Shen, Xingping Dong, Ali Borji |
| 2018 | CVPR | Revisiting Video Saliency: A Large-Scale Benchmark and a New Model. | Wenguan Wang, Jianbing Shen, Fang Guo, Ming-Ming Cheng, Ali Borji |
| 2018 | CVPR | Attentive Fashion Grammar Network for Fashion Landmark Detection and Clothing Category Classification. | Wenguan Wang, Yuanlu Xu, Jianbing Shen, Song-Chun Zhu |
| 2018 | CVPR | Learning Descriptor Networks for 3D Shape Synthesis and Analysis. | Jianwen Xie, Zilong Zheng, Ruiqi Gao, Wenguan Wang, Song-Chun Zhu, Ying Nian Wu |
| 2018 | ECCV | Learning Human-Object Interactions by Graph Parsing Neural Networks. | Siyuan Qi, Wenguan Wang, Baoxiong Jia, Jianbing Shen, Song-Chun Zhu |
| 2018 | ECCV | Pyramid Dilated Deeper ConvLSTM for Video Salient Object Detection. | Hongmei Song, Wenguan Wang, Sanyuan Zhao, Jianbing Shen, Kin-Man Lam |
| 2017 | ICCV | Deep Cropping via Attention Box Prediction and Aesthetics Assessment. | Wenguan Wang, Jianbing Shen |
| 2017 | ICCV | Super-Trajectory for Video Segmentation. | Wenguan Wang, Jianbing Shen, Jianwen Xie, Fatih Porikli |
| 2015 | CVPR | Saliency-aware geodesic video object segmentation. | Wenguan Wang, Jianbing Shen, Fatih Porikli |