| 2026 | WACV | LooC: Effective Low-Dimensional Codebook for Compositional Vector Quantization. | Jie Li, Kwan-Yee K. Wong, Kai Han |
| 2025 | AAAI | Affordances-Oriented Planning Using Foundation Models for Continuous Vision-Language Navigation. | Jiaqi Chen, Bingqian Lin, Xinmin Liu, Lin Ma, Xiaodan Liang, Kwan-Yee K. Wong |
| 2025 | CVPR | DriveGPT4-V2: Harnessing Large Language Model Capabilities for Enhanced Closed-Loop Autonomous Driving. | Zhenhua Xu, Yan Bai, Yujia Zhang, Zhuoling Li, Fei Xia, Kwan-Yee K. Wong, Jianqiang Wang, Hengshuang Zhao |
| 2025 | CVPR | ArtiFade: Learning to Generate High-quality Subject from Blemished Images. | Shuya Yang, Shaozhe Hao, Yukang Cao, Kwan-Yee K. Wong |
| 2025 | ICCV | Rethinking Cross-Modal Interaction in Multimodal Diffusion Transformers. | Zhengyao Lv, Tianlin Pan, Chenyang Si, Zhaoxi Chen, Wangmeng Zuo, Ziwei Liu, Kwan-Yee K. Wong |
| 2025 | ICCV | Dual-Expert Consistency Model for Efficient and High-Quality Video Generation. | Zhengyao Lv, Chenyang Si, Tianlin Pan, Zhaoxi Chen, Kwan-Yee K. Wong, Yu Qiao, Ziwei Liu |
| 2025 | ICLR | AvatarGO: Zero-shot 4D Human-Object Interaction Generation and Animation. | Yukang Cao, Liang Pan, Kai Han, Kwan-Yee K. Wong, Ziwei Liu |
| 2025 | ICLR | BiGR: Harnessing Binary Latent Codes for Image Generation and Improved Visual Representation Capabilities. | Shaozhe Hao, Xuantong Liu, Xianbiao Qi, Shihao Zhao, Bojia Zi, Rong Xiao, Kai Han, Kwan-Yee K. Wong |
| 2025 | ICLR | FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality. | Zhengyao Lv, Chenyang Si, Junhao Song, Zhenyu Yang, Yu Qiao, Ziwei Liu, Kwan-Yee K. Wong |
| 2025 | WACV | VipDiff: Towards Coherent and Diverse Video Inpainting via Training-Free Denoising Diffusion Models. | Chaohao Xie, Kai Han, Kwan-Yee K. Wong |
| 2024 | CVPR | DreamAvatar: Text-and-Shape Guided 3D Human Avatar Generation via Diffusion Models. | Yukang Cao, Yan-Pei Cao, Kai Han, Ying Shan, Kwan-Yee K. Wong |
| 2024 | CVPR | PLACE: Adaptive Layout-Semantic Fusion for Semantic Image Synthesis. | Zhengyao Lv, Yuxiang Wei, Wangmeng Zuo, Kwan-Yee K. Wong |
| 2024 | ECCV | ConceptExpress: Harnessing Diffusion Models for Single-Image Unsupervised Concept Extraction. | Shaozhe Hao, Kai Han, Zhengyao Lv, Shihao Zhao, Kwan-Yee K. Wong |
| 2024 | ECCV | InsMapper: Exploring Inner-Instance Information for Vectorized HD Mapping. | Zhenhua Xu, Kwan-Yee K. Wong, Hengshuang Zhao |
| 2024 | ECCV | Bridging Different Language Models and Generative Vision Models for Text-to-Image Generation. | Shihao Zhao, Shaozhe Hao, Bojia Zi, Huaizhe Xu, Kwan-Yee K. Wong |
| 2023 | CVPR | SeSDF: Self-Evolved Signed Distance Field for Implicit 3D Clothed Human Reconstruction. | Yukang Cao, Kai Han, Kwan-Yee K. Wong |
| 2023 | CVPR | Learning Attention as Disentangler for Compositional Zero-Shot Learning. | Shaozhe Hao, Kai Han, Kwan-Yee K. Wong |
| 2023 | ICCV | RIGID: Recurrent GAN Inversion and Editing of Real Face Videos. | Yangyang Xu, Shengfeng He, Kwan-Yee K. Wong, Ping Luo |
| 2022 | CVPR | JIFF: Jointly-aligned Implicit Face Function for High Quality Single View Clothed Human Reconstruction. | Yukang Cao, Guanying Chen, Kai Han, Wenqi Yang, Kwan-Yee K. Wong |
| 2022 | CVPR | Blind Image Super-resolution with Elaborate Degradation Modeling on Noise and Kernel. | Zongsheng Yue, Qian Zhao, Jianwen Xie, Lei Zhang, Deyu Meng, Kwan-Yee K. Wong |
| 2022 | ECCV | PS-NeRF: Neural Inverse Rendering for Multi-view Photometric Stereo. | Wenqi Yang, Guanying Chen, Chaofeng Chen, Zhenfang Chen, Kwan-Yee K. Wong |
| 2022 | ICIP | A Unified Framework for Masked and Mask-Free Face Recognition Via Feature Rectification. | Shaozhe Hao, Chaofeng Chen, Zhenfang Chen, Kwan-Yee K. Wong |
| 2021 | CVPR | Progressive Semantic-Aware Style Transformation for Blind Face Restoration. | Chaofeng Chen, Xiaoming Li, Lingbo Yang, Xianhui Lin, Lei Zhang, Kwan-Yee K. Wong |
| 2021 | ICCV | HDR Video Reconstruction: A Coarse-to-fine Network and A Real-world Benchmark Dataset. | Guanying Chen, Chaofeng Chen, Shi Guo, Zhetong Liang, Kwan-Yee K. Wong, Lei Zhang |
| 2020 | CVPR | Cops-Ref: A New Dataset and Task on Compositional Referring Expression Comprehension. | Zhenfang Chen, Peng Wang, Lin Ma, Kwan-Yee K. Wong, Qi Wu |
| 2020 | ECCV | What Is Learned in Deep Uncalibrated Photometric Stereo? | Guanying Chen, Michael Waechter, Boxin Shi, Kwan-Yee K. Wong, Yasuyuki Matsushita |
| 2019 | CVPR | Self-Calibrating Deep Photometric Stereo Networks. | Guanying Chen, Kai Han, Boxin Shi, Yasuyuki Matsushita, Kwan-Yee K. Wong |
| 2018 | AAAI | Char-Net: A Character-Aware Neural Network for Distorted Scene Text Recognition. | Wei Liu, Chaofeng Chen, Kwan-Yee K. Wong |
| 2018 | ACCV | Semi-supervised Learning for Face Sketch Synthesis in the Wild. | Chaofeng Chen, Wei Liu, Xiao Tan, Kwan-Yee K. Wong |
| 2018 | ACCV | SAFE: Scale Aware Feature Encoder for Scene Text Recognition. | Wei Liu, Chaofeng Chen, Kwan-Yee K. Wong |
| 2018 | CVPR | TOM-Net: Learning Transparent Object Matting From a Single Image. | Guanying Chen, Kai Han, Kwan-Yee K. Wong |
| 2018 | ECCV | PS-FCN: A Flexible Learning Framework for Photometric Stereo. | Guanying Chen, Kai Han, Kwan-Yee K. Wong |
| 2018 | WACV | Face Sketch Synthesis with Style Transfer Using Pyramid Column Feature. | Chaofeng Chen, Xiao Tan, Kwan-Yee K. Wong |
| 2017 | ICCV | SCNet: Learning Semantic Correspondence. | Kai Han, Rafael S. Rezende, Bumsub Ham, Kwan-Yee K. Wong, Minsu Cho, Cordelia Schmid, Jean Ponce |
| 2016 | BMVC | STAR-Net: A SpaTial Attention Residue Network for Scene Text Recognition. | Wei Liu, Chaofeng Chen, Kwan-Yee K. Wong, Zhizhong Su, Junyu Han |
| 2016 | CVPR | Mirror Surface Reconstruction under an Uncalibrated Camera. | Kai Han, Kwan-Yee K. Wong, Dirk Schnieders, Miaomiao Liu |
| 2016 | WACV | A two-stage detector for hand detection in ego-centric videos. | Xiaolong Zhu, Wei Liu, Xuhui Jia, Kwan-Yee K. Wong |