| 2026 | AAAI | FreeInpaint: Tuning-free Prompt Alignment and Visual Rationality Enhancement in Image Inpainting. | Chao Gong, Dong Li, Yingwei Pan, Jingjing Chen, Ting Yao, Tao Mei |
| 2025 | CVPR | Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction. | Dong Li, Wenqi Zhong, Wei Yu, Yingwei Pan, Dingwen Zhang, Ting Yao, Junwei Han, Tao Mei |
| 2025 | CVPR | MotionPro: A Precise Motion Controller for Image-to-Video Generation. | Zhongwei Zhang, Fuchen Long, Zhaofan Qiu, Yingwei Pan, Wu Liu, Ting Yao, Tao Mei |
| 2025 | ICCV | Denoising Token Prediction in Masked Autoregressive Models. | Ting Yao, Yehao Li, Yingwei Pan, Zhaofan Qiu, Tao Mei |
| 2025 | ICLR | Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On. | Siqi Wan, Jingwen Chen, Yingwei Pan, Ting Yao, Tao Mei |
| 2025 | ICML | Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots. | Guangting Zheng, Yehao Li, Yingwei Pan, Jiajun Deng, Ting Yao, Yanyong Zhang, Tao Mei |
| 2024 | ACL | Prompt Refinement with Image Pivot for Text-to-Image Generation. | Jingtao Zhan, Qingyao Ai, Yiqun Liu, Yingwei Pan, Ting Yao, Jiaxin Mao, Shaoping Ma, Tao Mei |
| 2024 | CVPR | VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation. | Yang Chen, Yingwei Pan, Haibo Yang, Ting Yao, Tao Mei |
| 2024 | CVPR | Boosting Diffusion Models with Moving Average Sampling in Frequency Domain. | Yurui Qian, Qi Cai, Yingwei Pan, Yehao Li, Ting Yao, Qibin Sun, Tao Mei |
| 2024 | CVPR | TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models. | Zhongwei Zhang, Fuchen Long, Yingwei Pan, Zhaofan Qiu, Ting Yao, Yang Cao, Tao Mei |
| 2024 | CVPR | SD-DiT: Unleashing the Power of Self-Supervised Discrimination in Diffusion Transformer | Rui Zhu, Yingwei Pan, Yehao Li, Ting Yao, Zhenglong Sun, Tao Mei, Chang Wen Chen |
| 2024 | ECCV | Improving Text-Guided Object Inpainting with Semantic Pre-inpainting. | Yifu Chen, Jingwen Chen, Yingwei Pan, Yehao Li, Ting Yao, Zhineng Chen, Tao Mei |
| 2024 | ECCV | Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning. | Jianjie Luo, Jingwen Chen, Yehao Li, Yingwei Pan, Jianlin Feng, Hongyang Chao, Ting Yao |
| 2024 | ECCV | Improving Virtual Try-On with Garment-Focused Diffusion Models. | Siqi Wan, Yehao Li, Jingwen Chen, Yingwei Pan, Ting Yao, Yang Cao, Tao Mei |
| 2024 | ECCV | DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation. | Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Zuxuan Wu, Yu-Gang Jiang, Tao Mei |
| 2023 | CVPR | Learning to Generate Language-Supervised and Open-Vocabulary Scene Graph Using Pre-Trained Visual-Semantic Space. | Yong Zhang, Yingwei Pan, Ting Yao, Rui Huang, Tao Mei, Chang Wen Chen |
| 2023 | CVPR | Semantic-Conditional Diffusion Networks for Image Captioning. | Jianjie Luo, Yehao Li, Yingwei Pan, Ting Yao, Jianlin Feng, Hongyang Chao, Tao Mei |
| 2023 | CVPR | Modality-Agnostic Debiasing for Single Domain Generalization. | Sanqing Qu, Yingwei Pan, Guang Chen, Ting Yao, Changjun Jiang, Tao Mei |
| 2023 | CVPR | HGNet: Learning Hierarchical Geometry from Points, Edges, and Surfaces. | Ting Yao, Yehao Li, Yingwei Pan, Tao Mei |
| 2023 | CVPR | Transforming Radiance Field with Lipschitz Network for Photorealistic 3D Scene Stylization. | Zicheng Zhang, Yinglu Liu, Congying Han, Yingwei Pan, Tiande Guo, Ting Yao |
| 2023 | ICCV | ObjectFusion: Multi-modal 3D Object Detection with Object-Centric Fusion. | Qi Cai, Yingwei Pan, Ting Yao, Chong-Wah Ngo, Tao Mei |
| 2023 | ICCV | Learning Neural Implicit Surfaces with Object-Aware Radiance Fields. | Yiheng Zhang, Zhaofan Qiu, Yingwei Pan, Ting Yao, Tao Mei |
| 2022 | CVPR | Comprehending and Ordering Semantics for Image Captioning. | Yehao Li, Yingwei Pan, Ting Yao, Tao Mei |
| 2022 | CVPR | Stand-Alone Inter-Frame Attention in Video Models. | Fuchen Long, Zhaofan Qiu, Yingwei Pan, Ting Yao, Jiebo Luo, Tao Mei |
| 2022 | CVPR | Exploring Structure-aware Transformer over Interaction Proposals for Human-Object Interaction Detection. | Yong Zhang, Yingwei Pan, Ting Yao, Rui Huang, Tao Mei, Chang Wen Chen |
| 2022 | ECCV | Dynamic Temporal Filtering in Video Models. | Fuchen Long, Zhaofan Qiu, Yingwei Pan, Ting Yao, Chong-Wah Ngo, Tao Mei |
| 2022 | ECCV | SPE-Net: Boosting Point Cloud Analysis via Rotation Robustness Enhancement. | Zhaofan Qiu, Yehao Li, Yu Wang, Yingwei Pan, Ting Yao, Tao Mei |
| 2022 | ECCV | Wave-ViT: Unifying Wavelet and Transformers for Visual Representation Learning. | Ting Yao, Yingwei Pan, Yehao Li, Chong-Wah Ngo, Tao Mei |
| 2021 | AAAI | Scheduled Sampling in Vision-Language Pretraining with Decoupled Encoder-Decoder Network. | Yehao Li, Yingwei Pan, Ting Yao, Jingwen Chen, Tao Mei |
| 2021 | AAAI | SeCo: Exploring Sequence Supervision for Unsupervised Representation Learning. | Ting Yao, Yiheng Zhang, Zhaofan Qiu, Yingwei Pan, Tao Mei |
| 2021 | CVPR | Representing Videos As Discriminative Sub-Graphs for Action Recognition. | Dong Li, Zhaofan Qiu, Yingwei Pan, Ting Yao, Houqiang Li, Tao Mei |
| 2021 | ICCV | A Style and Semantic Memory Mechanism for Domain Generalization | Yang Chen, Yu Wang, Yingwei Pan, Ting Yao, Xinmei Tian, Tao Mei |
| 2020 | CVPR | Learning a Unified Sample Weighting Network for Object Detection. | Qi Cai, Yingwei Pan, Yu Wang, Jingen Liu, Ting Yao, Tao Mei |
| 2020 | CVPR | X-Linear Attention Networks for Image Captioning. | Yingwei Pan, Ting Yao, Yehao Li, Tao Mei |
| 2020 | CVPR | Exploring Category-Agnostic Clusters for Open-Set Domain Adaptation. | Yingwei Pan, Ting Yao, Yehao Li, Chong-Wah Ngo, Tao Mei |
| 2019 | AAAI | Temporal Deformable Convolutional Encoder-Decoder Networks for Video Captioning. | Jingwen Chen, Yingwei Pan, Yehao Li, Ting Yao, Hongyang Chao, Tao Mei |
| 2019 | CVPR | Exploring Object Relation in Mean Teacher for Cross-Domain Detection. | Qi Cai, Yingwei Pan, Chong-Wah Ngo, Xinmei Tian, Lingyu Duan, Ting Yao |
| 2019 | CVPR | Pointing Novel Objects in Image Captioning. | Yehao Li, Ting Yao, Yingwei Pan, Hongyang Chao, Tao Mei |
| 2019 | CVPR | Transferrable Prototypical Networks for Unsupervised Domain Adaptation. | Yingwei Pan, Ting Yao, Yehao Li, Yu Wang, Chong-Wah Ngo, Tao Mei |
| 2019 | ICCV | Relation Distillation Networks for Video Object Detection. | Jiajun Deng, Yingwei Pan, Ting Yao, Wengang Zhou, Houqiang Li, Tao Mei |
| 2019 | ICCV | Hierarchy Parsing for Image Captioning. | Ting Yao, Yingwei Pan, Yehao Li, Tao Mei |
| 2019 | IJCAI | Convolutional Auto-encoding of Sentence Topics for Image Paragraph Generation. | Jing Wang, Yingwei Pan, Ting Yao, Jinhui Tang, Tao Mei |
| 2018 | CVPR | Memory Matching Networks for One-Shot Image Recognition. | Qi Cai, Yingwei Pan, Ting Yao, Chenggang Yan, Tao Mei |
| 2018 | CVPR | Jointly Localizing and Describing Events for Dense Video Captioning. | Yehao Li, Ting Yao, Yingwei Pan, Hongyang Chao, Tao Mei |
| 2018 | ECCV | Exploring Visual Relationship for Image Captioning. | Ting Yao, Yingwei Pan, Yehao Li, Tao Mei |
| 2017 | CVPR | Video Captioning with Transferred Semantic Attributes. | Yingwei Pan, Ting Yao, Houqiang Li, Tao Mei |
| 2017 | CVPR | Incorporating Copying Mechanism in Image Captioning for Learning Novel Objects. | Ting Yao, Yingwei Pan, Yehao Li, Tao Mei |
| 2017 | ICCV | Boosting Image Captioning with Attributes. | Ting Yao, Yingwei Pan, Yehao Li, Zhaofan Qiu, Tao Mei |
| 2017 | SIGIR | Seeing Bot. | Yingwei Pan, Zhaofan Qiu, Ting Yao, Houqiang Li, Tao Mei |
| 2017 | SIGIR | Deep Semantic Hashing with Generative Adversarial Networks. | Zhaofan Qiu, Yingwei Pan, Ting Yao, Tao Mei |
| 2016 | CVPR | Jointly Modeling Embedding and Translation to Bridge Video and Language. | Yingwei Pan, Tao Mei, Ting Yao, Houqiang Li, Yong Rui |
| 2016 | IJCAI | Learning Deep Intrinsic Video Representation by Exploring Temporal Coherence and Graph Structure. | Yingwei Pan, Yehao Li, Ting Yao, Tao Mei, Houqiang Li, Yong Rui |
| 2015 | CVPR | Semi-supervised Domain Adaptation with Subspace Learning for visual recognition. | Ting Yao, Yingwei Pan, Chong-Wah Ngo, Houqiang Li, Tao Mei |
| 2015 | SIGIR | Semi-supervised Hashing with Semantic Confidence for Large Scale Visual Search. | Yingwei Pan, Ting Yao, Houqiang Li, Chong-Wah Ngo, Tao Mei |
| 2014 | SIGIR | Click-through-based cross-view learning for image search. | Yingwei Pan, Ting Yao, Tao Mei, Houqiang Li, Chong-Wah Ngo, Yong Rui |