| 2026 | AAAI | FreeInpaint: Tuning-free Prompt Alignment and Visual Rationality Enhancement in Image Inpainting. | Chao Gong, Dong Li, Yingwei Pan, Jingjing Chen, Ting Yao, Tao Mei |
| 2026 | FAST | Fast Cloud Storage for AI Jobs via Grouped I/O API with Transparent Read/Write Optimizations. | Yingyi Hao, Ting Yao, Xingda Wei, Dingyan Zhang, Tianle Sun, Yiwen Zhang, Zhiyong Fu, Huatao Wu, Rong Chen |
| 2025 | AAAI | Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion. | Jingyuan Chen, Fuchen Long, Jie An, Zhaofan Qiu, Ting Yao, Jiebo Luo, Tao Mei |
| 2025 | ACL | Bone Soups: A Seek-and-Soup Model Merging Approach for Controllable Multi-Objective Generation. | Guofu Xie, Xiao Zhang, Ting Yao, Yunsheng Shi |
| 2025 | CVPR | Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction. | Dong Li, Wenqi Zhong, Wei Yu, Yingwei Pan, Dingwen Zhang, Ting Yao, Junwei Han, Tao Mei |
| 2025 | CVPR | MotionPro: A Precise Motion Controller for Image-to-Video Generation. | Zhongwei Zhang, Fuchen Long, Zhaofan Qiu, Yingwei Pan, Wu Liu, Ting Yao, Tao Mei |
| 2025 | ICCV | Aligning Global Semantics and Local Textures in Generative Video Enhancement. | Zhikai Chen, Fuchen Long, Zhaofan Qiu, Ting Yao, Wengang Zhou, Jiebo Luo, Tao Mei |
| 2025 | ICCV | Denoising Token Prediction in Masked Autoregressive Models. | Ting Yao, Yehao Li, Yingwei Pan, Zhaofan Qiu, Tao Mei |
| 2025 | ICLR | Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On. | Siqi Wan, Jingwen Chen, Yingwei Pan, Ting Yao, Tao Mei |
| 2025 | ICML | Discriminative Policy Optimization for Token-Level Reward Models. | Hongzhan Chen, Tao Yang, Shiping Gao, Ruijun Chen, Xiaojun Quan, Hongtao Tian, Ting Yao |
| 2025 | ICML | Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots. | Guangting Zheng, Yehao Li, Yingwei Pan, Jiajun Deng, Ting Yao, Yanyong Zhang, Tao Mei |
| 2025 | USENIX | DShuffle: DPU-Optimized Shuffle Framework for Large-scale Data Processing. | Chen Ding, Sicen Li, Kai Lu, Ting Yao, Daohui Wang, Huatao Wu, Jiguang Wan, Zhihu Tan, Changsheng Xie |
| 2024 | ACL | Prompt Refinement with Image Pivot for Text-to-Image Generation. | Jingtao Zhan, Qingyao Ai, Yiqun Liu, Yingwei Pan, Ting Yao, Jiaxin Mao, Shaoping Ma, Tao Mei |
| 2024 | CVPR | Learning Spatial Adaptation and Temporal Coherence in Diffusion Models for Video Super-Resolution. | Zhikai Chen, Fuchen Long, Zhaofan Qiu, Ting Yao, Wengang Zhou, Jiebo Luo, Tao Mei |
| 2024 | CVPR | VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation. | Yang Chen, Yingwei Pan, Haibo Yang, Ting Yao, Tao Mei |
| 2024 | CVPR | Boosting Diffusion Models with Moving Average Sampling in Frequency Domain. | Yurui Qian, Qi Cai, Yingwei Pan, Yehao Li, Ting Yao, Qibin Sun, Tao Mei |
| 2024 | CVPR | TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models. | Zhongwei Zhang, Fuchen Long, Yingwei Pan, Zhaofan Qiu, Ting Yao, Yang Cao, Tao Mei |
| 2024 | CVPR | SD-DiT: Unleashing the Power of Self-Supervised Discrimination in Diffusion Transformer | Rui Zhu, Yingwei Pan, Yehao Li, Ting Yao, Zhenglong Sun, Tao Mei, Chang Wen Chen |
| 2024 | ECCV | Improving Text-Guided Object Inpainting with Semantic Pre-inpainting. | Yifu Chen, Jingwen Chen, Yingwei Pan, Yehao Li, Ting Yao, Zhineng Chen, Tao Mei |
| 2024 | ECCV | VideoStudio: Generating Consistent-Content and Multi-scene Videos. | Fuchen Long, Zhaofan Qiu, Ting Yao, Tao Mei |
| 2024 | ECCV | Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning. | Jianjie Luo, Jingwen Chen, Yehao Li, Yingwei Pan, Jianlin Feng, Hongyang Chao, Ting Yao |
| 2024 | ECCV | Improving Virtual Try-On with Garment-Focused Diffusion Models. | Siqi Wan, Yehao Li, Jingwen Chen, Yingwei Pan, Ting Yao, Yang Cao, Tao Mei |
| 2024 | ECCV | DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation. | Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Zuxuan Wu, Yu-Gang Jiang, Tao Mei |
| 2023 | ACL | Knowledge Transfer in Incremental Learning for Multilingual Neural Machine Translation. | Kaiyu Huang, Peng Li, Jin Ma, Ting Yao, Yang Liu |
| 2023 | CLUSTER | DoW-KV: A DPU-offloaded and Write-optimized Key-Value Store on Disaggregated Persistent Memory. | Yiwen Zhang, Guokuan Li, Jiguang Wan, Junyue Wang, Jun Li, Ting Yao, Huatao Wu, Daohui Wang |
| 2023 | CVPR | Learning to Generate Language-Supervised and Open-Vocabulary Scene Graph Using Pre-Trained Visual-Semantic Space. | Yong Zhang, Yingwei Pan, Ting Yao, Rui Huang, Tao Mei, Chang Wen Chen |
| 2023 | CVPR | AnchorFormer: Point Cloud Completion from Discriminative Nodes. | Zhikai Chen, Fuchen Long, Zhaofan Qiu, Ting Yao, Wengang Zhou, Jiebo Luo, Tao Mei |
| 2023 | CVPR | Learning Orthogonal Prototypes for Generalized Few-Shot Semantic Segmentation. | Sun'ao Liu, Yiheng Zhang, Zhaofan Qiu, Hongtao Xie, Yongdong Zhang, Ting Yao |
| 2023 | CVPR | PointClustering: Unsupervised Point Cloud Pre-training using Transformation Invariance in Clustering. | Fuchen Long, Ting Yao, Zhaofan Qiu, Lusong Li, Tao Mei |
| 2023 | CVPR | Semantic-Conditional Diffusion Networks for Image Captioning. | Jianjie Luo, Yehao Li, Yingwei Pan, Ting Yao, Jianlin Feng, Hongyang Chao, Tao Mei |
| 2023 | CVPR | Modality-Agnostic Debiasing for Single Domain Generalization. | Sanqing Qu, Yingwei Pan, Guang Chen, Ting Yao, Changjun Jiang, Tao Mei |
| 2023 | CVPR | 3D Human Pose Estimation with Spatio-Temporal Criss-Cross Attention. | Zhenhua Tang, Zhaofan Qiu, Yanbin Hao, Richang Hong, Ting Yao |
| 2023 | CVPR | HGNet: Learning Hierarchical Geometry from Points, Edges, and Surfaces. | Ting Yao, Yehao Li, Yingwei Pan, Tao Mei |
| 2023 | CVPR | Transforming Radiance Field with Lipschitz Network for Photorealistic 3D Scene Stylization. | Zicheng Zhang, Yinglu Liu, Congying Han, Yingwei Pan, Tiande Guo, Ting Yao |
| 2023 | ICASSP | Visual-Aware Text-to-Speech | Mohan Zhou, Yalong Bai, Wei Zhang, Ting Yao, Tiejun Zhao, Tao Mei |
| 2023 | ICCV | ObjectFusion: Multi-modal 3D Object Detection with Object-Centric Fusion. | Qi Cai, Yingwei Pan, Ting Yao, Chong-Wah Ngo, Tao Mei |
| 2023 | ICCV | Learning Neural Implicit Surfaces with Object-Aware Radiance Fields. | Yiheng Zhang, Zhaofan Qiu, Yingwei Pan, Ting Yao, Tao Mei |
| 2023 | ICDE | EEPH: An Efficient Extendible Perfect Hashing for Hybrid PMem-DRAM. | Qi Chen, Hao Hu, Cai Deng, Dingbang Liu, Shiyi Li, Bo Tang, Ting Yao, Wen Xia |
| 2023 | SIGIR | T2Ranking: A Large-scale Chinese Benchmark for Passage Ranking. | Xiaohui Xie, Qian Dong, Bingning Wang, Feiyang Lv, Ting Yao, Weinan Gan, Zhijing Wu, Xiangsheng Li, Haitao Li, Yiqun Liu, Jin Ma |
| 2022 | CIKM | ChiQA: A Large Scale Image-based Real-World Question Answering Dataset for Multi-Modal Understanding. | Bingning Wang, Feiyang Lv, Ting Yao, Jin Ma, Yu Luo, Haijin Liang |
| 2022 | COLING | DPTDR: Deep Prompt Tuning for Dense Passage Retrieval. | Zhengyang Tang, Benyou Wang, Ting Yao |
| 2022 | CVPR | Comprehending and Ordering Semantics for Image Captioning. | Yehao Li, Yingwei Pan, Ting Yao, Tao Mei |
| 2022 | CVPR | Stand-Alone Inter-Frame Attention in Video Models. | Fuchen Long, Zhaofan Qiu, Yingwei Pan, Ting Yao, Jiebo Luo, Tao Mei |
| 2022 | CVPR | MLP-3D: A MLP-like 3D Architecture with Grouped Time Mixing. | Zhaofan Qiu, Ting Yao, Chong-Wah Ngo, Tao Mei |
| 2022 | CVPR | Exploring Structure-aware Transformer over Interaction Proposals for Human-Object Interaction Detection. | Yong Zhang, Yingwei Pan, Ting Yao, Rui Huang, Tao Mei, Chang Wen Chen |
| 2022 | ECCV | Dynamic Temporal Filtering in Video Models. | Fuchen Long, Zhaofan Qiu, Yingwei Pan, Ting Yao, Chong-Wah Ngo, Tao Mei |
| 2022 | ECCV | SPE-Net: Boosting Point Cloud Analysis via Rotation Robustness Enhancement. | Zhaofan Qiu, Yehao Li, Yu Wang, Yingwei Pan, Ting Yao, Tao Mei |
| 2022 | ECCV | Wave-ViT: Unifying Wavelet and Transformers for Visual Representation Learning. | Ting Yao, Yingwei Pan, Yehao Li, Chong-Wah Ngo, Tao Mei |
| 2022 | ECCV | Responsive Listening Head Generation: A Benchmark Dataset and Baseline. | Mohan Zhou, Yalong Bai, Wei Zhang, Ting Yao, Tiejun Zhao, Tao Mei |
| 2021 | AAAI | Scheduled Sampling in Vision-Language Pretraining with Decoupled Encoder-Decoder Network. | Yehao Li, Yingwei Pan, Ting Yao, Jingwen Chen, Tao Mei |
| 2021 | AAAI | SeCo: Exploring Sequence Supervision for Unsupervised Representation Learning. | Ting Yao, Yiheng Zhang, Zhaofan Qiu, Yingwei Pan, Tao Mei |
| 2021 | ACL | Multi-Lingual Question Generation with Language Agnostic Language Model. | Bingning Wang, Ting Yao, Weipeng Chen, Jingfang Xu, Xiaochuan Wang |
| 2021 | CIKM | Cycle or Minkowski: Which is More Appropriate for Knowledge Graph Embedding? | Han Yang, Leilei Zhang, Bingning Wang, Ting Yao, Junfei Liu |
| 2021 | CVPR | Representing Videos As Discriminative Sub-Graphs for Action Recognition. | Dong Li, Zhaofan Qiu, Yingwei Pan, Ting Yao, Houqiang Li, Tao Mei |
| 2021 | CVPR | Boosting Video Representation Learning With Multi-Faceted Integration. | Zhaofan Qiu, Ting Yao, Chong-Wah Ngo, Xiao-Ping Zhang, Dong Wu, Tao Mei |
| 2021 | ICCV | A Style and Semantic Memory Mechanism for Domain Generalization | Yang Chen, Yu Wang, Yingwei Pan, Ting Yao, Xinmei Tian, Tao Mei |
| 2021 | ICCV | Motion-Focused Contrastive Learning of Video Representations | Rui Li, Yiheng Zhang, Zhaofan Qiu, Ting Yao, Dong Liu, Tao Mei |
| 2021 | ICCV | Condensing a Sequence to One Informative Frame for Video Recognition. | Zhaofan Qiu, Ting Yao, Yan Shu, Chong-Wah Ngo, Tao Mei |
| 2021 | ICML | Optimization Planning for 3D ConvNets. | Zhaofan Qiu, Ting Yao, Chong-Wah Ngo, Tao Mei |
| 2021 | WWW | ComQA: Compositional Question Answering via Hierarchical Graph Neural Networks. | Bingning Wang, Ting Yao, Weipeng Chen, Jingfang Xu, Xiaochuan Wang |
| 2020 | AAAI | ReCO: A Large Scale Chinese Reading Comprehension Dataset on Opinion. | Bingning Wang, Ting Yao, Qi Zhang, Jingfang Xu, Xiaochuan Wang |
| 2020 | ACL | A Self-Training Method for Machine Reading Comprehension with Soft Evidence Extraction. | Yilin Niu, Fangkai Jiao, Mantong Zhou, Ting Yao, Jingfang Xu, Minlie Huang |
| 2020 | CVPR | Learning a Unified Sample Weighting Network for Object Detection. | Qi Cai, Yingwei Pan, Yu Wang, Jingen Liu, Ting Yao, Tao Mei |
| 2020 | CVPR | X-Linear Attention Networks for Image Captioning. | Yingwei Pan, Ting Yao, Yehao Li, Tao Mei |
| 2020 | CVPR | Exploring Category-Agnostic Clusters for Open-Set Domain Adaptation. | Yingwei Pan, Ting Yao, Yehao Li, Chong-Wah Ngo, Tao Mei |
| 2020 | CVPR | Transferring and Regularizing Prediction for Semantic Segmentation. | Yiheng Zhang, Zhaofan Qiu, Ting Yao, Chong-Wah Ngo, Dong Liu, Tao Mei |
| 2020 | ECCV | Learning to Localize Actions from Moments. | Fuchen Long, Ting Yao, Zhaofan Qiu, Xinmei Tian, Jiebo Luo, Tao Mei |
| 2020 | USENIX | MatrixKV: Reducing Write Stalls and Write Amplification in LSM-tree Based KV Stores with Matrix Container in NVM. | Ting Yao, Yiwen Zhang, Jiguang Wan, Qiu Cui, Liu Tang, Hong Jiang, Changsheng Xie, Xubin He |
| 2019 | AAAI | Temporal Deformable Convolutional Encoder-Decoder Networks for Video Captioning. | Jingwen Chen, Yingwei Pan, Yehao Li, Ting Yao, Hongyang Chao, Tao Mei |
| 2019 | CVPR | Exploring Object Relation in Mean Teacher for Cross-Domain Detection. | Qi Cai, Yingwei Pan, Chong-Wah Ngo, Xinmei Tian, Lingyu Duan, Ting Yao |
| 2019 | CVPR | Pointing Novel Objects in Image Captioning. | Yehao Li, Ting Yao, Yingwei Pan, Hongyang Chao, Tao Mei |
| 2019 | CVPR | Gaussian Temporal Awareness Networks for Action Localization. | Fuchen Long, Ting Yao, Zhaofan Qiu, Xinmei Tian, Jiebo Luo, Tao Mei |
| 2019 | CVPR | Transferrable Prototypical Networks for Unsupervised Domain Adaptation. | Yingwei Pan, Ting Yao, Yehao Li, Yu Wang, Chong-Wah Ngo, Tao Mei |
| 2019 | CVPR | Learning Spatio-Temporal Representation With Local and Global Diffusion. | Zhaofan Qiu, Ting Yao, Chong-Wah Ngo, Xinmei Tian, Tao Mei |
| 2019 | CVPR | Customizable Architecture Search for Semantic Segmentation. | Yiheng Zhang, Zhaofan Qiu, Jingen Liu, Ting Yao, Dong Liu, Tao Mei |
| 2019 | FAST | GearDB: A GC-free Key-Value Store on HM-SMR Drives with Gear Compaction. | Ting Yao, Jiguang Wan, Ping Huang, Yiwen Zhang, Zhiwen Liu, Changsheng Xie, Xubin He |
| 2019 | ICCV | Relation Distillation Networks for Video Object Detection. | Jiajun Deng, Yingwei Pan, Ting Yao, Wengang Zhou, Houqiang Li, Tao Mei |
| 2019 | ICCV | Hierarchy Parsing for Image Captioning. | Ting Yao, Yingwei Pan, Yehao Li, Tao Mei |
| 2019 | IJCAI | Deep Learning for Video Captioning: A Review. | Shaoxiang Chen, Ting Yao, Yu-Gang Jiang |
| 2019 | IJCAI | Convolutional Auto-encoding of Sentence Topics for Image Paragraph Generation. | Jing Wang, Yingwei Pan, Ting Yao, Jinhui Tang, Tao Mei |
| 2019 | ICTIR | Unsupervised Story Comprehension with Hierarchical Encoder-Decoder. | Bingning Wang, Ting Yao, Qi Zhang, Jingfang Xu, Kang Liu, Zhixing Tian, Jun Zhao |
| 2019 | SIGIR | Document Gated Reader for Open-Domain Question Answering. | Bingning Wang, Ting Yao, Qi Zhang, Jingfang Xu, Zhixing Tian, Kang Liu, Jun Zhao |
| 2018 | CVPR | Memory Matching Networks for One-Shot Image Recognition. | Qi Cai, Yingwei Pan, Ting Yao, Chenggang Yan, Tao Mei |
| 2018 | CVPR | Jointly Localizing and Describing Events for Dense Video Captioning. | Yehao Li, Ting Yao, Yingwei Pan, Hongyang Chao, Tao Mei |
| 2018 | CVPR | Fully Convolutional Adaptation Networks for Semantic Segmentation. | Yiheng Zhang, Zhaofan Qiu, Ting Yao, Dong Liu, Tao Mei |
| 2018 | ECCV | Recurrent Tubelet Proposal and Recognition Networks for Action Detection. | Dong Li, Zhaofan Qiu, Qi Dai, Ting Yao, Tao Mei |
| 2018 | ECCV | Exploring Visual Relationship for Image Captioning. | Ting Yao, Yingwei Pan, Yehao Li, Tao Mei |
| 2018 | SIGIR | Deep Domain Adaptation Hashing with Adversarial Learning. | Fuchen Long, Ting Yao, Qi Dai, Xinmei Tian, Jiebo Luo, Tao Mei |
| 2017 | CVPR | Video Captioning with Transferred Semantic Attributes. | Yingwei Pan, Ting Yao, Houqiang Li, Tao Mei |
| 2017 | CVPR | Deep Quantization: Encoding Convolutional Activations with Deep Generative Model. | Zhaofan Qiu, Ting Yao, Tao Mei |
| 2017 | CVPR | Incorporating Copying Mechanism in Image Captioning for Learning Novel Objects. | Ting Yao, Yingwei Pan, Yehao Li, Tao Mei |
| 2017 | ICCV | Learning Spatio-Temporal Representation with Pseudo-3D Residual Networks. | Zhaofan Qiu, Ting Yao, Tao Mei |
| 2017 | ICCV | Boosting Image Captioning with Attributes. | Ting Yao, Yingwei Pan, Yehao Li, Zhaofan Qiu, Tao Mei |
| 2017 | SIGIR | Seeing Bot. | Yingwei Pan, Zhaofan Qiu, Ting Yao, Houqiang Li, Tao Mei |
| 2017 | SIGIR | Deep Semantic Hashing with Generative Adversarial Networks. | Zhaofan Qiu, Yingwei Pan, Ting Yao, Tao Mei |
| 2016 | CVPR | You Lead, We Exceed: Labor-Free Video Concept Learning by Jointly Exploiting Web Videos and Images. | Chuang Gan, Ting Yao, Kuiyuan Yang, Yi Yang, Tao Mei |
| 2016 | CVPR | Jointly Modeling Embedding and Translation to Bridge Video and Language. | Yingwei Pan, Tao Mei, Ting Yao, Houqiang Li, Yong Rui |
| 2016 | CVPR | MSR-VTT: A Large Video Description Dataset for Bridging Video and Language. | Jun Xu, Tao Mei, Ting Yao, Yong Rui |
| 2016 | CVPR | Highlight Detection with Pairwise Deep Ranking for First-Person Video Summarization. | Ting Yao, Tao Mei, Yong Rui |
| 2016 | IJCAI | Learning Deep Intrinsic Video Representation by Exploring Temporal Coherence and Graph Structure. | Yingwei Pan, Yehao Li, Ting Yao, Tao Mei, Houqiang Li, Yong Rui |
| 2016 | IJCAI | Deep Semantic-Preserving and Ranking-Based Hashing for Image Retrieval. | Ting Yao, Fuchen Long, Tao Mei, Yong Rui |
| 2015 | CVPR | Semi-supervised Domain Adaptation with Subspace Learning for visual recognition. | Ting Yao, Yingwei Pan, Chong-Wah Ngo, Houqiang Li, Tao Mei |
| 2015 | ICCV | Learning Query and Image Similarities with Ranking Canonical Correlation Analysis. | Ting Yao, Tao Mei, Chong-Wah Ngo |
| 2015 | SIGIR | Semi-supervised Hashing with Semantic Confidence for Large Scale Visual Search. | Yingwei Pan, Ting Yao, Houqiang Li, Chong-Wah Ngo, Tao Mei |
| 2014 | MMSys | ROI-based Video Quality Assessment and Regulation for Mobile Videoconferencing. | Hailiang Yu, Ting Yao, Wenjun Wu, Yihua Lou |
| 2014 | SIGIR | Click-through-based cross-view learning for image search. | Yingwei Pan, Ting Yao, Tao Mei, Houqiang Li, Chong-Wah Ngo, Yong Rui |
| 2013 | MMSys | A novel scheme of ROI detection and transcoding for mobile devices in high-definition videoconferencing. | Yihua Lou, Ting Yao, Yongquan Chen, Wenjun Wu |
| 2013 | WWW | Unified entity search in social media community. | Ting Yao, Yuan Liu, Chong-Wah Ngo, Tao Mei |
| 2012 | WWW | Incorporating seasonal time series analysis with search behavior information in sales forecasting. | Yuchen Tian, Yiqun Liu, Danqing Xu, Ting Yao, Min Zhang, Shaoping Ma |