| 2025 | AAAI | ContextHOI: Spatial Context Learning for Human-Object Interaction Detection. | Mingda Jia, Liming Zhao, Ge Li, Yun Zheng |
| 2025 | AAAI | Orchestrating the Symphony of Prompt Distribution Learning for Human-Object Interaction Detection. | Mingda Jia, Liming Zhao, Ge Li, Yun Zheng |
| 2025 | CVPR | Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models. | Zhihang Liu, Chen-Wei Xie, Pandeng Li, Liming Zhao, Longxiang Tang, Yun Zheng, Chuanbin Liu, Hongtao Xie |
| 2025 | ICCV | DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding. | Xiaoyi Bao, Chenwei Xie, Hao Tang, Tingyu Weng, Xiaofeng Wang, Yun Zheng, Xingang Wang |
| 2025 | ICLR | Aligned Better, Listen Better for Audio-Visual Large Language Models. | Yuxin Guo, Shuailei Ma, Shijie Ma, Xiaoyi Bao, Chen-Wei Xie, Kecheng Zheng, Tingyu Weng, Siyang Sun, Yun Zheng, Wei Zou |
| 2024 | AAAI | Relevant Intrinsic Feature Enhancement Network for Few-Shot Semantic Segmentation. | Xiaoyi Bao, Jie Qin, Siyang Sun, Xingang Wang, Yun Zheng |
| 2024 | CVPR | CrossMAE: Cross-Modality Masked Autoencoders for Region-Aware Audio-Visual Pre-Training. | Yuxin Guo, Siyang Sun, Shuailei Ma, Kecheng Zheng, Xiaoyi Bao, Shijie Ma, Wei Zou, Yun Zheng |
| 2024 | ECCV | CoReS: Orchestrating the Dance of Reasoning and Segmentation. | Xiaoyi Bao, Siyang Sun, Shuailei Ma, Kecheng Zheng, Yuxin Guo, Guosheng Zhao, Yun Zheng, Xingang Wang |
| 2024 | ECCV | FuseTeacher: Modality-Fused Encoders are Strong Vision Supervisors. | Chen-Wei Xie, Siyang Sun, Liming Zhao, Pandeng Li, Shuailei Ma, Yun Zheng |
| 2023 | CVPR | RA-CLIP: Retrieval Augmented Contrastive Language-Image Pre-Training. | Chen-Wei Xie, Siyang Sun, Xiong Xiong, Yun Zheng, Deli Zhao, Jingren Zhou |
| 2023 | ICCV | Progressive Spatio-Temporal Prototype Matching for Text-Video Retrieval. | Pandeng Li, Chen-Wei Xie, Liming Zhao, Hongtao Xie, Jiannan Ge, Yun Zheng, Deli Zhao, Yongdong Zhang |
| 2023 | ICML | RLEG: Vision-Language Representation Learning with Diffusion-based Embedding Generation. | Liming Zhao, Kecheng Zheng, Yun Zheng, Deli Zhao, Jingren Zhou |
| 2023 | SIGIR | TMML: Text-Guided MuliModal Product Location For Alleviating Retrieval Inconsistency in E-Commerce. | Youhua Tang, Xiong Xiong, Siyang Sun, Baoliang Cui, Yun Zheng, Haihong Tang |
| 2022 | CVPR | RCL: Recurrent Continuous Localization for Temporal Action Detection. | Qiang Wang, Yanhao Zhang, Yun Zheng, Pan Pan |
| 2022 | WWW | FastClip: An Efficient Video Understanding System with Heterogeneous Computing and Coarse-to-fine Processing. | Liming Zhao, Siyang Sun, Yanhao Zhang, Yun Zheng, Pan Pan |
| 2022 | SIGIR | An Intelligent Advertisement Short Video Production System via Multi-Modal Retrieval. | Yanheng Wei, Lianghua Huang, Yanhao Zhang, Yun Zheng, Pan Pan |
| 2021 | AAAI | Fashion Focus: Multi-modal Retrieval System for Video Commodity Localization in E-commerce. | Yanhao Zhang, Qiang Wang, Pan Pan, Yun Zheng, Cheng Da, Siyang Sun, Yinghui Xu |
| 2021 | CVPR | Multiple Object Tracking With Correlation Learning. | Qiang Wang, Yun Zheng, Pan Pan, Yinghui Xu |
| 2021 | CVPR | Few-Shot Incremental Learning With Continually Evolved Classifiers. | Chi Zhang, Nan Song, Guosheng Lin, Yun Zheng, Pan Pan, Yinghui Xu |
| 2021 | ICASSP | Exploring Visual-Audio Composition Alignment Network for Quality Fashion Retrieval in Video. | Yanhao Zhang, Jianmin Wu, Xiong Xiong, Dangwei Li, Chenwei Xie, Yun Zheng, Pan Pan, Yinghui Xu |
| 2020 | CIKM | Large Scale Long-tailed Product Recognition System at Alibaba. | Xiangzeng Zhou, Pan Pan, Yun Zheng, Yinghui Xu, Rong Jin |
| 2020 | ECCV | Weakly Supervised Learning with Side Information for Noisy Labeled Images. | Lele Cheng, Xiangzeng Zhou, Liming Zhao, Dangwei Li, Hong Shang, Yun Zheng, Pan Pan, Yinghui Xu |
| 2020 | HCI | Technology Intelligence Practice for NTBFs in Developing Countries. | Thi Ha Htun, Weiguo Fang, Yun Zheng |
| 2019 | CIKM | Virtual ID Discovery from E-commerce Media at Alibaba: Exploiting Richness of User Click Behavior for Visual Search Relevance. | Yanhao Zhang, Pan Pan, Yun Zheng, Kang Zhao, Jianmin Wu, Yinghui Xu, Rong Jin |
| 2019 | CIKM | Large-Scale Visual Search with Binary Distributed Graph at Alibaba. | Kang Zhao, Pan Pan, Yun Zheng, Yanhao Zhang, Changxu Wang, Yingya Zhang, Yinghui Xu, Rong Jin |
| 2018 | KDD | Visual Search at Alibaba. | Yanhao Zhang, Pan Pan, Yun Zheng, Kang Zhao, Yingya Zhang, Xiaofeng Ren, Rong Jin |
| 2017 | IECON | Torque ripple reduction of a modular-stator outer-rotor flux-switching permanent-magnet motor. | Jing Zhao, Yun Zheng, Congcong Zhu, Hao Chen, Liu Yang |
| 2014 | DAS | Real-Time Document Image Super-Resolution by Fast Matting. | Yun Zheng, Xudong Kang, Shutao Li, Yuan He, Jun Sun |
| 2012 | CVPR | MAP-MRF inference based on extended junction tree representation. | Yun Zheng, Pei Chen, Jiang-Zhong Cao |
| 2006 | PAKDD | Informative MicroRNA Expression Patterns for Cancer Classification. | Yun Zheng, Chee Keong Kwoh |
| 2005 | VLSID | Worst-Case Crosstalk Noise Analysis Based on Dual-Exponential Noise Metrics. | Jiaxing Sun, Yun Zheng, Qing Ye, Tianchun Ye |