| 2025 | CVPR | LiveCC: Learning Video LLM with Streaming Speech Transcription at Scale. | Joya Chen, Ziyun Zeng, Yiqi Lin, Wei Li, Zejun Ma, Mike Zheng Shou |
| 2025 | ICCV | Omnipaint: Mastering Object-Oriented Editing Via Disentangled Insertion-Removal Inpainting. | Yongsheng Yu, Ziyun Zeng, Haitian Zheng, Jiebo Luo |
| 2024 | AAAI | GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval. | Yuting Wang, Jinpeng Wang, Bin Chen, Ziyun Zeng, Shu-Tao Xia |
| 2024 | CVPR | VideoCutLER: Surprisingly Simple Unsupervised Video Instance Segmentation. | Xudong Wang, Ishan Misra, Ziyun Zeng, Rohit Girdhar, Trevor Darrell |
| 2024 | ICLR | Making LLaMA SEE and Draw with SEED Tokenizer. | Yuying Ge, Sijie Zhao, Ziyun Zeng, Yixiao Ge, Chen Li, Xintao Wang, Ying Shan |
| 2023 | AAAI | Contrastive Masked Autoencoders for Self-Supervised Video Hashing. | Yuting Wang, Jinpeng Wang, Bin Chen, Ziyun Zeng, Shu-Tao Xia |
| 2023 | CVPR | Learning Transferable Spatiotemporal Representations from Natural Script Knowledge. | Ziyun Zeng, Yuying Ge, Xihui Liu, Bin Chen, Ping Luo, Shu-Tao Xia, Yixiao Ge |
| 2022 | AAAI | Contrastive Quantization with Code Memory for Unsupervised Image Retrieval. | Jinpeng Wang, Ziyun Zeng, Bin Chen, Tao Dai, Shu-Tao Xia |
| 2022 | BMVC | Hugs Are Better Than Handshakes: Unsupervised Cross-Modal Transformer Hashing with Multi-granularity Alignment. | Jinpeng Wang, Ziyun Zeng, Bin Chen, Yuting Wang, Dongliang Liao, Gongfu Li, Yiru Wang, Shu-Tao Xia |
| 2022 | BMVC | Motion-Aware Graph Reasoning Hashing for Self-supervised Video Retrieval. | Ziyun Zeng, Jinpeng Wang, Bin Chen, Yuting Wang, Shu-Tao Xia |
| 2022 | WWW | Hybrid Contrastive Quantization for Efficient Cross-View Video Retrieval. | Jinpeng Wang, Bin Chen, Dongliang Liao, Ziyun Zeng, Gongfu Li, Shu-Tao Xia, Jin Xu |
| 2021 | BMVC | SwinFGHash: Fine-grained Image Retrieval via Transformer-based Hashing Network. | Di Lu, Jinpeng Wang, Ziyun Zeng, Bin Chen, Shudeng Wu, Shu-Tao Xia |