Skip to content

Zehuan Yuan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

41

Venues

9

Active years

2018–2026

Best venue rank

A*

Where they publish

Papers

41 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIFlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video Generation.Shilong Zhang, Wenbo Li, Shoufa Chen, Chongjian Ge, Peize Sun, Yifu Zhang, Yi Jiang, Zehuan Yuan, Bingyue Peng, Ping Luo
2025CVPRGoku: Flow Based Video Generative Foundation Models.Shoufa Chen, Chongjian Ge, Yuqi Zhang, Yida Zhang, Fengda Zhu, Hao Yang, Hongxiang Hao, Hui Wu, Zhichao Lai, Yifei Hu, Ting-Che Lin, Shilong Zhang, Fu Li, Chuan Li, Xing Wang, Yanghua Peng, Peize Sun, Ping Luo, Yi Jiang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu
2025CVPRInfinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis.Jian Han, Jinlai Liu, Yi Jiang, Bin Yan, Yuqi Zhang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu
2025CVPRTokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation.Liao Qu, Huichao Zhang, Yiheng Liu, Xu Wang, Yi Jiang, Yiming Gao, Hu Ye, Daniel K. Du, Zehuan Yuan, Xinglong Wu
2024AAAIEVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE.Junyi Chen, Longteng Guo, Jia Sun, Shuai Shao, Zehuan Yuan, Liang Lin, Dongyu Zhang
2024BMVCMotionMAE: Self-supervised Video Representation Learning with Motion-Aware Masked Autoencoders.Haosen Yang, Deng Huang, Bin Wen, Jiannan Wu, Hongxun Yao, Yi Jiang, Xiatian Zhu, Zehuan Yuan
2024CVPRGenerative Region-Language Pretraining for Open-Ended Object Detection.Chuang Lin, Yi Jiang, Lizhen Qu, Zehuan Yuan, Jianfei Cai
2024CVPRGeneral Object Foundation Model for Images and Videos at Scale.Junfeng Wu, Yi Jiang, Qihao Liu, Zehuan Yuan, Xiang Bai, Song Bai
2024ECCVGroma: Localized Visual Tokenization for Grounding Multimodal Large Language Models.Chuofan Ma, Yi Jiang, Jiannan Wu, Zehuan Yuan, Xiaojuan Qi
2024ICASSPView Crafting For Instance-Level Representation from Scene Images.Bin Liu, Yuchen Luo, Shaofeng Zhang, Zehuan Yuan, Changdong Xu, Boan Chen, Junchi Yan
2023CVPRUniversal Instance Perception as Object Discovery and Retrieval.Bin Yan, Yi Jiang, Jiannan Wu, Dong Wang, Ping Luo, Zehuan Yuan, Huchuan Lu
2023CVPRLearning Instance-Level Representation for Large-Scale Multi-Modal Pretraining in E-Commerce.Yang Jin, Yongzhi Li, Zehuan Yuan, Yadong Mu
2023CVPRToken Boosting for Robust Self-Supervised Visual Transformer Pre-training.Tianjiao Li, Lin Geng Foo, Ping Hu, Xindi Shang, Hossein Rahmani, Zehuan Yuan, Jun Liu
2023CVPRMeta Compositional Referring Expression Segmentation.Li Xu, Mark He Huang, Xindi Shang, Zehuan Yuan, Ying Sun, Jun Liu
2023ICCVEGC: Image Generation and Classification via a Diffusion Energy-Based Model.Qiushan Guo, Chuofan Ma, Yi Jiang, Zehuan Yuan, Yizhou Yu, Ping Luo
2023ICCVSegment Every Reference Object in Spatial and Temporal Spaces.Jiannan Wu, Yi Jiang, Bin Yan, Huchuan Lu, Zehuan Yuan, Ping Luo
2023ICCVExploring Transformers for Open-world Instance Segmentation.Jiannan Wu, Yi Jiang, Bin Yan, Huchuan Lu, Zehuan Yuan, Ping Luo
2023ICLRLearning Object-Language Alignments for Open-Vocabulary Object Detection.Chuang Lin, Peize Sun, Yi Jiang, Ping Luo, Lizhen Qu, Gholamreza Haffari, Zehuan Yuan, Jianfei Cai
2023ICLRDesigning BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling.Keyu Tian, Yi Jiang, Qishuai Diao, Chen Lin, Liwei Wang, Zehuan Yuan
2023SIGIRMAMO: Fine-Grained Vision-Language Representations Learning with Masked Multimodal Modeling.Zijia Zhao, Longteng Guo, Xingjian He, Shuai Shao, Zehuan Yuan, Jing Liu
2022AAAIContent-Variant Reference Image Quality Assessment via Knowledge Distillation.Guanghao Yin, Wei Wang, Zehuan Yuan, Chuchu Han, Wei Ji, Shouqian Sun, Changhu Wang
2022CVPRDanceTrack: Multi-Object Tracking in Uniform Appearance and Diverse Motion.Peize Sun, Jinkun Cao, Yi Jiang, Zehuan Yuan, Song Bai, Kris Kitani, Ping Luo
2022CVPRLanguage as Queries for Referring Video Object Segmentation.Jiannan Wu, Yi Jiang, Peize Sun, Zehuan Yuan, Ping Luo
2022CVPRFocal and Global Knowledge Distillation for Detectors.Zhendong Yang, Zhe Li, Xiaohu Jiang, Yuan Gong, Zehuan Yuan, Danpei Zhao, Chun Yuan
2022ECCVYou Should Look at All Objects.Zhenchao Jin, Dongdong Yu, Luchuan Song, Zehuan Yuan, Lequan Yu
2022ECCVMultimodal Transformer with Variable-Length Memory for Vision-and-Language Navigation.Chuang Lin, Yi Jiang, Jianfei Cai, Lizhen Qu, Gholamreza Haffari, Zehuan Yuan
2022ECCVMasked Generative Distillation.Zhendong Yang, Zhe Li, Mingqi Shao, Dachuan Shi, Zehuan Yuan, Chun Yuan
2022ECCVTowards Grand Unification of Object Tracking.Bin Yan, Yi Jiang, Peize Sun, Dong Wang, Zehuan Yuan, Ping Luo, Huchuan Lu
2022ECCVByteTrack: Multi-object Tracking by Associating Every Detection Box.Yifu Zhang, Peize Sun, Yi Jiang, Dongdong Yu, Fucheng Weng, Zehuan Yuan, Ping Luo, Wenyu Liu, Xinggang Wang
2022ICLRObjects in Semantic Topology.Shuo Yang, Peize Sun, Yi Jiang, Xiaobo Xia, Ruiheng Zhang, Zehuan Yuan, Changhu Wang, Ping Luo, Min Xu
2021AAAISlimmable Generative Adversarial Networks.Liang Hou, Zehuan Yuan, Lei Huang, Huawei Shen, Xueqi Cheng, Changhu Wang
2021CVPRSparse R-CNN: End-to-End Object Detection With Learnable Proposals.Peize Sun, Rufeng Zhang, Yi Jiang, Tao Kong, Chenfeng Xu, Wei Zhan, Masayoshi Tomizuka, Lei Li, Zehuan Yuan, Changhu Wang, Ping Luo
2021ICCVWeakly Supervised Person Search with Region Siamese Networks.Chuchu Han, Kai Su, Dongdong Yu, Zehuan Yuan, Changxin Gao, Nong Sang, Yi Yang, Changhu Wang
2021ICCVDomain-Invariant Disentangled Network for Generalizable Object Detection.Chuang Lin, Zehuan Yuan, Sicheng Zhao, Peize Sun, Changhu Wang, Jianfei Cai
2021ICCVUnsupervised Real-World Super-Resolution: A Domain Adaptation Perspective.Wei Wang, Haochen Zhang, Zehuan Yuan, Changhu Wang
2021ICLRExploring Balanced Feature Spaces for Representation Learning.Bingyi Kang, Yu Li, Sa Xie, Zehuan Yuan, Jiashi Feng
2021ICMLWhat Makes for End-to-End Object Detection?Peize Sun, Yi Jiang, Enze Xie, Wenqi Shao, Zehuan Yuan, Changhu Wang, Ping Luo
2020CVPRNon-Local Neural Networks With Grouped Bilinear Attentional Transforms.Lu Chi, Zehuan Yuan, Yadong Mu, Changhu Wang
2020CVPRControllable Orthogonalization in Training DNNs.Lei Huang, Li Liu, Fan Zhu, Diwen Wan, Zehuan Yuan, Bo Li, Ling Shao
2018ECCVTowards Good Practices for Multi-modal Fusion in Large-Scale Video Classification.Jinlai Liu, Zehuan Yuan, Changhu Wang
2018ECCVKnowing Where to Look? Analysis on Attention of Visual Question Answering System.Wei Li, Zehuan Yuan, Xiangzhong Fang, Changhu Wang