Zehuan Yuan
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
41
Venues
9
Active years
2018–2026
Best venue rank
A*
Where they publish
Papers
41 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | FlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video Generation. | Shilong Zhang, Wenbo Li, Shoufa Chen, Chongjian Ge, Peize Sun, Yifu Zhang, Yi Jiang, Zehuan Yuan, Bingyue Peng, Ping Luo |
| 2025 | CVPR | Goku: Flow Based Video Generative Foundation Models. | Shoufa Chen, Chongjian Ge, Yuqi Zhang, Yida Zhang, Fengda Zhu, Hao Yang, Hongxiang Hao, Hui Wu, Zhichao Lai, Yifei Hu, Ting-Che Lin, Shilong Zhang, Fu Li, Chuan Li, Xing Wang, Yanghua Peng, Peize Sun, Ping Luo, Yi Jiang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu |
| 2025 | CVPR | Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis. | Jian Han, Jinlai Liu, Yi Jiang, Bin Yan, Yuqi Zhang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu |
| 2025 | CVPR | TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation. | Liao Qu, Huichao Zhang, Yiheng Liu, Xu Wang, Yi Jiang, Yiming Gao, Hu Ye, Daniel K. Du, Zehuan Yuan, Xinglong Wu |
| 2024 | AAAI | EVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE. | Junyi Chen, Longteng Guo, Jia Sun, Shuai Shao, Zehuan Yuan, Liang Lin, Dongyu Zhang |
| 2024 | BMVC | MotionMAE: Self-supervised Video Representation Learning with Motion-Aware Masked Autoencoders. | Haosen Yang, Deng Huang, Bin Wen, Jiannan Wu, Hongxun Yao, Yi Jiang, Xiatian Zhu, Zehuan Yuan |
| 2024 | CVPR | Generative Region-Language Pretraining for Open-Ended Object Detection. | Chuang Lin, Yi Jiang, Lizhen Qu, Zehuan Yuan, Jianfei Cai |
| 2024 | CVPR | General Object Foundation Model for Images and Videos at Scale. | Junfeng Wu, Yi Jiang, Qihao Liu, Zehuan Yuan, Xiang Bai, Song Bai |
| 2024 | ECCV | Groma: Localized Visual Tokenization for Grounding Multimodal Large Language Models. | Chuofan Ma, Yi Jiang, Jiannan Wu, Zehuan Yuan, Xiaojuan Qi |
| 2024 | ICASSP | View Crafting For Instance-Level Representation from Scene Images. | Bin Liu, Yuchen Luo, Shaofeng Zhang, Zehuan Yuan, Changdong Xu, Boan Chen, Junchi Yan |
| 2023 | CVPR | Universal Instance Perception as Object Discovery and Retrieval. | Bin Yan, Yi Jiang, Jiannan Wu, Dong Wang, Ping Luo, Zehuan Yuan, Huchuan Lu |
| 2023 | CVPR | Learning Instance-Level Representation for Large-Scale Multi-Modal Pretraining in E-Commerce. | Yang Jin, Yongzhi Li, Zehuan Yuan, Yadong Mu |
| 2023 | CVPR | Token Boosting for Robust Self-Supervised Visual Transformer Pre-training. | Tianjiao Li, Lin Geng Foo, Ping Hu, Xindi Shang, Hossein Rahmani, Zehuan Yuan, Jun Liu |
| 2023 | CVPR | Meta Compositional Referring Expression Segmentation. | Li Xu, Mark He Huang, Xindi Shang, Zehuan Yuan, Ying Sun, Jun Liu |
| 2023 | ICCV | EGC: Image Generation and Classification via a Diffusion Energy-Based Model. | Qiushan Guo, Chuofan Ma, Yi Jiang, Zehuan Yuan, Yizhou Yu, Ping Luo |
| 2023 | ICCV | Segment Every Reference Object in Spatial and Temporal Spaces. | Jiannan Wu, Yi Jiang, Bin Yan, Huchuan Lu, Zehuan Yuan, Ping Luo |
| 2023 | ICCV | Exploring Transformers for Open-world Instance Segmentation. | Jiannan Wu, Yi Jiang, Bin Yan, Huchuan Lu, Zehuan Yuan, Ping Luo |
| 2023 | ICLR | Learning Object-Language Alignments for Open-Vocabulary Object Detection. | Chuang Lin, Peize Sun, Yi Jiang, Ping Luo, Lizhen Qu, Gholamreza Haffari, Zehuan Yuan, Jianfei Cai |
| 2023 | ICLR | Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling. | Keyu Tian, Yi Jiang, Qishuai Diao, Chen Lin, Liwei Wang, Zehuan Yuan |
| 2023 | SIGIR | MAMO: Fine-Grained Vision-Language Representations Learning with Masked Multimodal Modeling. | Zijia Zhao, Longteng Guo, Xingjian He, Shuai Shao, Zehuan Yuan, Jing Liu |
| 2022 | AAAI | Content-Variant Reference Image Quality Assessment via Knowledge Distillation. | Guanghao Yin, Wei Wang, Zehuan Yuan, Chuchu Han, Wei Ji, Shouqian Sun, Changhu Wang |
| 2022 | CVPR | DanceTrack: Multi-Object Tracking in Uniform Appearance and Diverse Motion. | Peize Sun, Jinkun Cao, Yi Jiang, Zehuan Yuan, Song Bai, Kris Kitani, Ping Luo |
| 2022 | CVPR | Language as Queries for Referring Video Object Segmentation. | Jiannan Wu, Yi Jiang, Peize Sun, Zehuan Yuan, Ping Luo |
| 2022 | CVPR | Focal and Global Knowledge Distillation for Detectors. | Zhendong Yang, Zhe Li, Xiaohu Jiang, Yuan Gong, Zehuan Yuan, Danpei Zhao, Chun Yuan |
| 2022 | ECCV | You Should Look at All Objects. | Zhenchao Jin, Dongdong Yu, Luchuan Song, Zehuan Yuan, Lequan Yu |
| 2022 | ECCV | Multimodal Transformer with Variable-Length Memory for Vision-and-Language Navigation. | Chuang Lin, Yi Jiang, Jianfei Cai, Lizhen Qu, Gholamreza Haffari, Zehuan Yuan |
| 2022 | ECCV | Masked Generative Distillation. | Zhendong Yang, Zhe Li, Mingqi Shao, Dachuan Shi, Zehuan Yuan, Chun Yuan |
| 2022 | ECCV | Towards Grand Unification of Object Tracking. | Bin Yan, Yi Jiang, Peize Sun, Dong Wang, Zehuan Yuan, Ping Luo, Huchuan Lu |
| 2022 | ECCV | ByteTrack: Multi-object Tracking by Associating Every Detection Box. | Yifu Zhang, Peize Sun, Yi Jiang, Dongdong Yu, Fucheng Weng, Zehuan Yuan, Ping Luo, Wenyu Liu, Xinggang Wang |
| 2022 | ICLR | Objects in Semantic Topology. | Shuo Yang, Peize Sun, Yi Jiang, Xiaobo Xia, Ruiheng Zhang, Zehuan Yuan, Changhu Wang, Ping Luo, Min Xu |
| 2021 | AAAI | Slimmable Generative Adversarial Networks. | Liang Hou, Zehuan Yuan, Lei Huang, Huawei Shen, Xueqi Cheng, Changhu Wang |
| 2021 | CVPR | Sparse R-CNN: End-to-End Object Detection With Learnable Proposals. | Peize Sun, Rufeng Zhang, Yi Jiang, Tao Kong, Chenfeng Xu, Wei Zhan, Masayoshi Tomizuka, Lei Li, Zehuan Yuan, Changhu Wang, Ping Luo |
| 2021 | ICCV | Weakly Supervised Person Search with Region Siamese Networks. | Chuchu Han, Kai Su, Dongdong Yu, Zehuan Yuan, Changxin Gao, Nong Sang, Yi Yang, Changhu Wang |
| 2021 | ICCV | Domain-Invariant Disentangled Network for Generalizable Object Detection. | Chuang Lin, Zehuan Yuan, Sicheng Zhao, Peize Sun, Changhu Wang, Jianfei Cai |
| 2021 | ICCV | Unsupervised Real-World Super-Resolution: A Domain Adaptation Perspective. | Wei Wang, Haochen Zhang, Zehuan Yuan, Changhu Wang |
| 2021 | ICLR | Exploring Balanced Feature Spaces for Representation Learning. | Bingyi Kang, Yu Li, Sa Xie, Zehuan Yuan, Jiashi Feng |
| 2021 | ICML | What Makes for End-to-End Object Detection? | Peize Sun, Yi Jiang, Enze Xie, Wenqi Shao, Zehuan Yuan, Changhu Wang, Ping Luo |
| 2020 | CVPR | Non-Local Neural Networks With Grouped Bilinear Attentional Transforms. | Lu Chi, Zehuan Yuan, Yadong Mu, Changhu Wang |
| 2020 | CVPR | Controllable Orthogonalization in Training DNNs. | Lei Huang, Li Liu, Fan Zhu, Diwen Wan, Zehuan Yuan, Bo Li, Ling Shao |
| 2018 | ECCV | Towards Good Practices for Multi-modal Fusion in Large-Scale Video Classification. | Jinlai Liu, Zehuan Yuan, Changhu Wang |
| 2018 | ECCV | Knowing Where to Look? Analysis on Attention of Visual Question Answering System. | Wei Li, Zehuan Yuan, Xiangzhong Fang, Changhu Wang |