Skip to content

Yixiao Ge

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

57

Venues

11

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

57 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLGRPO-CARE: Consistency-Aware Reinforcement Learning for Multimodal Reasoning.Yi Chen, Yuying Ge, Rui Wang, Yixiao Ge, Junhao Cheng, Ying Shan, Xihui Liu
2025CVPRDivot: Diffusion Powers Video Tokenizer for Comprehension and Generation.Yuying Ge, Yizhuo Li, Yixiao Ge, Ying Shan
2025CVPRATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models.Xubing Ye, Yukang Gan, Yixiao Ge, Xiao-Ping Zhang, Yansong Tang
2025CVPRVoCo-LLaMA: Towards Vision Compression with Large Language Models.Xubing Ye, Yukang Gan, Xiaoke Huang, Yixiao Ge, Yansong Tang
2025ICCVAnimeGamer: Infinite Anime Life Simulation with Next Game State Prediction.Junhao Cheng, Yuying Ge, Yixiao Ge, Jing Liao, Ying Shan
2025ICCVMoto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos.Yi Chen, Yuying Ge, Weiliang Tang, Yizhuo Li, Yixiao Ge, Mingyu Ding, Ying Shan, Xihui Liu
2025ICCVGenHancer: Imperfect Generative Models are Secretly Strong Vision-Centric Enhancers.Shijie Ma, Yuying Ge, Teng Wang, Yuxin Guo, Yixiao Ge, Ying Shan
2025ICCVScalable Image Tokenization with Index Backpropagation Quantization.Fengyuan Shi, Zhuoyan Luo, Yixiao Ge, Yujiu Yang, Ying Shan, Limin Wang
2025ICCVSEED-Story: Multimodal Long Story Generation with Large Language Model.Shuai Yang, Yuying Ge, Yang Li, Yukang Chen, Yixiao Ge, Ying Shan, Yingcong Chen
2025ICMLHaploVL: A Single-Transformer Baseline for Multi-Modal Understanding.Rui Yang, Lin Song, Yicheng Xiao, Runhui Huang, Yixiao Ge, Ying Shan, Hengshuang Zhao
2025ICMLLoRA-Gen: Specializing Large Language Model via Online LoRA Generation.Yicheng Xiao, Lin Song, Rui Yan, Cheng Cheng, Yixiao Ge, Xiu Li, Ying Shan
2025ICRAEquivariant Filter Design for Range-Only SLAM.Yixiao Ge, Arthur Pearce, Pieter van Goor, Robert E. Mahony
2025NAACLPlot2Code: A Comprehensive Benchmark for Evaluating Multi-modal Large Language Models in Code Generation from Scientific Plots.Chengyue Wu, Zhixuan Liang, Yixiao Ge, Qiushan Guo, Zeyu Lu, Jiahao Wang, Ying Shan, Ping Luo
2024AAAICached Transformers: Improving Transformers with Differentiable Memory Cachde.Zhaoyang Zhang, Wenqi Shao, Yixiao Ge, Xiaogang Wang, Jinwei Gu, Ping Luo
2024ACLLLaMA Pro: Progressive LLaMA with Block Expansion.Chengyue Wu, Yukang Gan, Yixiao Ge, Zeyu Lu, Jiahao Wang, Ye Feng, Ying Shan, Ping Luo
2024CVPRYOLO-World: Real-Time Open-Vocabulary Object Detection.Tianheng Cheng, Lin Song, Yixiao Ge, Wenyu Liu, Xinggang Wang, Ying Shan
2024CVPRUniRepLKNet: A Universal Perception Large-Kernel ConvNet for Audio, Video, Point Cloud, Time-Series and Image Recognition.Xiaohan Ding, Yiyuan Zhang, Yixiao Ge, Sijie Zhao, Lin Song, Xiangyu Yue, Ying Shan
2024CVPRRethinking the Objectives of Vector-Quantized Tokenizers for Image Synthesis.Yuchao Gu, Xintao Wang, Yixiao Ge, Ying Shan, Mike Zheng Shou
2024CVPRSmartEdit: Exploring Complex Instruction-Based Image Editing with Multimodal Large Language Models.Yuzhou Huang, Liangbin Xie, Xintao Wang, Ziyang Yuan, Xiaodong Cun, Yixiao Ge, Jiantao Zhou, Chao Dong, Rui Huang, Ruimao Zhang, Ying Shan
2024CVPRVIT-LENS: Towards Omni-modal Representations.Weixian Lei, Yixiao Ge, Kun Yi, Jianfeng Zhang, Difei Gao, Dylan Sun, Yuying Ge, Ying Shan, Mike Zheng Shou
2024CVPRSEED-Bench: Benchmarking Multimodal Large Language Models.Bohao Li, Yuying Ge, Yixiao Ge, Guangzhi Wang, Rui Wang, Ruimao Zhang, Ying Shan
2024CVPRBT-Adapter: Video Conversation is Feasible Without Video Instruction Tuning.Ruyang Liu, Chen Li, Yixiao Ge, Thomas H. Li, Ying Shan, Ge Li
2024CVPRLow-Rank Approximation for Sparse Attention in Multi-Modal LLMs.Lin Song, Yukang Chen, Shuai Yang, Xiaohan Ding, Yixiao Ge, Ying-Cong Chen, Ying Shan
2024CVPRMultimodal Pathway: Improve Transformers with Irrelevant Data from Other Modalities.Yiyuan Zhang, Xiaohan Ding, Kaixiong Gong, Yixiao Ge, Ying Shan, Xiangyu Yue
2024ECCVDreamDiffusion: High-Quality EEG-to-Image Generation with Temporal Masked Signal Modeling and CLIP Alignment.Yunpeng Bai, Xintao Wang, Yan-Pei Cao, Yixiao Ge, Chun Yuan, Ying Shan
2024ECCVST-LLM: Large Language Models Are Effective Temporal Learners.Ruyang Liu, Chen Li, Haoran Tang, Yixiao Ge, Ying Shan, Ge Li
2024ICLRMaking LLaMA SEE and Draw with SEED Tokenizer.Yuying Ge, Sijie Zhao, Ziyun Zeng, Yixiao Ge, Chen Li, Xintao Wang, Ying Shan
2024ICRAAn Equivariant Approach to Robust State Estimation for the ArduPilot Autopilot System.Alessandro Fornasier, Yixiao Ge, Pieter van Goor, Martin Scheiber, Andrew Tridgell, Robert E. Mahony, Stephan Weiss
2023AAAIVideo-Text Pre-training with Learned Regions for Retrieval.Rui Yan, Mike Zheng Shou, Yixiao Ge, Jinpeng Wang, Xudong Lin, Guanyu Cai, Jinhui Tang
2023AAAIDarwinian Model Upgrades: Model Evolving with Selective Compatibility.Binjie Zhang, Shupeng Su, Yixiao Ge, Xuyuan Xu, Yexin Wang, Chun Yuan, Mike Zheng Shou, Ying Shan
2023CVPRAll in One: Exploring Unified Video-Language Pre-Training.Jinpeng Wang, Yixiao Ge, Rui Yan, Yuying Ge, Kevin Qinghong Lin, Satoshi Tsutsui, Xudong Lin, Guanyu Cai, Jianping Wu, Ying Shan, Xiaohu Qie, Mike Zheng Shou
2023CVPRAccelerating Vision-Language Pretraining with Free Language Modeling.Teng Wang, Yixiao Ge, Feng Zheng, Ran Cheng, Ying Shan, Xiaohu Qie, Ping Luo
2023CVPRRILS: Masked Visual Reconstruction in Language Semantic Space.Shusheng Yang, Yixiao Ge, Kun Yi, Dian Li, Ying Shan, Xiaohu Qie, Xinggang Wang
2023CVPRLearning Transferable Spatiotemporal Representations from Natural Script Knowledge.Ziyun Zeng, Yuying Ge, Xihui Liu, Bin Chen, Ping Luo, Shu-Tao Xia, Yixiao Ge
2023ICCVUnleashing Vanilla Vision Transformer with Masked Image Modeling for Object Detection.Yuxin Fang, Shusheng Yang, Shijie Wang, Yixiao Ge, Ying Shan, Xinggang Wang
2023ICCVExploring Model Transferability through the Lens of Potential Energy.Xiaotong Li, Zixuan Hu, Yixiao Ge, Ying Shan, Ling-Yu Duan
2023ICCVTune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation.Jay Zhangjie Wu, Yixiao Ge, Xintao Wang, Stan Weixian Lei, Yuchao Gu, Yufei Shi, Wynne Hsu, Ying Shan, Xiaohu Qie, Mike Zheng Shou
2023ICCVBoxSnake: Polygonal Instance Segmentation with Box Supervision.Rui Yang, Lin Song, Yixiao Ge, Xiu Li
2023ICLRMasked Image Modeling with Denoising Contrast.Kun Yi, Yixiao Ge, Xiaotong Li, Shusheng Yang, Dian Li, Jianping Wu, Ying Shan, Xiaohu Qie
2023ICMLπ-Tuning: Transferring Multimodal Foundation Models with Optimal Multi-task Interpolation.Chengyue Wu, Teng Wang, Yixiao Ge, Zeyu Lu, Ruisong Zhou, Ying Shan, Ping Luo
2023KDDBinary Embedding-based Retrieval at Tencent.Yukang Gan, Yixiao Ge, Chang Zhou, Shupeng Su, Zhouchuan Xu, Xuyuan Xu, Quanchao Hui, Xiang Chen, Yexin Wang, Ying Shan
2022CVPRBridging Video-text Retrieval with Multiple Choice Questions.Yuying Ge, Yixiao Ge, Xihui Liu, Dian Li, Ying Shan, Xiaohu Qie, Ping Luo
2022CVPRObject-aware Video-language Pre-training for Retrieval.Alex Jinpeng Wang, Yixiao Ge, Guanyu Cai, Rui Yan, Xudong Lin, Ying Shan, Xiaohu Qie, Mike Zheng Shou
2022ECCVMILES: Visual BERT Pre-training with Injected Language Semantics for Video-Text Retrieval.Yuying Ge, Yixiao Ge, Xihui Liu, Jinpeng Wang, Jianping Wu, Ying Shan, Xiaohu Qie, Ping Luo
2022ECCVmc-BEiT: Multi-choice Discretization for Image BERT Pre-training.Xiaotong Li, Yixiao Ge, Kun Yi, Zixuan Hu, Ying Shan, Ling-Yu Duan
2022ECCVNot All Models Are Equal: Predicting Model Transferability in a Self-challenging Fisher Space.Wenqi Shao, Xun Zhao, Yixiao Ge, Zhaoyang Zhang, Lei Yang, Xiaogang Wang, Ying Shan, Ping Luo
2022ICLRUncertainty Modeling for Out-of-Distribution Generalization.Xiaotong Li, Yongxing Dai, Yixiao Ge, Jun Liu, Ying Shan, Lingyu Duan
2022ICLRDynamic Token Normalization improves Vision Transformers.Wenqi Shao, Yixiao Ge, Zhaoyang Zhang, Xuyuan Xu, Xiaogang Wang, Ying Shan, Ping Luo
2022ICLRHot-Refresh Model Upgrades with Regression-Free Compatible Training in Image Retrieval.Binjie Zhang, Yixiao Ge, Yantao Shen, Yu Li, Chun Yuan, Xuyuan Xu, Yexin Wang, Ying Shan
2022IJCAITowards Universal Backward-Compatible Representation Learning.Binjie Zhang, Yixiao Ge, Yantao Shen, Shupeng Su, Fanzi Wu, Chun Yuan, Xuyuan Xu, Yexin Wang, Ying Shan
2021CVPRDivCo: Diverse Conditional Image Synthesis via Contrastive Generative Adversarial Network.Rui Liu, Yixiao Ge, Ching Lam Choi, Xiaogang Wang, Hongsheng Li
2021CVPRMutual CRF-GNN for Few-Shot Learning.Shixiang Tang, Dapeng Chen, Lei Bai, Kaijian Liu, Yixiao Ge, Wanli Ouyang
2021CVPRRefining Pseudo Labels With Clustering Consensus Over Generations for Unsupervised Object Re-Identification.Xiao Zhang, Yixiao Ge, Yu Qiao, Hongsheng Li
2021ICCVProgressive Correspondence Pruning by Consensus Learning.Chen Zhao, Yixiao Ge, Feng Zhu, Rui Zhao, Hongsheng Li, Mathieu Salzmann
2021ICCVOnline Pseudo Label Generation by Hierarchical Cluster Dynamics for Adaptive Person Re-identification.Yi Zheng, Shixiang Tang, Guolong Teng, Yixiao Ge, Kaijian Liu, Jing Qin, Donglian Qi, Dapeng Chen
2020ECCVSelf-supervising Fine-Grained Region Similarities for Large-Scale Image Localization.Yixiao Ge, Haibo Wang, Feng Zhu, Rui Zhao, Hongsheng Li
2020ICLRMutual Mean-Teaching: Pseudo Label Refinery for Unsupervised Domain Adaptation on Person Re-identification.Yixiao Ge, Dapeng Chen, Hongsheng Li