Yixiao Ge
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
57
Venues
11
Active years
2020–2026
Best venue rank
A*
Where they publish
Papers
57 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | GRPO-CARE: Consistency-Aware Reinforcement Learning for Multimodal Reasoning. | Yi Chen, Yuying Ge, Rui Wang, Yixiao Ge, Junhao Cheng, Ying Shan, Xihui Liu |
| 2025 | CVPR | Divot: Diffusion Powers Video Tokenizer for Comprehension and Generation. | Yuying Ge, Yizhuo Li, Yixiao Ge, Ying Shan |
| 2025 | CVPR | ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models. | Xubing Ye, Yukang Gan, Yixiao Ge, Xiao-Ping Zhang, Yansong Tang |
| 2025 | CVPR | VoCo-LLaMA: Towards Vision Compression with Large Language Models. | Xubing Ye, Yukang Gan, Xiaoke Huang, Yixiao Ge, Yansong Tang |
| 2025 | ICCV | AnimeGamer: Infinite Anime Life Simulation with Next Game State Prediction. | Junhao Cheng, Yuying Ge, Yixiao Ge, Jing Liao, Ying Shan |
| 2025 | ICCV | Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos. | Yi Chen, Yuying Ge, Weiliang Tang, Yizhuo Li, Yixiao Ge, Mingyu Ding, Ying Shan, Xihui Liu |
| 2025 | ICCV | GenHancer: Imperfect Generative Models are Secretly Strong Vision-Centric Enhancers. | Shijie Ma, Yuying Ge, Teng Wang, Yuxin Guo, Yixiao Ge, Ying Shan |
| 2025 | ICCV | Scalable Image Tokenization with Index Backpropagation Quantization. | Fengyuan Shi, Zhuoyan Luo, Yixiao Ge, Yujiu Yang, Ying Shan, Limin Wang |
| 2025 | ICCV | SEED-Story: Multimodal Long Story Generation with Large Language Model. | Shuai Yang, Yuying Ge, Yang Li, Yukang Chen, Yixiao Ge, Ying Shan, Yingcong Chen |
| 2025 | ICML | HaploVL: A Single-Transformer Baseline for Multi-Modal Understanding. | Rui Yang, Lin Song, Yicheng Xiao, Runhui Huang, Yixiao Ge, Ying Shan, Hengshuang Zhao |
| 2025 | ICML | LoRA-Gen: Specializing Large Language Model via Online LoRA Generation. | Yicheng Xiao, Lin Song, Rui Yan, Cheng Cheng, Yixiao Ge, Xiu Li, Ying Shan |
| 2025 | ICRA | Equivariant Filter Design for Range-Only SLAM. | Yixiao Ge, Arthur Pearce, Pieter van Goor, Robert E. Mahony |
| 2025 | NAACL | Plot2Code: A Comprehensive Benchmark for Evaluating Multi-modal Large Language Models in Code Generation from Scientific Plots. | Chengyue Wu, Zhixuan Liang, Yixiao Ge, Qiushan Guo, Zeyu Lu, Jiahao Wang, Ying Shan, Ping Luo |
| 2024 | AAAI | Cached Transformers: Improving Transformers with Differentiable Memory Cachde. | Zhaoyang Zhang, Wenqi Shao, Yixiao Ge, Xiaogang Wang, Jinwei Gu, Ping Luo |
| 2024 | ACL | LLaMA Pro: Progressive LLaMA with Block Expansion. | Chengyue Wu, Yukang Gan, Yixiao Ge, Zeyu Lu, Jiahao Wang, Ye Feng, Ying Shan, Ping Luo |
| 2024 | CVPR | YOLO-World: Real-Time Open-Vocabulary Object Detection. | Tianheng Cheng, Lin Song, Yixiao Ge, Wenyu Liu, Xinggang Wang, Ying Shan |
| 2024 | CVPR | UniRepLKNet: A Universal Perception Large-Kernel ConvNet for Audio, Video, Point Cloud, Time-Series and Image Recognition. | Xiaohan Ding, Yiyuan Zhang, Yixiao Ge, Sijie Zhao, Lin Song, Xiangyu Yue, Ying Shan |
| 2024 | CVPR | Rethinking the Objectives of Vector-Quantized Tokenizers for Image Synthesis. | Yuchao Gu, Xintao Wang, Yixiao Ge, Ying Shan, Mike Zheng Shou |
| 2024 | CVPR | SmartEdit: Exploring Complex Instruction-Based Image Editing with Multimodal Large Language Models. | Yuzhou Huang, Liangbin Xie, Xintao Wang, Ziyang Yuan, Xiaodong Cun, Yixiao Ge, Jiantao Zhou, Chao Dong, Rui Huang, Ruimao Zhang, Ying Shan |
| 2024 | CVPR | VIT-LENS: Towards Omni-modal Representations. | Weixian Lei, Yixiao Ge, Kun Yi, Jianfeng Zhang, Difei Gao, Dylan Sun, Yuying Ge, Ying Shan, Mike Zheng Shou |
| 2024 | CVPR | SEED-Bench: Benchmarking Multimodal Large Language Models. | Bohao Li, Yuying Ge, Yixiao Ge, Guangzhi Wang, Rui Wang, Ruimao Zhang, Ying Shan |
| 2024 | CVPR | BT-Adapter: Video Conversation is Feasible Without Video Instruction Tuning. | Ruyang Liu, Chen Li, Yixiao Ge, Thomas H. Li, Ying Shan, Ge Li |
| 2024 | CVPR | Low-Rank Approximation for Sparse Attention in Multi-Modal LLMs. | Lin Song, Yukang Chen, Shuai Yang, Xiaohan Ding, Yixiao Ge, Ying-Cong Chen, Ying Shan |
| 2024 | CVPR | Multimodal Pathway: Improve Transformers with Irrelevant Data from Other Modalities. | Yiyuan Zhang, Xiaohan Ding, Kaixiong Gong, Yixiao Ge, Ying Shan, Xiangyu Yue |
| 2024 | ECCV | DreamDiffusion: High-Quality EEG-to-Image Generation with Temporal Masked Signal Modeling and CLIP Alignment. | Yunpeng Bai, Xintao Wang, Yan-Pei Cao, Yixiao Ge, Chun Yuan, Ying Shan |
| 2024 | ECCV | ST-LLM: Large Language Models Are Effective Temporal Learners. | Ruyang Liu, Chen Li, Haoran Tang, Yixiao Ge, Ying Shan, Ge Li |
| 2024 | ICLR | Making LLaMA SEE and Draw with SEED Tokenizer. | Yuying Ge, Sijie Zhao, Ziyun Zeng, Yixiao Ge, Chen Li, Xintao Wang, Ying Shan |
| 2024 | ICRA | An Equivariant Approach to Robust State Estimation for the ArduPilot Autopilot System. | Alessandro Fornasier, Yixiao Ge, Pieter van Goor, Martin Scheiber, Andrew Tridgell, Robert E. Mahony, Stephan Weiss |
| 2023 | AAAI | Video-Text Pre-training with Learned Regions for Retrieval. | Rui Yan, Mike Zheng Shou, Yixiao Ge, Jinpeng Wang, Xudong Lin, Guanyu Cai, Jinhui Tang |
| 2023 | AAAI | Darwinian Model Upgrades: Model Evolving with Selective Compatibility. | Binjie Zhang, Shupeng Su, Yixiao Ge, Xuyuan Xu, Yexin Wang, Chun Yuan, Mike Zheng Shou, Ying Shan |
| 2023 | CVPR | All in One: Exploring Unified Video-Language Pre-Training. | Jinpeng Wang, Yixiao Ge, Rui Yan, Yuying Ge, Kevin Qinghong Lin, Satoshi Tsutsui, Xudong Lin, Guanyu Cai, Jianping Wu, Ying Shan, Xiaohu Qie, Mike Zheng Shou |
| 2023 | CVPR | Accelerating Vision-Language Pretraining with Free Language Modeling. | Teng Wang, Yixiao Ge, Feng Zheng, Ran Cheng, Ying Shan, Xiaohu Qie, Ping Luo |
| 2023 | CVPR | RILS: Masked Visual Reconstruction in Language Semantic Space. | Shusheng Yang, Yixiao Ge, Kun Yi, Dian Li, Ying Shan, Xiaohu Qie, Xinggang Wang |
| 2023 | CVPR | Learning Transferable Spatiotemporal Representations from Natural Script Knowledge. | Ziyun Zeng, Yuying Ge, Xihui Liu, Bin Chen, Ping Luo, Shu-Tao Xia, Yixiao Ge |
| 2023 | ICCV | Unleashing Vanilla Vision Transformer with Masked Image Modeling for Object Detection. | Yuxin Fang, Shusheng Yang, Shijie Wang, Yixiao Ge, Ying Shan, Xinggang Wang |
| 2023 | ICCV | Exploring Model Transferability through the Lens of Potential Energy. | Xiaotong Li, Zixuan Hu, Yixiao Ge, Ying Shan, Ling-Yu Duan |
| 2023 | ICCV | Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation. | Jay Zhangjie Wu, Yixiao Ge, Xintao Wang, Stan Weixian Lei, Yuchao Gu, Yufei Shi, Wynne Hsu, Ying Shan, Xiaohu Qie, Mike Zheng Shou |
| 2023 | ICCV | BoxSnake: Polygonal Instance Segmentation with Box Supervision. | Rui Yang, Lin Song, Yixiao Ge, Xiu Li |
| 2023 | ICLR | Masked Image Modeling with Denoising Contrast. | Kun Yi, Yixiao Ge, Xiaotong Li, Shusheng Yang, Dian Li, Jianping Wu, Ying Shan, Xiaohu Qie |
| 2023 | ICML | π-Tuning: Transferring Multimodal Foundation Models with Optimal Multi-task Interpolation. | Chengyue Wu, Teng Wang, Yixiao Ge, Zeyu Lu, Ruisong Zhou, Ying Shan, Ping Luo |
| 2023 | KDD | Binary Embedding-based Retrieval at Tencent. | Yukang Gan, Yixiao Ge, Chang Zhou, Shupeng Su, Zhouchuan Xu, Xuyuan Xu, Quanchao Hui, Xiang Chen, Yexin Wang, Ying Shan |
| 2022 | CVPR | Bridging Video-text Retrieval with Multiple Choice Questions. | Yuying Ge, Yixiao Ge, Xihui Liu, Dian Li, Ying Shan, Xiaohu Qie, Ping Luo |
| 2022 | CVPR | Object-aware Video-language Pre-training for Retrieval. | Alex Jinpeng Wang, Yixiao Ge, Guanyu Cai, Rui Yan, Xudong Lin, Ying Shan, Xiaohu Qie, Mike Zheng Shou |
| 2022 | ECCV | MILES: Visual BERT Pre-training with Injected Language Semantics for Video-Text Retrieval. | Yuying Ge, Yixiao Ge, Xihui Liu, Jinpeng Wang, Jianping Wu, Ying Shan, Xiaohu Qie, Ping Luo |
| 2022 | ECCV | mc-BEiT: Multi-choice Discretization for Image BERT Pre-training. | Xiaotong Li, Yixiao Ge, Kun Yi, Zixuan Hu, Ying Shan, Ling-Yu Duan |
| 2022 | ECCV | Not All Models Are Equal: Predicting Model Transferability in a Self-challenging Fisher Space. | Wenqi Shao, Xun Zhao, Yixiao Ge, Zhaoyang Zhang, Lei Yang, Xiaogang Wang, Ying Shan, Ping Luo |
| 2022 | ICLR | Uncertainty Modeling for Out-of-Distribution Generalization. | Xiaotong Li, Yongxing Dai, Yixiao Ge, Jun Liu, Ying Shan, Lingyu Duan |
| 2022 | ICLR | Dynamic Token Normalization improves Vision Transformers. | Wenqi Shao, Yixiao Ge, Zhaoyang Zhang, Xuyuan Xu, Xiaogang Wang, Ying Shan, Ping Luo |
| 2022 | ICLR | Hot-Refresh Model Upgrades with Regression-Free Compatible Training in Image Retrieval. | Binjie Zhang, Yixiao Ge, Yantao Shen, Yu Li, Chun Yuan, Xuyuan Xu, Yexin Wang, Ying Shan |
| 2022 | IJCAI | Towards Universal Backward-Compatible Representation Learning. | Binjie Zhang, Yixiao Ge, Yantao Shen, Shupeng Su, Fanzi Wu, Chun Yuan, Xuyuan Xu, Yexin Wang, Ying Shan |
| 2021 | CVPR | DivCo: Diverse Conditional Image Synthesis via Contrastive Generative Adversarial Network. | Rui Liu, Yixiao Ge, Ching Lam Choi, Xiaogang Wang, Hongsheng Li |
| 2021 | CVPR | Mutual CRF-GNN for Few-Shot Learning. | Shixiang Tang, Dapeng Chen, Lei Bai, Kaijian Liu, Yixiao Ge, Wanli Ouyang |
| 2021 | CVPR | Refining Pseudo Labels With Clustering Consensus Over Generations for Unsupervised Object Re-Identification. | Xiao Zhang, Yixiao Ge, Yu Qiao, Hongsheng Li |
| 2021 | ICCV | Progressive Correspondence Pruning by Consensus Learning. | Chen Zhao, Yixiao Ge, Feng Zhu, Rui Zhao, Hongsheng Li, Mathieu Salzmann |
| 2021 | ICCV | Online Pseudo Label Generation by Hierarchical Cluster Dynamics for Adaptive Person Re-identification. | Yi Zheng, Shixiang Tang, Guolong Teng, Yixiao Ge, Kaijian Liu, Jing Qin, Donglian Qi, Dapeng Chen |
| 2020 | ECCV | Self-supervising Fine-Grained Region Similarities for Large-Scale Image Localization. | Yixiao Ge, Haibo Wang, Feng Zhu, Rui Zhao, Hongsheng Li |
| 2020 | ICLR | Mutual Mean-Teaching: Pseudo Label Refinery for Unsupervised Domain Adaptation on Person Re-identification. | Yixiao Ge, Dapeng Chen, Hongsheng Li |