Skip to content

Chaoyou Fu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

7

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIQuoTA: Query-oriented Token Assignment via CoT Query Decouple for Long Video Comprehension.Yongdong Luo, Wang Chen, Weizhong Huang, Shukang Yin, Haojia Lin, Jinfa Huang, Chaoyou Fu, Jiayi Ji, Xiawu Zheng, Jiebo Luo
2026ACLScaling Law for Multimodal Large Language Model Supervised Fine-Tuning.Yifan Zhang, Tao Yu, Feng Li, Chaoyou Fu, Yibo Hu, Kun Wang, Qingsong Wen, Zhang Zhang, Liang Wang, Rong Jin
2025CVPRInstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption.Tiehan Fan, Kepan Nan, Rui Xie, Penghao Zhou, Zhenheng Yang, Chaoyou Fu, Xiang Li, Jian Yang, Ying Tai
2025CVPRVideo-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis.Chaoyou Fu, Yuhan Dai, Yongdong Luo, Lei Li, Shuhuai Ren, Renrui Zhang, Zihan Wang, Chenyu Zhou, Yunhang Shen, Mengdan Zhang, Peixian Chen, Yanwei Li, Shaohui Lin, Sirui Zhao, Ke Li, Tong Xu, Xiawu Zheng, Enhong Chen, Caifeng Shan, Ran He, Xing Sun
2025ICLRMME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?Yifan Zhang, Huanyu Zhang, Haochen Tian, Chaoyou Fu, Shuangqing Zhang, Junfei Wu, Feng Li, Kun Wang, Qingsong Wen, Zhang Zhang, Liang Wang, Rong Jin
2025ICLRLearning Interleaved Image-Text Comprehension in Vision-Language Large Models.Chenyu Zhou, Mengdan Zhang, Peixian Chen, Chaoyou Fu, Yunhang Shen, Xiawu Zheng, Xing Sun, Rongrong Ji
2025ICMLMM-RLHF: The Next Step Forward in Multimodal LLM Alignment.Yifan Zhang, Tao Yu, Haochen Tian, Chaoyou Fu, Peiyan Li, Jianshu Zeng, Wulin Xie, Yang Shi, Huanyu Zhang, Junkang Wu, Xue Wang, Yibo Hu, Bin Wen, Tingting Gao, Zhang Zhang, Fan Yang, Di Zhang, Liang Wang, Rong Jin
2025ICMLMME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency.Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanwei Li, Yu Qi, Xinyan Chen, Liuhui Wang, Jianhan Jin, Claire Guo, Shen Yan, Bo Zhang, Chaoyou Fu, Peng Gao, Hongsheng Li
2025ICMLFreeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM.Xiong Wang, Yangze Li, Chaoyou Fu, Yike Zhang, Yunhang Shen, Lei Xie, Ke Li, Xing Sun, Long Ma
2024CVPRAligning and Prompting Everything All at Once for Universal Visual Perception.Yunhang Shen, Chaoyou Fu, Peixian Chen, Mengdan Zhang, Ke Li, Xing Sun, Yunsheng Wu, Shaohui Lin, Rongrong Ji
2024CVPRNo Time to Train: Empowering Non-Parametric Networks for Few-Shot 3D Scene Segmentation.Xiangyang Zhu, Renrui Zhang, Bowei He, Ziyu Guo, Jiaming Liu, Han Xiao, Chaoyou Fu, Hao Dong, Peng Gao
2022CVPRRethinking Image Cropping: Exploring Diverse Compositions from Global Views.Gengyun Jia, Huaibo Huang, Chaoyou Fu, Ran He
2021CVPRInformation Bottleneck Disentanglement for Identity Swapping.Gege Gao, Huaibo Huang, Chaoyou Fu, Zhaoyang Li, Ran He
2021CVPRPareidolia Face Reenactment.Linsen Song, Wayne Wu, Chaoyou Fu, Chen Qian, Chen Change Loy, Ran He
2021ICCVCM-NAS: Cross-Modality Neural Architecture Search for Visible-Infrared Person Re-Identification.Chaoyou Fu, Yibo Hu, Xiang Wu, Hailin Shi, Tao Mei, Ran He
2020CVPRCross-Spectral Face Hallucination via Disentangling Independent Factors.Boyan Duan, Chaoyou Fu, Yi Li, Xingguang Song, Ran He
2019IJCAINeurons Merging Layer: Towards Progressive Redundancy Reduction for Deep Supervised Hashing.Chaoyou Fu, Liangchen Song, Xiang Wu, Guoli Wang, Ran He