Chaoyou Fu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
17
Venues
7
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
17 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | QuoTA: Query-oriented Token Assignment via CoT Query Decouple for Long Video Comprehension. | Yongdong Luo, Wang Chen, Weizhong Huang, Shukang Yin, Haojia Lin, Jinfa Huang, Chaoyou Fu, Jiayi Ji, Xiawu Zheng, Jiebo Luo |
| 2026 | ACL | Scaling Law for Multimodal Large Language Model Supervised Fine-Tuning. | Yifan Zhang, Tao Yu, Feng Li, Chaoyou Fu, Yibo Hu, Kun Wang, Qingsong Wen, Zhang Zhang, Liang Wang, Rong Jin |
| 2025 | CVPR | InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption. | Tiehan Fan, Kepan Nan, Rui Xie, Penghao Zhou, Zhenheng Yang, Chaoyou Fu, Xiang Li, Jian Yang, Ying Tai |
| 2025 | CVPR | Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis. | Chaoyou Fu, Yuhan Dai, Yongdong Luo, Lei Li, Shuhuai Ren, Renrui Zhang, Zihan Wang, Chenyu Zhou, Yunhang Shen, Mengdan Zhang, Peixian Chen, Yanwei Li, Shaohui Lin, Sirui Zhao, Ke Li, Tong Xu, Xiawu Zheng, Enhong Chen, Caifeng Shan, Ran He, Xing Sun |
| 2025 | ICLR | MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans? | Yifan Zhang, Huanyu Zhang, Haochen Tian, Chaoyou Fu, Shuangqing Zhang, Junfei Wu, Feng Li, Kun Wang, Qingsong Wen, Zhang Zhang, Liang Wang, Rong Jin |
| 2025 | ICLR | Learning Interleaved Image-Text Comprehension in Vision-Language Large Models. | Chenyu Zhou, Mengdan Zhang, Peixian Chen, Chaoyou Fu, Yunhang Shen, Xiawu Zheng, Xing Sun, Rongrong Ji |
| 2025 | ICML | MM-RLHF: The Next Step Forward in Multimodal LLM Alignment. | Yifan Zhang, Tao Yu, Haochen Tian, Chaoyou Fu, Peiyan Li, Jianshu Zeng, Wulin Xie, Yang Shi, Huanyu Zhang, Junkang Wu, Xue Wang, Yibo Hu, Bin Wen, Tingting Gao, Zhang Zhang, Fan Yang, Di Zhang, Liang Wang, Rong Jin |
| 2025 | ICML | MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency. | Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanwei Li, Yu Qi, Xinyan Chen, Liuhui Wang, Jianhan Jin, Claire Guo, Shen Yan, Bo Zhang, Chaoyou Fu, Peng Gao, Hongsheng Li |
| 2025 | ICML | Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM. | Xiong Wang, Yangze Li, Chaoyou Fu, Yike Zhang, Yunhang Shen, Lei Xie, Ke Li, Xing Sun, Long Ma |
| 2024 | CVPR | Aligning and Prompting Everything All at Once for Universal Visual Perception. | Yunhang Shen, Chaoyou Fu, Peixian Chen, Mengdan Zhang, Ke Li, Xing Sun, Yunsheng Wu, Shaohui Lin, Rongrong Ji |
| 2024 | CVPR | No Time to Train: Empowering Non-Parametric Networks for Few-Shot 3D Scene Segmentation. | Xiangyang Zhu, Renrui Zhang, Bowei He, Ziyu Guo, Jiaming Liu, Han Xiao, Chaoyou Fu, Hao Dong, Peng Gao |
| 2022 | CVPR | Rethinking Image Cropping: Exploring Diverse Compositions from Global Views. | Gengyun Jia, Huaibo Huang, Chaoyou Fu, Ran He |
| 2021 | CVPR | Information Bottleneck Disentanglement for Identity Swapping. | Gege Gao, Huaibo Huang, Chaoyou Fu, Zhaoyang Li, Ran He |
| 2021 | CVPR | Pareidolia Face Reenactment. | Linsen Song, Wayne Wu, Chaoyou Fu, Chen Qian, Chen Change Loy, Ran He |
| 2021 | ICCV | CM-NAS: Cross-Modality Neural Architecture Search for Visible-Infrared Person Re-Identification. | Chaoyou Fu, Yibo Hu, Xiang Wu, Hailin Shi, Tao Mei, Ran He |
| 2020 | CVPR | Cross-Spectral Face Hallucination via Disentangling Independent Factors. | Boyan Duan, Chaoyou Fu, Yi Li, Xingguang Song, Ran He |
| 2019 | IJCAI | Neurons Merging Layer: Towards Progressive Redundancy Reduction for Deep Supervised Hashing. | Chaoyou Fu, Liangchen Song, Xiang Wu, Guoli Wang, Ran He |