Skip to content

Qinghao Ye

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

15

Venues

9

Active years

2021–2025

Best venue rank

A*

Where they publish

Papers

15 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRLLaVA-Critic: Learning to Evaluate Multimodal Models.Tianyi Xiong, Xiyao Wang, Dong Guo, Qinghao Ye, Haoqi Fan, Quanquan Gu, Heng Huang, Chunyuan Li
2025ICLRPainting with Words: Elevating Detailed Image Captioning with Benchmark and Alignment Learning.Qinghao Ye, Xianhan Zeng, Fu Li, Chunyuan Li, Haoqi Fan
2024AAAITiMix: Text-Aware Image Mixing for Effective Vision-Language Pre-training.Chaoya Jiang, Wei Ye, Haiyang Xu, Qinghao Ye, Ming Yan, Ji Zhang, Shikun Zhang
2024COLINGSemantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training.Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu
2024COLINGUnifying Latent and Lexicon Representations for Effective Video-Text Retrieval.Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu
2024CVPRHallucination Augmented Contrastive Learning for Multimodal Large Language Model.Chaoya Jiang, Haiyang Xu, Mengfan Dong, Jiaxing Chen, Wei Ye, Ming Yan, Qinghao Ye, Ji Zhang, Fei Huang, Shikun Zhang
2024CVPRmPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration.Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang
2023ACLTransforming Visual Scene Graphs to Image Captions.Xu Yang, Jiawei Peng, Zihua Wang, Haiyang Xu, Qinghao Ye, Chenliang Li, Songfang Huang, Fei Huang, Zhangzikang Li, Yu Zhang
2023EMNLPUReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model.Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang
2023ICCVBUS : Efficient and Effective Vision-language Pre-training with Bottom-Up Patch Summarization.Chaoya Jiang, Haiyang Xu, Wei Ye, Qinghao Ye, Chenliang Li, Ming Yan, Bin Bi, Shikun Zhang, Fei Huang, Songfang Huang
2023ICCVLearning Trajectory-Word Alignments for Video-Language Tasks.Xu Yang, Zhangzikang Li, Haiyang Xu, Hanwang Zhang, Qinghao Ye, Chenliang Li, Ming Yan, Yu Zhang, Fei Huang, Songfang Huang
2023ICCVHiTeA: Hierarchical Temporal-Aware Video-Language Pre-training.Qinghao Ye, Guohai Xu, Ming Yan, Haiyang Xu, Qi Qian, Ji Zhang, Fei Huang
2023ICMLmPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video.Haiyang Xu, Qinghao Ye, Ming Yan, Yaya Shi, Jiabo Ye, Yuanhong Xu, Chenliang Li, Bin Bi, Qi Qian, Wei Wang, Guohai Xu, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou
2021CBMSExplainable AI for COVID-19 CT Classifiers: An Initial Comparison Study.Qinghao Ye, Jun Xia, Guang Yang
2021ICCVTemporal Cue Guided Video Highlight Detection with Low-Rank Audio-Visual Fusion.Qinghao Ye, Xiyue Shen, Yuan Gao, Zirui Wang, Qi Bi, Ping Li, Guang Yang