Qinghao Ye
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
15
Venues
9
Active years
2021–2025
Best venue rank
A*
Where they publish
Papers
15 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | CVPR | LLaVA-Critic: Learning to Evaluate Multimodal Models. | Tianyi Xiong, Xiyao Wang, Dong Guo, Qinghao Ye, Haoqi Fan, Quanquan Gu, Heng Huang, Chunyuan Li |
| 2025 | ICLR | Painting with Words: Elevating Detailed Image Captioning with Benchmark and Alignment Learning. | Qinghao Ye, Xianhan Zeng, Fu Li, Chunyuan Li, Haoqi Fan |
| 2024 | AAAI | TiMix: Text-Aware Image Mixing for Effective Vision-Language Pre-training. | Chaoya Jiang, Wei Ye, Haiyang Xu, Qinghao Ye, Ming Yan, Ji Zhang, Shikun Zhang |
| 2024 | COLING | Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training. | Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu |
| 2024 | COLING | Unifying Latent and Lexicon Representations for Effective Video-Text Retrieval. | Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu |
| 2024 | CVPR | Hallucination Augmented Contrastive Learning for Multimodal Large Language Model. | Chaoya Jiang, Haiyang Xu, Mengfan Dong, Jiaxing Chen, Wei Ye, Ming Yan, Qinghao Ye, Ji Zhang, Fei Huang, Shikun Zhang |
| 2024 | CVPR | mPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration. | Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang |
| 2023 | ACL | Transforming Visual Scene Graphs to Image Captions. | Xu Yang, Jiawei Peng, Zihua Wang, Haiyang Xu, Qinghao Ye, Chenliang Li, Songfang Huang, Fei Huang, Zhangzikang Li, Yu Zhang |
| 2023 | EMNLP | UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model. | Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang |
| 2023 | ICCV | BUS : Efficient and Effective Vision-language Pre-training with Bottom-Up Patch Summarization. | Chaoya Jiang, Haiyang Xu, Wei Ye, Qinghao Ye, Chenliang Li, Ming Yan, Bin Bi, Shikun Zhang, Fei Huang, Songfang Huang |
| 2023 | ICCV | Learning Trajectory-Word Alignments for Video-Language Tasks. | Xu Yang, Zhangzikang Li, Haiyang Xu, Hanwang Zhang, Qinghao Ye, Chenliang Li, Ming Yan, Yu Zhang, Fei Huang, Songfang Huang |
| 2023 | ICCV | HiTeA: Hierarchical Temporal-Aware Video-Language Pre-training. | Qinghao Ye, Guohai Xu, Ming Yan, Haiyang Xu, Qi Qian, Ji Zhang, Fei Huang |
| 2023 | ICML | mPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video. | Haiyang Xu, Qinghao Ye, Ming Yan, Yaya Shi, Jiabo Ye, Yuanhong Xu, Chenliang Li, Bin Bi, Qi Qian, Wei Wang, Guohai Xu, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou |
| 2021 | CBMS | Explainable AI for COVID-19 CT Classifiers: An Initial Comparison Study. | Qinghao Ye, Jun Xia, Guang Yang |
| 2021 | ICCV | Temporal Cue Guided Video Highlight Detection with Low-Rank Audio-Visual Fusion. | Qinghao Ye, Xiyue Shen, Yuan Gao, Zirui Wang, Qi Bi, Ping Li, Guang Yang |