Haoyu Cao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
11
Venues
8
Active years
2022–2026
Best venue rank
A*
Where they publish
Papers
11 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Frequency-Aligned Cross-Modal Learning with Top-K Wavelet Fusion and Dynamic Expert Routing for Enhanced Retinal Disease Diagnosis. | Yuxin Lin, Haoran Li, Haoyu Cao, Yongting Hu, Qihao Xu, Chengliang Liu, Xiaoling Luo, Zhihao Wu, Yong Xu, Wei Wang |
| 2026 | AAAI | Multimodal Table Understanding with Difficulty-aware Reinforcement Learning. | Chaohu Liu, Haoyu Cao, YongXiang Hua, Linli Xu |
| 2025 | ICCV | BASIC: Boosting Visual Alignment with Intrinsic Refined Embeddings in Multimodal Large Language Models. | Jianting Tang, Yubo Wang, Haoyu Cao, Linli Xu |
| 2024 | ACCV | HDNeXt: Hybrid Dynamic MedNeXt with Level Set Regularization for Medical Image Segmentation. | Haoyu Cao, Tianyi Han, Yunyun Yang |
| 2024 | ACL | Talk With Human-like Agents: Empathetic Dialogue Through Perceptible Acoustic Reception and Reaction. | Haoqiu Yan, Yongxin Zhu, Kai Zheng, Bing Liu, Haoyu Cao, Deqiang Jiang, Linli Xu |
| 2024 | COLING | Few-shot Temporal Pruning Accelerates Diffusion Models for Text Generation. | Bocheng Li, Zhujin Gao, Yongxin Zhu, Kun Yin, Haoyu Cao, Deqiang Jiang, Linli Xu |
| 2024 | CVPR | HRVDA: High-Resolution Visual Document Assistant. | Chaohu Liu, Kun Yin, Haoyu Cao, Xinghua Jiang, Xin Li, Yinsong Liu, Deqiang Jiang, Xing Sun, Linli Xu |
| 2024 | CVPR | Enhancing Visual Document Understanding with Contrastive Learning in Large Visual-Language Models. | Xin Li, Yunfei Wu, Xinghua Jiang, Zhihao Guo, Mingming Gong, Haoyu Cao, Yinsong Liu, Deqiang Jiang, Xing Sun |
| 2023 | ICCV | Attention Where It Matters: Rethinking Visual Document Understanding with Selective Region Concentration. | Haoyu Cao, Changcun Bao, Chaohu Liu, Huang Chen, Kun Yin, Hao Liu, Yinsong Liu, Deqiang Jiang, Xing Sun |
| 2023 | ICDAR | ICDAR 2023 Competition on Structured Text Extraction from Visually-Rich Document Images. | Wenwen Yu, Chengquan Zhang, Haoyu Cao, Wei Hua, Bohan Li, Huang Chen, Mingyu Liu, Mingrui Chen, Jianfeng Kuang, Mengjun Cheng, Yuning Du, Shikun Feng, Xiaoguang Hu, Pengyuan Lyu, Kun Yao, Yuechen Yu, Yuliang Liu, Wanxiang Che, Errui Ding, Cheng-Lin Liu, Jiebo Luo, Shuicheng Yan, Min Zhang, Dimosthenis Karatzas, Xing Sun, Jingdong Wang, Xiang Bai |
| 2022 | NAACL | GMN: Generative Multi-modal Network for Practical Document Information Extraction. | Haoyu Cao, Jiefeng Ma, Antai Guo, Yiqing Hu, Hao Liu, Deqiang Jiang, Yinsong Liu, Bo Ren |