Skip to content

Haiyang Xu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

53

Venues

20

Active years

2007–2026

Best venue rank

A*

Where they publish

Papers

53 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIEfficient and Effective In-context Demonstration Selection with Coreset.Zihua Wang, Jiarui Wang, Haiyang Xu, Ming Yan, Fei Huang, Xu Yang, Xiu-Shen Wei, Siya Mi, Yu Zhang
2026ACLAgentOCR: Reimagining Agent History via Optical Self-Compression.Lang Feng, Fuchao Yang, Feng Chen, Xin Cheng, Haiyang Xu, Zhenglin Wan, Ming Yan, Bo An
2026ACLExperience-driven Multi-turn Reinforcement Learning for GUI Agents.Zhengxi Lu, Jiabo Ye, Fei Tang, Yongliang Shen, Haiyang Xu, Ziwei Zheng, Weiming Lu, Ming Yan, Fei Huang, Jun Xiao, Yueting Zhuang
2026CHIMagHeart: Exploring Playful Avatar Co-Creation and Shared Heartbeats for Icebreaking in Hybrid Meetings.Black Sun, Haiyang Xu, Ge Kacy Fu, Liyue Da, Eve E. Hoggan
2026WACVCVP: Central-Peripheral Vision-Inspired Multimodal Model for Spatial Reasoning.Zeyuan Chen, Xiang Zhang, Haiyang Xu, Jianwen Xie, Zhuowen Tu
2025ACLmPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding.Anwen Hu, Haiyang Xu, Liang Zhang, Jiabo Ye, Ming Yan, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou
2025CHIDemonstration of BIOral: Fabricating Intraoral pH Sensor for Continuous Health Monitoring.Yijing Jiang, Junzhe Jin, Yunhui Song, Haiyang Xu, Michael Wessely
2025CVPRSymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Preference Optimization.Hongrui Jia, Chaoya Jiang, Haiyang Xu, Wei Ye, Mengfan Dong, Ming Yan, Ji Zhang, Fei Huang, Shikun Zhang
2025CVPRScience-T2I: Addressing Scientific Illusions in Image Synthesis.Jialuo Li, Wenhao Chai, Xingyu Fu, Haiyang Xu, Saining Xie
2025ICCVYOLO-Count: Differentiable Object Counting for Text-to-Image Generation.Guanning Zeng, Xiang Zhang, Zirui Wang, Haiyang Xu, Zeyuan Chen, Bingnan Li, Zhuowen Tu
2025ICCVDepR: Depth Guided Single-View Scene Reconstruction with Instance-Level Diffusion.Qingcheng Zhao, Xiang Zhang, Haiyang Xu, Zeyuan Chen, Jianwen Xie, Yuan Gao, Zhuowen Tu
2025ICLRmPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models.Jiabo Ye, Haiyang Xu, Haowei Liu, Anwen Hu, Ming Yan, Qi Qian, Ji Zhang, Fei Huang, Jingren Zhou
2025ICLREndowing Visual Reprogramming with Adversarial Robustness.Shengjie Zhou, Xin Cheng, Haiyang Xu, Ming Yan, Tao Xiang, Feng Liu, Lei Feng
2025ICMLTowards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning.Lang Feng, Weihao Tan, Zhiyi Lyu, Longtao Zheng, Haiyang Xu, Ming Yan, Fei Huang, Bo An
2025ICMLExploiting Presentative Feature Distributions for Parameter-Efficient Continual Learning of Large Language Models.Xin Cheng, Jiabo Ye, Haiyang Xu, Ming Yan, Ji Zhang, Feng Liu, Fei Huang, Lei Feng
2024AAAITiMix: Text-Aware Image Mixing for Effective Vision-Language Pre-training.Chaoya Jiang, Wei Ye, Haiyang Xu, Qinghao Ye, Ming Yan, Ji Zhang, Shikun Zhang
2024COLINGSemantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training.Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu
2024COLINGUnifying Latent and Lexicon Representations for Effective Video-Text Retrieval.Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu
2024CVPRHallucination Augmented Contrastive Learning for Multimodal Large Language Model.Chaoya Jiang, Haiyang Xu, Mengfan Dong, Jiaxing Chen, Wei Ye, Ming Yan, Qinghao Ye, Ji Zhang, Fei Huang, Shikun Zhang
2024CVPROmniControlNet: Dual-stage Integration for Conditional Image Generation.Yilin Wang, Haiyang Xu, Xiang Zhang, Zeyuan Chen, Zhizhou Sha, Zirui Wang, Zhuowen Tu
2024CVPRBayesian Diffusion Models for 3D Shape Reconstruction.Haiyang Xu, Yu Lei, Zeyuan Chen, Xiang Zhang, Yue Zhao, Yilin Wang, Zhuowen Tu
2024CVPRmPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration.Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang
2024EMNLPmPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding.Anwen Hu, Haiyang Xu, Jiabo Ye, Ming Yan, Liang Zhang, Bo Zhang, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou
2024EMNLPMIBench: Evaluating Multimodal Large Language Models over Multiple Images.Haowei Liu, Xi Zhang, Haiyang Xu, Yaya Shi, Chaoya Jiang, Ming Yan, Ji Zhang, Fei Huang, Chunfeng Yuan, Bing Li, Weiming Hu
2024EMNLPTinyChart: Efficient Chart Understanding with Program-of-Thoughts Learning and Visual Token Merging.Liang Zhang, Anwen Hu, Haiyang Xu, Ming Yan, Yichen Xu, Qin Jin, Ji Zhang, Fei Huang
2024EuroSysHalflife: An Adaptive Flowlet-based Load Balancer with Fading Timeout in Data Center Networks.Sen Liu, Yongbo Gao, Zixuan Chen, Jiarui Ye, Haiyang Xu, Furong Liang, Wei Yan, Zerui Tian, Quanwei Sun, Zehua Guo, Yang Xu
2023ACLVision Language Pre-training by Contrastive Learning with Cross-Modal Similarity Regulation.Chaoya Jiang, Wei Ye, Haiyang Xu, Songfang Huang, Fei Huang, Shikun Zhang
2023ACLTransforming Visual Scene Graphs to Image Captions.Xu Yang, Jiawei Peng, Zihua Wang, Haiyang Xu, Qinghao Ye, Chenliang Li, Songfang Huang, Fei Huang, Zhangzikang Li, Yu Zhang
2023ACLTowards Adaptive Prefix Tuning for Parameter-Efficient Language Model Fine-tuning.Zhenru Zhang, Chuanqi Tan, Haiyang Xu, Chengyu Wang, Jun Huang, Songfang Huang
2023EMNLPModelScope-Agent: Building Your Customizable Agent System with Open-source Large Language Models.Chenliang Li, He Chen, Ming Yan, Weizhou Shen, Haiyang Xu, Zhikai Wu, Zhicheng Zhang, Wenmeng Zhou, Yingda Chen, Chen Cheng, Hongzhu Shi, Ji Zhang, Fei Huang, Jingren Zhou
2023EMNLPUReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model.Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang
2023ICCVBUS : Efficient and Effective Vision-language Pre-training with Bottom-Up Patch Summarization.Chaoya Jiang, Haiyang Xu, Wei Ye, Qinghao Ye, Chenliang Li, Ming Yan, Bin Bi, Shikun Zhang, Fei Huang, Songfang Huang
2023ICCVLearning Trajectory-Word Alignments for Video-Language Tasks.Xu Yang, Zhangzikang Li, Haiyang Xu, Hanwang Zhang, Qinghao Ye, Chenliang Li, Ming Yan, Yu Zhang, Fei Huang, Songfang Huang
2023ICCVHiTeA: Hierarchical Temporal-Aware Video-Language Pre-training.Qinghao Ye, Guohai Xu, Ming Yan, Haiyang Xu, Qi Qian, Ji Zhang, Fei Huang
2023ICMLmPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video.Haiyang Xu, Qinghao Ye, Ming Yan, Yaya Shi, Jiabo Ye, Yuanhong Xu, Chenliang Li, Bin Bi, Qi Qian, Wei Wang, Guohai Xu, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou
2023IJCAICurriculum Multi-Level Learning for Imbalanced Live-Stream Recommendation.Shuodian Yu, Junqi Jin, Li Ma, Xiaofeng Gao, Xiaopeng Wu, Haiyang Xu, Jian Xu
2022CIKMControl-based Bidding for Mobile Livestreaming Ads with Exposure Guarantee.Haoqi Zhang, Junqi Jin, Zhenzhe Zheng, Fan Wu, Haiyang Xu, Jian Xu
2022CVPREMScore: Evaluating Video Captioning via Coarse-Grained and Fine-Grained Embedding Matching.Yaya Shi, Xu Yang, Haiyang Xu, Chunfeng Yuan, Bing Li, Weiming Hu, Zheng-Jun Zha
2022EMNLPTRIPS: Efficient Vision-and-Language Pre-training with Text-Relevant Image Patch Selection.Chaoya Jiang, Haiyang Xu, Chenliang Li, Ming Yan, Wei Ye, Shikun Zhang, Bin Bi, Songfang Huang
2022EMNLPmPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections.Chenliang Li, Haiyang Xu, Junfeng Tian, Wei Wang, Ming Yan, Bin Bi, Jiabo Ye, He Chen, Guohai Xu, Zheng Cao, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou, Luo Si
2021ACLE2E-VLP: End-to-End Vision-Language Pre-training Enhanced by Visual Learning.Haiyang Xu, Ming Yan, Chenliang Li, Bin Bi, Songfang Huang, Wenming Xiao, Fei Huang
2021IPCCCMulti-objective Dynamic Auction Mechanism for Online Advertising.Yiqing Wang, Junqi Jin, Zhenzhe Zheng, Haiyang Xu, Fan Wu, Yuning Jiang, Guihai Chen
2021KDDWe Know What You Want: An Advertising Strategy Recommender System for Online Advertising.Liyi Guo, Junqi Jin, Haoqi Zhang, Zhenzhe Zheng, Zhiye Yang, Zhizhuang Xing, Fei Pan, Lvyin Niu, Fan Wu, Haiyang Xu, Chuan Yu, Yuning Jiang, Xiaoqiang Zhu
2020ACLNeural Topic Modeling with Bidirectional Adversarial Training.Rui Wang, Xuemeng Hu, Deyu Zhou, Yulan He, Yuxuan Xiong, Chenchen Ye, Haiyang Xu
2020CIKMA Deep Prediction Network for Understanding Advertiser Intent and Satisfaction.Liyi Guo, Rui Lu, Haoqi Zhang, Junqi Jin, Zhenzhe Zheng, Fan Wu, Jin Li, Haiyang Xu, Han Li, Wenkai Lu, Jian Xu, Kun Gai
2020CIKMLearning to Infer User Hidden States for Online Sequential Advertising.Zhaoqing Peng, Junqi Jin, Lan Luo, Yaodong Yang, Rui Luo, Jun Wang, Weinan Zhang, Haiyang Xu, Miao Xu, Chuan Yu, Tiejian Luo, Han Li, Jian Xu, Kun Gai
2020ICASSPSelective Attention Encoders by Syntactic Graph Convolutional Networks for Document Summarization.Haiyang Xu, Yun Wang, Kun Han, Baochang Ma, Junwen Chen, Xiangang Li
2019ICDMNVSRN: A Neural Variational Scaling Reasoning Network for Initiative Response Generation.Jinxin Chang, Ruifang He, Haiyang Xu, Kun Han, Longbiao Wang, Xiangang Li, Jianwu Dang
2019IJCNNLearning Syntactic and Dynamic Selective Encoding for Document Summarization.Haiyang Xu, Yahao He, Kun Han, Junwen Chen, Xiangang Li
2019InterspeechLearning Alignment for Multimodal Emotion Recognition from Speech.Haiyang Xu, Hui Zhang, Kun Han, Yun Wang, Yiping Peng, Xiangang Li
2016IJCAIUnsupervised Storyline Extraction from News Articles.Deyu Zhou, Haiyang Xu, Xin-Yu Dai, Yulan He
2015EMNLPAn Unsupervised Bayesian Modelling Approach for Storyline Detection on News Articles.Deyu Zhou, Haiyang Xu, Yulan He
2007SNPDProbabilistic Logic Operator based on Zero-order N/T-Norms Complete Clusters.Haiyang Xu, Wenshan Cui, Ping Wang