Haiyang Xu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
53
Venues
20
Active years
2007–2026
Best venue rank
A*
Where they publish
Papers
53 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Efficient and Effective In-context Demonstration Selection with Coreset. | Zihua Wang, Jiarui Wang, Haiyang Xu, Ming Yan, Fei Huang, Xu Yang, Xiu-Shen Wei, Siya Mi, Yu Zhang |
| 2026 | ACL | AgentOCR: Reimagining Agent History via Optical Self-Compression. | Lang Feng, Fuchao Yang, Feng Chen, Xin Cheng, Haiyang Xu, Zhenglin Wan, Ming Yan, Bo An |
| 2026 | ACL | Experience-driven Multi-turn Reinforcement Learning for GUI Agents. | Zhengxi Lu, Jiabo Ye, Fei Tang, Yongliang Shen, Haiyang Xu, Ziwei Zheng, Weiming Lu, Ming Yan, Fei Huang, Jun Xiao, Yueting Zhuang |
| 2026 | CHI | MagHeart: Exploring Playful Avatar Co-Creation and Shared Heartbeats for Icebreaking in Hybrid Meetings. | Black Sun, Haiyang Xu, Ge Kacy Fu, Liyue Da, Eve E. Hoggan |
| 2026 | WACV | CVP: Central-Peripheral Vision-Inspired Multimodal Model for Spatial Reasoning. | Zeyuan Chen, Xiang Zhang, Haiyang Xu, Jianwen Xie, Zhuowen Tu |
| 2025 | ACL | mPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding. | Anwen Hu, Haiyang Xu, Liang Zhang, Jiabo Ye, Ming Yan, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou |
| 2025 | CHI | Demonstration of BIOral: Fabricating Intraoral pH Sensor for Continuous Health Monitoring. | Yijing Jiang, Junzhe Jin, Yunhui Song, Haiyang Xu, Michael Wessely |
| 2025 | CVPR | SymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Preference Optimization. | Hongrui Jia, Chaoya Jiang, Haiyang Xu, Wei Ye, Mengfan Dong, Ming Yan, Ji Zhang, Fei Huang, Shikun Zhang |
| 2025 | CVPR | Science-T2I: Addressing Scientific Illusions in Image Synthesis. | Jialuo Li, Wenhao Chai, Xingyu Fu, Haiyang Xu, Saining Xie |
| 2025 | ICCV | YOLO-Count: Differentiable Object Counting for Text-to-Image Generation. | Guanning Zeng, Xiang Zhang, Zirui Wang, Haiyang Xu, Zeyuan Chen, Bingnan Li, Zhuowen Tu |
| 2025 | ICCV | DepR: Depth Guided Single-View Scene Reconstruction with Instance-Level Diffusion. | Qingcheng Zhao, Xiang Zhang, Haiyang Xu, Zeyuan Chen, Jianwen Xie, Yuan Gao, Zhuowen Tu |
| 2025 | ICLR | mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models. | Jiabo Ye, Haiyang Xu, Haowei Liu, Anwen Hu, Ming Yan, Qi Qian, Ji Zhang, Fei Huang, Jingren Zhou |
| 2025 | ICLR | Endowing Visual Reprogramming with Adversarial Robustness. | Shengjie Zhou, Xin Cheng, Haiyang Xu, Ming Yan, Tao Xiang, Feng Liu, Lei Feng |
| 2025 | ICML | Towards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning. | Lang Feng, Weihao Tan, Zhiyi Lyu, Longtao Zheng, Haiyang Xu, Ming Yan, Fei Huang, Bo An |
| 2025 | ICML | Exploiting Presentative Feature Distributions for Parameter-Efficient Continual Learning of Large Language Models. | Xin Cheng, Jiabo Ye, Haiyang Xu, Ming Yan, Ji Zhang, Feng Liu, Fei Huang, Lei Feng |
| 2024 | AAAI | TiMix: Text-Aware Image Mixing for Effective Vision-Language Pre-training. | Chaoya Jiang, Wei Ye, Haiyang Xu, Qinghao Ye, Ming Yan, Ji Zhang, Shikun Zhang |
| 2024 | COLING | Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training. | Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu |
| 2024 | COLING | Unifying Latent and Lexicon Representations for Effective Video-Text Retrieval. | Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu |
| 2024 | CVPR | Hallucination Augmented Contrastive Learning for Multimodal Large Language Model. | Chaoya Jiang, Haiyang Xu, Mengfan Dong, Jiaxing Chen, Wei Ye, Ming Yan, Qinghao Ye, Ji Zhang, Fei Huang, Shikun Zhang |
| 2024 | CVPR | OmniControlNet: Dual-stage Integration for Conditional Image Generation. | Yilin Wang, Haiyang Xu, Xiang Zhang, Zeyuan Chen, Zhizhou Sha, Zirui Wang, Zhuowen Tu |
| 2024 | CVPR | Bayesian Diffusion Models for 3D Shape Reconstruction. | Haiyang Xu, Yu Lei, Zeyuan Chen, Xiang Zhang, Yue Zhao, Yilin Wang, Zhuowen Tu |
| 2024 | CVPR | mPLUG-OwI2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration. | Qinghao Ye, Haiyang Xu, Jiabo Ye, Ming Yan, Anwen Hu, Haowei Liu, Qi Qian, Ji Zhang, Fei Huang |
| 2024 | EMNLP | mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding. | Anwen Hu, Haiyang Xu, Jiabo Ye, Ming Yan, Liang Zhang, Bo Zhang, Ji Zhang, Qin Jin, Fei Huang, Jingren Zhou |
| 2024 | EMNLP | MIBench: Evaluating Multimodal Large Language Models over Multiple Images. | Haowei Liu, Xi Zhang, Haiyang Xu, Yaya Shi, Chaoya Jiang, Ming Yan, Ji Zhang, Fei Huang, Chunfeng Yuan, Bing Li, Weiming Hu |
| 2024 | EMNLP | TinyChart: Efficient Chart Understanding with Program-of-Thoughts Learning and Visual Token Merging. | Liang Zhang, Anwen Hu, Haiyang Xu, Ming Yan, Yichen Xu, Qin Jin, Ji Zhang, Fei Huang |
| 2024 | EuroSys | Halflife: An Adaptive Flowlet-based Load Balancer with Fading Timeout in Data Center Networks. | Sen Liu, Yongbo Gao, Zixuan Chen, Jiarui Ye, Haiyang Xu, Furong Liang, Wei Yan, Zerui Tian, Quanwei Sun, Zehua Guo, Yang Xu |
| 2023 | ACL | Vision Language Pre-training by Contrastive Learning with Cross-Modal Similarity Regulation. | Chaoya Jiang, Wei Ye, Haiyang Xu, Songfang Huang, Fei Huang, Shikun Zhang |
| 2023 | ACL | Transforming Visual Scene Graphs to Image Captions. | Xu Yang, Jiawei Peng, Zihua Wang, Haiyang Xu, Qinghao Ye, Chenliang Li, Songfang Huang, Fei Huang, Zhangzikang Li, Yu Zhang |
| 2023 | ACL | Towards Adaptive Prefix Tuning for Parameter-Efficient Language Model Fine-tuning. | Zhenru Zhang, Chuanqi Tan, Haiyang Xu, Chengyu Wang, Jun Huang, Songfang Huang |
| 2023 | EMNLP | ModelScope-Agent: Building Your Customizable Agent System with Open-source Large Language Models. | Chenliang Li, He Chen, Ming Yan, Weizhou Shen, Haiyang Xu, Zhikai Wu, Zhicheng Zhang, Wenmeng Zhou, Yingda Chen, Chen Cheng, Hongzhu Shi, Ji Zhang, Fei Huang, Jingren Zhou |
| 2023 | EMNLP | UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model. | Jiabo Ye, Anwen Hu, Haiyang Xu, Qinghao Ye, Ming Yan, Guohai Xu, Chenliang Li, Junfeng Tian, Qi Qian, Ji Zhang, Qin Jin, Liang He, Xin Lin, Fei Huang |
| 2023 | ICCV | BUS : Efficient and Effective Vision-language Pre-training with Bottom-Up Patch Summarization. | Chaoya Jiang, Haiyang Xu, Wei Ye, Qinghao Ye, Chenliang Li, Ming Yan, Bin Bi, Shikun Zhang, Fei Huang, Songfang Huang |
| 2023 | ICCV | Learning Trajectory-Word Alignments for Video-Language Tasks. | Xu Yang, Zhangzikang Li, Haiyang Xu, Hanwang Zhang, Qinghao Ye, Chenliang Li, Ming Yan, Yu Zhang, Fei Huang, Songfang Huang |
| 2023 | ICCV | HiTeA: Hierarchical Temporal-Aware Video-Language Pre-training. | Qinghao Ye, Guohai Xu, Ming Yan, Haiyang Xu, Qi Qian, Ji Zhang, Fei Huang |
| 2023 | ICML | mPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video. | Haiyang Xu, Qinghao Ye, Ming Yan, Yaya Shi, Jiabo Ye, Yuanhong Xu, Chenliang Li, Bin Bi, Qi Qian, Wei Wang, Guohai Xu, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou |
| 2023 | IJCAI | Curriculum Multi-Level Learning for Imbalanced Live-Stream Recommendation. | Shuodian Yu, Junqi Jin, Li Ma, Xiaofeng Gao, Xiaopeng Wu, Haiyang Xu, Jian Xu |
| 2022 | CIKM | Control-based Bidding for Mobile Livestreaming Ads with Exposure Guarantee. | Haoqi Zhang, Junqi Jin, Zhenzhe Zheng, Fan Wu, Haiyang Xu, Jian Xu |
| 2022 | CVPR | EMScore: Evaluating Video Captioning via Coarse-Grained and Fine-Grained Embedding Matching. | Yaya Shi, Xu Yang, Haiyang Xu, Chunfeng Yuan, Bing Li, Weiming Hu, Zheng-Jun Zha |
| 2022 | EMNLP | TRIPS: Efficient Vision-and-Language Pre-training with Text-Relevant Image Patch Selection. | Chaoya Jiang, Haiyang Xu, Chenliang Li, Ming Yan, Wei Ye, Shikun Zhang, Bin Bi, Songfang Huang |
| 2022 | EMNLP | mPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections. | Chenliang Li, Haiyang Xu, Junfeng Tian, Wei Wang, Ming Yan, Bin Bi, Jiabo Ye, He Chen, Guohai Xu, Zheng Cao, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou, Luo Si |
| 2021 | ACL | E2E-VLP: End-to-End Vision-Language Pre-training Enhanced by Visual Learning. | Haiyang Xu, Ming Yan, Chenliang Li, Bin Bi, Songfang Huang, Wenming Xiao, Fei Huang |
| 2021 | IPCCC | Multi-objective Dynamic Auction Mechanism for Online Advertising. | Yiqing Wang, Junqi Jin, Zhenzhe Zheng, Haiyang Xu, Fan Wu, Yuning Jiang, Guihai Chen |
| 2021 | KDD | We Know What You Want: An Advertising Strategy Recommender System for Online Advertising. | Liyi Guo, Junqi Jin, Haoqi Zhang, Zhenzhe Zheng, Zhiye Yang, Zhizhuang Xing, Fei Pan, Lvyin Niu, Fan Wu, Haiyang Xu, Chuan Yu, Yuning Jiang, Xiaoqiang Zhu |
| 2020 | ACL | Neural Topic Modeling with Bidirectional Adversarial Training. | Rui Wang, Xuemeng Hu, Deyu Zhou, Yulan He, Yuxuan Xiong, Chenchen Ye, Haiyang Xu |
| 2020 | CIKM | A Deep Prediction Network for Understanding Advertiser Intent and Satisfaction. | Liyi Guo, Rui Lu, Haoqi Zhang, Junqi Jin, Zhenzhe Zheng, Fan Wu, Jin Li, Haiyang Xu, Han Li, Wenkai Lu, Jian Xu, Kun Gai |
| 2020 | CIKM | Learning to Infer User Hidden States for Online Sequential Advertising. | Zhaoqing Peng, Junqi Jin, Lan Luo, Yaodong Yang, Rui Luo, Jun Wang, Weinan Zhang, Haiyang Xu, Miao Xu, Chuan Yu, Tiejian Luo, Han Li, Jian Xu, Kun Gai |
| 2020 | ICASSP | Selective Attention Encoders by Syntactic Graph Convolutional Networks for Document Summarization. | Haiyang Xu, Yun Wang, Kun Han, Baochang Ma, Junwen Chen, Xiangang Li |
| 2019 | ICDM | NVSRN: A Neural Variational Scaling Reasoning Network for Initiative Response Generation. | Jinxin Chang, Ruifang He, Haiyang Xu, Kun Han, Longbiao Wang, Xiangang Li, Jianwu Dang |
| 2019 | IJCNN | Learning Syntactic and Dynamic Selective Encoding for Document Summarization. | Haiyang Xu, Yahao He, Kun Han, Junwen Chen, Xiangang Li |
| 2019 | Interspeech | Learning Alignment for Multimodal Emotion Recognition from Speech. | Haiyang Xu, Hui Zhang, Kun Han, Yun Wang, Yiping Peng, Xiangang Li |
| 2016 | IJCAI | Unsupervised Storyline Extraction from News Articles. | Deyu Zhou, Haiyang Xu, Xin-Yu Dai, Yulan He |
| 2015 | EMNLP | An Unsupervised Bayesian Modelling Approach for Storyline Detection on News Articles. | Deyu Zhou, Haiyang Xu, Yulan He |
| 2007 | SNPD | Probabilistic Logic Operator based on Zero-order N/T-Norms Complete Clusters. | Haiyang Xu, Wenshan Cui, Ping Wang |