| 2026 | AAAI | UVLM: Benchmarking Video Language Model for Underwater World Understanding. | Xizhe Xue, Yang Zhou, Dawei Yan, Lijie Tao, Junjie Li, Ying Li, Haokui Zhang, Rong Xiao |
| 2025 | AAAI | TG-LLaVA: Text Guided LLaVA via Learnable Latent Embeddings. | Dawei Yan, Pengcheng Li, Yang Li, Hao Chen, Qingguo Chen, Weihua Luo, Wei Dong, Qingsen Yan, Haokui Zhang, Chunhua Shen |
| 2025 | CVPR | NN-Former: Rethinking Graph Structure in Neural Architecture Representation. | Ruihan Xu, Haokui Zhang, Yaowei Wang, Wei Zeng, Shiliang Zhang |
| 2025 | ICCV | Efficient Adaptation of Pre-Trained Vision Transformer Underpinned by Approximately Orthogonal Fine-Tuning Strategy. | Yiting Yang, Hao Luo, Yuan Sun, Qingsen Yan, Haokui Zhang, Wei Dong, Guoqing Wang, Peng Wang, Yang Yang, Hengtao Shen |
| 2023 | CVPR | NAR-Former: Neural Architecture Representation Learning Towards Holistic Attributes Prediction. | Yun Yi, Haokui Zhang, Wenze Hu, Nannan Wang, Xiaoyu Wang |
| 2023 | ICCV | ParCNetV2: Oversized Kernel with Enhanced Attention | Ruihan Xu, Haokui Zhang, Wenze Hu, Shiliang Zhang, Xiaoyu Wang |
| 2023 | ICCV | Fcaformer: Forward Cross Attention in Hybrid Vision Transformer. | Haokui Zhang, Wenze Hu, Xiaoyu Wang |
| 2022 | ECCV | ParC-Net: Position Aware Circular Convolution with Merits from ConvNets and Transformer. | Haokui Zhang, Wenze Hu, Xiaoyu Wang |
| 2022 | ECCV | Connecting Compression Spaces with Transformer for Approximate Nearest Neighbor Search. | Haokui Zhang, Buzhou Tang, Wenze Hu, Xiaoyu Wang |
| 2020 | CVPR | Memory-Efficient Hierarchical Neural Architecture Search for Image Denoising. | Haokui Zhang, Ying Li, Hao Chen, Chunhua Shen |
| 2020 | IROS | Meta Learning with Differentiable Closed-form Solver for Fast Video Object Segmentation. | Yu Liu, Lingqiao Liu, Haokui Zhang, Hamid Rezatofighi, Qingsen Yan, Ian D. Reid |
| 2019 | ICCV | Exploiting Temporal Consistency for Real-Time Video Depth Estimation. | Haokui Zhang, Ying Li, Yuanzhouhan Cao, Yu Liu, Chunhua Shen, Youliang Yan |