| 2026 | WWW | Adaptive Task Balancing for Visual Instruction Tuning via Inter-Task Contribution and Intra-Task Difficulty. | Yanqi Dai, Yong Wang, Zebin You, Dong Jing, Xiangxiang Chu, Zhiwu Lu |
| 2025 | AAAI | Leveraging Large Vision-Language Model as User Intent-Aware Encoder for Composed Image Retrieval. | Zelong Sun, Dong Jing, Guoxing Yang, Nanyi Fei, Zhiwu Lu |
| 2025 | ICASSP | Enhancing Data-Free Class-Incremental Learning via Image-Centric Dual Distillation. | Feifei Fu, Zhiwu Lu |
| 2025 | ICCV | CoTMR: Chain-of-Thought Multi-Scale Reasoning for Training-Free Zero-Shot Composed Image Retrieval. | Zelong Sun, Dong Jing, Zhiwu Lu |
| 2025 | ICLR | MMRole: A Comprehensive Framework for Developing and Evaluating Multimodal Role-Playing Agents. | Yanqi Dai, Huanran Hu, Lei Wang, Shengjie Jin, Xu Chen, Zhiwu Lu |
| 2024 | CVPR | Dual-Enhanced Coreset Selection with Class-Wise Collaboration for Online Blurry Class Incremental Learning. | Yutian Luo, Shiqi Zhao, Haoran Wu, Zhiwu Lu |
| 2024 | ECIR | VEMO: A Versatile Elastic Multi-modal Model for Search-Oriented Multi-task Learning. | Nanyi Fei, Hao Jiang, Haoyu Lu, Jinqiang Long, Yanqi Dai, Tuo Fan, Zhao Cao, Zhiwu Lu |
| 2024 | ICASSP | Unsupervised Continual Learning of Image Representation Via Rememory-Based Simsiam. | Feifei Fu, Yizhao Gao, Zhiwu Lu, Haoran Wu, Shiqi Zhao |
| 2024 | ICASSP | Image Retrieval with Composed Query by Multi-Scale Multi-Modal Fusion. | Zelong Sun, Guoxing Yang, Zhiwu Lu, Hao Jiang, Guojie Zhu, Zhao Cao |
| 2024 | ICASSP | Progressive Image Synthesis from Semantics to Details with Denoising Diffusion GAN. | Guoxing Yang, Haoyu Lu, Chongxuan Li, Guang Zhou, Haoran Wu, Zhiwu Lu |
| 2024 | ICASSP | Multi-Level Contrastive Learning For Hybrid Cross-Modal Retrieval. | Yiming Zhao, Haoyu Lu, Shiqi Zhao, Haoran Wu, Zhiwu Lu |
| 2024 | ICLR | UniAdapter: Unified Parameter-Efficient Transfer Learning for Cross-modal Modeling. | Haoyu Lu, Yuqi Huo, Guoxing Yang, Zhiwu Lu, Wei Zhan, Masayoshi Tomizuka, Mingyu Ding |
| 2024 | ICLR | VDT: General-purpose Video Diffusion Transformers via Mask Modeling. | Haoyu Lu, Guoxing Yang, Nanyi Fei, Yuqi Huo, Zhiwu Lu, Ping Luo, Mingyu Ding |
| 2023 | ADMA | Song-to-Video Translation: Writing a Video from Song Lyrics Based on Multimodal Pre-training. | Feifei Fu, Zelong Sun, Guoxing Yang, Xiaolong He, Zhiwu Lu |
| 2023 | ECAI | R-STAR: Robust Self-Taught Task-Wise Reweighting for Rehearsal-Based Class Incremental Learning. | Yutian Luo, Yizhao Gao, Haoran Wu, Ruitao Ma, Zhiwu Lu |
| 2023 | ECAI | Task-Sensitive Discriminative Mutual Attention Network for Few-Shot Learning. | Baogui Xu, Chengjin Xu, Zhiwu Lu, Bing Su |
| 2023 | ICDM | Mixup-Inspired Video Class-Incremental Learning. | Jinqiang Long, Yizhao Gao, Zhiwu Lu |
| 2023 | MMM | Binary Neural Network for Video Action Recognition. | Hongfeng Han, Zhiwu Lu, Ji-Rong Wen |
| 2023 | MMM | CTDA: Contrastive Temporal Domain Adaptation for Action Segmentation. | Hongfeng Han, Zhiwu Lu, Ji-Rong Wen |
| 2023 | UAI | Improvable Gap Balancing for Multi-Task Learning. | Yanqi Dai, Nanyi Fei, Zhiwu Lu |
| 2022 | AAAI | SVT-Net: Super Light-Weight Sparse Voxel Transformer for Large Scale Place Recognition. | Zhaoxin Fan, Zhenbo Song, Hongyan Liu, Zhiwu Lu, Jun He, Xiaoyong Du |
| 2022 | ACCV | SST-VLM: Sparse Sampling-Twice Inspired Video-Language Model. | Yizhao Gao, Zhiwu Lu |
| 2022 | COLING | Visual Prompt Tuning for Few-Shot Text Classification. | Jingyuan Wen, Yutian Luo, Nanyi Fei, Guoxing Yang, Zhiwu Lu, Hao Jiang, Jie Jiang, Zhao Cao |
| 2022 | CVPR | COTS: Collaborative Two-Stream Vision-Language Pre-Training Model for Cross-Modal Retrieval. | Haoyu Lu, Nanyi Fei, Yuqi Huo, Yizhao Gao, Zhiwu Lu, Ji-Rong Wen |
| 2022 | ICASSP | Text2Poster: Laying Out Stylized Texts on Retrieved Images. | Chuhao Jin, Hongteng Xu, Ruihua Song, Zhiwu Lu |
| 2022 | ICLR | Learning Versatile Neural Architectures by Propagating Network Codes. | Mingyu Ding, Yuqi Huo, Haoyu Lu, Linjie Yang, Zhe Wang, Zhiwu Lu, Jingdong Wang, Ping Luo |
| 2022 | ICLR | Task Relatedness-Based Generalization Bounds for Meta Learning. | Jiechao Guan, Zhiwu Lu |
| 2022 | ICML | Fast-Rate PAC-Bayesian Generalization Bounds for Meta-Learning. | Jiechao Guan, Zhiwu Lu |
| 2021 | AAAI | A Global Occlusion-Aware Approach to Self-Supervised Monocular Visual Odometry. | Yao Lu, Xiaoli Xu, Mingyu Ding, Zhiwu Lu, Tao Xiang |
| 2021 | CVPR | HR-NAS: Searching Efficient High-Resolution Neural Architectures With Lightweight Transformers. | Mingyu Ding, Xiaochen Lian, Linjie Yang, Peng Wang, Xiaojie Jin, Zhiwu Lu, Ping Luo |
| 2021 | CVPR | Counterfactual VQA: A Cause-Effect Look at Language Bias. | Yulei Niu, Kaihua Tang, Hanwang Zhang, Zhiwu Lu, Xian-Sheng Hua, Ji-Rong Wen |
| 2021 | CVPR | L2M-GAN: Learning To Manipulate Latent Space Semantics for Facial Attribute Editing. | Guoxing Yang, Nanyi Fei, Mingyu Ding, Guangzhen Liu, Zhiwu Lu, Tao Xiang |
| 2021 | ICCV | Z-Score Normalization, Hubness, and Few-Shot Learning. | Nanyi Fei, Yizhao Gao, Zhiwu Lu, Tao Xiang |
| 2021 | ICLR | MELR: Meta-Learning via Modeling Episode-Level Relationships for Few-Shot Learning. | Nanyi Fei, Zhiwu Lu, Tao Xiang, Songfang Huang |
| 2021 | ICLR | IEPT: Instance-Level and Episode-Level Pretext Tasks for Few-Shot Learning. | Manli Zhang, Jianhong Zhang, Zhiwu Lu, Tao Xiang, Mingyu Ding, Songfang Huang |
| 2021 | IJCAI | Self-Supervised Video Representation Learning with Constrained Spatiotemporal Jigsaw. | Yuqi Huo, Mingyu Ding, Haoyu Lu, Ziyuan Huang, Mingqian Tang, Zhiwu Lu, Tao Xiang |
| 2021 | WACV | Vid2Int: Detecting Implicit Intention from Long Dialog Videos. | Xiaoli Xu, Yao Lu, Zhiwu Lu, Tao Xiang |
| 2021 | WACV | AdarGCN: Adaptive Aggregation GCN for Few-Shot Learning. | Jianhong Zhang, Manli Zhang, Zhiwu Lu, Tao Xiang |
| 2021 | WACV | Domain-Adaptive Few-Shot Learning. | An Zhao, Mingyu Ding, Zhiwu Lu, Tao Xiang, Yulei Niu, Jiechao Guan, Ji-Rong Wen |
| 2021 | UAI | Contrastive prototype learning with augmented embeddings for few-shot learning. | Yizhao Gao, Nanyi Fei, Guangzhen Liu, Zhiwu Lu, Tao Xiang |
| 2020 | AAAI | Every Frame Counts: Joint Learning of Video Segmentation and Optical Flow. | Mingyu Ding, Zhe Wang, Bolei Zhou, Jianping Shi, Zhiwu Lu, Ping Luo |
| 2020 | ACCV | Few-Shot Zero-Shot Learning: Knowledge Transfer with Less Supervision. | Nanyi Fei, Jiechao Guan, Zhiwu Lu, Yizhao Gao |
| 2020 | ACCV | Large-Scale Cross-Domain Few-Shot Learning. | Jiechao Guan, Manli Zhang, Zhiwu Lu |
| 2020 | CVPR | Learning Depth-Guided Convolutions for Monocular 3D Object Detection. | Mingyu Ding, Yuqi Huo, Hongwei Yi, Zhe Wang, Jianping Shi, Zhiwu Lu, Ping Luo |
| 2020 | CVPR | Learning Depth-Guided Convolutions for Monocular 3D Object Detection. | Mingyu Ding, Yuqi Huo, Hongwei Yi, Zhe Wang, Jianping Shi, Zhiwu Lu, Ping Luo |
| 2020 | ECCV | Lightweight Action Recognition in Compressed Videos. | Yuqi Huo, Xiaoli Xu, Yao Lu, Yulei Niu, Mingyu Ding, Zhiwu Lu, Tao Xiang, Ji-Rong Wen |
| 2019 | CVPR | Face-Focused Cross-Stream Network for Deception Detection in Videos. | Mingyu Ding, An Zhao, Zhiwu Lu, Tao Xiang, Ji-Rong Wen |
| 2019 | CVPR | Large-Scale Few-Shot Learning: Knowledge Transfer With Class Hierarchy. | Aoxue Li, Tiange Luo, Zhiwu Lu, Tao Xiang, Liwei Wang |
| 2019 | CVPR | Recursive Visual Attention in Visual Dialog. | Yulei Niu, Hanwang Zhang, Manli Zhang, Jianhong Zhang, Zhiwu Lu, Ji-Rong Wen |
| 2019 | ICDE | RUM: Network Representation Learning Using Motifs. | Yanlei Yu, Zhiwu Lu, Jiajun Liu, Guoping Zhao, Ji-Rong Wen |
| 2019 | SIGIR | Coarse-to-Fine Grained Classification. | Yuqi Huo, Yao Lu, Yulei Niu, Zhiwu Lu, Ji-Rong Wen |
| 2018 | ACCV | Extreme Reverse Projection Learning for Zero-Shot Recognition. | Jiechao Guan, An Zhao, Zhiwu Lu |
| 2018 | BMVC | DeepInsight: Multi-Task Multi-Scale Deep Learning for Mental Disorder Diagnosis. | Mingyu Ding, Yuqi Huo, Jun Hu, Zhiwu Lu |
| 2018 | ICONIP | Zero-Shot Learning with Superclasses. | Yuqi Huo, Mingyu Ding, An Zhao, Jun Hu, Ji-Rong Wen, Zhiwu Lu |
| 2018 | ICONIP | InsightGAN: Semi-Supervised Feature Learning with Generative Adversarial Network for Drug Abuse Detection. | Guangzhen Liu, Jun Hu, An Zhao, Mingyu Ding, Yuqi Huo, Zhiwu Lu |
| 2017 | AAAI | FeaBoost: Joint Feature and Label Refinement for Semantic Segmentation. | Yulei Niu, Zhiwu Lu, Songfang Huang, Xin Gao, Ji-Rong Wen |
| 2017 | IJCNN | Graph-boosted convolutional neural networks for semantic segmentation. | Guangzhen Liu, Peng Han, Yulei Niu, Wenwu Yuan, Zhiwu Lu, Ji-Rong Wen |
| 2016 | ICONIP | Segmentation with Selectively Propagated Constraints. | Peng Han, Guangzhen Liu, Songfang Huang, Wenwu Yuan, Zhiwu Lu |
| 2016 | IJCAI | Large Scale Sparse Clustering. | Ruqi Zhang, Zhiwu Lu |
| 2015 | AAAI | Noise-Robust Semi-Supervised Learning by Large-Scale Sparse Coding. | Zhiwu Lu, Xin Gao, Liwei Wang, Ji-Rong Wen, Songfang Huang |
| 2015 | IJCAI | Social Image Parsing by Cross-Modal Data Refinement. | Zhiwu Lu, Xin Gao, Songfang Huang, Liwei Wang, Ji-Rong Wen |
| 2015 | IJCAI | Weakly Supervised Matrix Factorization for Noisily Tagged Image Parsing. | Yulei Niu, Zhiwu Lu, Songfang Huang, Peng Han, Ji-Rong Wen |
| 2014 | AAAI | Direct Semantic Analysis for Social Image Classification. | Zhiwu Lu, Liwei Wang, Ji-Rong Wen |
| 2013 | AAAI | Unified Constraint Propagation on Multi-View Data. | Zhiwu Lu, Yuxin Peng |
| 2013 | ICIP | Multimodal semi-supervised image classification by combining tag refinement, graph-based learning and support vector regression. | Wenxuan Xie, Zhiwu Lu, Yuxin Peng, Jianguo Xiao |
| 2013 | IJCAI | Learning Descriptive Visual Representation by Semantic Regularized Matrix Factorization. | Zhiwu Lu, Yuxin Peng |
| 2012 | ICDM | Heterogeneous Constraint Propagation with Constrained Sparse Representation. | Zhiwu Lu, Yuxin Peng |
| 2011 | AAAI | Symmetric Graph Regularized Constraint Propagation. | Zhenyong Fu, Zhiwu Lu, Horace Ho-Shing Ip, Yuxin Peng, Hongtao Lu |
| 2011 | AAAI | Latent Semantic Learning by Efficient Sparse Coding with Hypergraph Regularization. | Zhiwu Lu, Yuxin Peng |
| 2011 | ICCV | Spectral learning of latent semantics for action recognition. | Zhiwu Lu, Yuxin Peng, Horace Ho-Shing Ip |
| 2010 | ECCV | Constrained Spectral Clustering via Exhaustive and Efficient Constraint Propagation. | Zhiwu Lu, Horace Ho-Shing Ip |
| 2009 | CAIP | Image Categorization Based on a Hierarchical Spatial Markov Model. | Lihua Wang, Zhiwu Lu, Horace Ho-Shing Ip |
| 2009 | CVPR | Image categorization with spatial mismatch kernels. | Zhiwu Lu, Horace Ho-Shing Ip |
| 2009 | CVPR | Image categorization by learning with context and consistency. | Zhiwu Lu, Horace Ho-Shing Ip |
| 2008 | AAAI | From Comparing Clusterings to Combining Clusterings. | Zhiwu Lu, Yuxin Peng, Jianguo Xiao |
| 2008 | CVPR | Unsupervised learning of finite mixtures using entropy regularization and its application to image segmentation. | Zhiwu Lu, Yuxin Peng, Jianguo Xiao |
| 2007 | ISNN | Asymptotic Convergence Properties of Entropy Regularized Likelihood Learning on Finite Mixtures with Automatic Model Selection. | Zhiwu Lu, Xiaoqing Lu, Zhiyuan Ye |
| 2007 | ISNN | Unsupervised Image Categorization Using Constrained Entropy-Regularized Likelihood Learning with Pairwise Constraints. | Zhiwu Lu, Xiaoqing Lu, Zhiyuan Ye |
| 2007 | PAKDD | Entropy Regularization, Automatic Model Selection, and Unsupervised Image Segmentation. | Zhiwu Lu, Xiaoqing Lu, Zhiyuan Ye |
| 2006 | ISNN | Unsupervised Image Segmentation Using an Iterative Entropy Regularized Likelihood Learning Algorithm. | Zhiwu Lu |
| 2006 | ISNN | A Regularized Minimum Cross-Entropy Algorithm on Mixtures of Experts for Time Series Prediction. | Zhiwu Lu |
| 2006 | ISNN | A Gradient Entropy Regularized Likelihood Learning Algorithm on Gaussian Mixture with Automatic Model Selection. | Zhiwu Lu, Jinwen Ma |
| 2005 | IDEAL | A Gradient BYY Harmony Learning Algorithm on Mixture of Experts for Curve Detection. | Zhiwu Lu, QianSheng Cheng, Jinwen Ma |