| 2026 | ACL | Debiased Orthogonal Boundary-Driven Efficient Noise Mitigation. | Hao Li, Jiayang Gu, Jingkuan Song, An Zhang, Lianli Gao |
| 2025 | AAAI | DFDNet: Disentangling and Filtering Dynamics for Enhanced Video Prediction. | Lianqiang Gan, Junyu Lai, Jingze Ju, Lianli Gao, Yi Bin |
| 2025 | ACL | MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct. | Run Luo, Haonan Zhang, Longze Chen, Ting-En Lin, Xiong Liu, Yuchuan Wu, Min Yang, Yongbin Li, Minzheng Wang, Pengpeng Zeng, Lianli Gao, Heng Tao Shen, Yunshui Li, Hamid Alinejad-Rokny, Xiaobo Xia, Jingkuan Song, Fei Huang |
| 2025 | ACL | OmniCharacter: Towards Immersive Role-Playing Agents with Seamless Speech-Language Personality Interaction. | Haonan Zhang, Run Luo, Xiong Liu, Yuchuan Wu, Ting-En Lin, Pengpeng Zeng, Qiang Qu, Feiteng Fang, Min Yang, Lianli Gao, Jingkuan Song, Fei Huang, Yongbin Li |
| 2025 | CVPR | Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves. | Shihan Wu, Ji Zhang, Pengpeng Zeng, Lianli Gao, Jingkuan Song, Heng Tao Shen |
| 2025 | EMNLP | Unlocking Smarter Device Control: Foresighted Planning with a World Model-Driven Code Execution Approach. | Xiaoran Yin, Xu Luo, Hao Wu, Lianli Gao, Jingkuan Song |
| 2024 | AAAI | F³-Pruning: A Training-Free and Generalized Pruning Strategy towards Faster and Finer Text-to-Video Synthesis. | Sitong Su, Jianzhi Liu, Lianli Gao, Jingkuan Song |
| 2024 | CVPR | ProS: Prompting-to-Simulate Generalized Knowledge for Universal Cross-Domain Retrieval. | Kaipeng Fang, Jingkuan Song, Lianli Gao, Pengpeng Zeng, Zhi-Qi Cheng, Xiyao Li, Heng Tao Shen |
| 2024 | CVPR | DePT: Decoupled Prompt Tuning. | Ji Zhang, Shihan Wu, Lianli Gao, Heng Tao Shen, Jingkuan Song |
| 2024 | ECCV | Any Target Can be Offense: Adversarial Example Generation via Generalized Latent Infection. | Youheng Sun, Shengming Yuan, Xuanhan Wang, Lianli Gao, Jingkuan Song |
| 2024 | ECCV | RoScenes: A Large-Scale Multi-view 3D Dataset for Roadside Perception. | Xiaosu Zhu, Hualian Sheng, Sijia Cai, Bing Deng, Shaopeng Yang, Qiao Liang, Ken Chen, Lianli Gao, Jingkuan Song, Jieping Ye |
| 2023 | CVPR | Prototype-Based Embedding Network for Scene Graph Generation. | Chaofan Zheng, Xinyu Lyu, Lianli Gao, Bo Dai, Jingkuan Song |
| 2023 | ICCV | Part-Aware Transformer for Generalizable Person Re-identification. | Hao Ni, Yuke Li, Lianli Gao, Heng Tao Shen, Jingkuan Song |
| 2023 | ICCV | DETA: Denoised Task Adaptation for Few-Shot Learning. | Ji Zhang, Lianli Gao, Xu Luo, Hengtao Shen, Jingkuan Song |
| 2023 | ICML | A Closer Look at Few-shot Classification Again. | Xu Luo, Hao Wu, Ji Zhang, Lianli Gao, Jing Xu, Jingkuan Song |
| 2022 | CVPR | Practical Evaluation of Adversarial Robustness via Adaptive Auto Attack. | Ye Liu, Yaya Cheng, Lianli Gao, Xianglong Liu, Qilong Zhang, Jingkuan Song |
| 2022 | CVPR | Fine-Grained Predicates Learning for Scene Graph Generation. | Xinyu Lyu, Lianli Gao, Yuyu Guo, Zhou Zhao, Hao Huang, Heng Tao Shen, Jingkuan Song |
| 2022 | CVPR | Wnet: Audio-Guided Video Object Segmentation via Wavelet-Based Cross- Modal Denoising Networks. | Wenwen Pan, Haonan Shi, Zhou Zhao, Jieming Zhu, Xiuqiang He, Zhigeng Pan, Lianli Gao, Jun Yu, Fei Wu, Qi Tian |
| 2022 | CVPR | Unified Multivariate Gaussian Mixture for Efficient Neural Image Compression. | Xiaosu Zhu, Jingkuan Song, Lianli Gao, Feng Zheng, Heng Tao Shen |
| 2022 | ECCV | Towards Open-Vocabulary Scene Graph Generation with Prompt-Based Finetuning. | Tao He, Lianli Gao, Jingkuan Song, Yuan-Fang Li |
| 2022 | ECCV | Frequency Domain Model Augmentation for Adversarial Attack. | Yuyang Long, Qilong Zhang, Boheng Zeng, Lianli Gao, Xianglong Liu, Jian Zhang, Jingkuan Song |
| 2022 | ICLR | Beyond ImageNet Attack: Towards Crafting Adversarial Examples for Black-box Domains. | Qilong Zhang, Xiaodan Li, Yuefeng Chen, Jingkuan Song, Lianli Gao, Yuan He, Hui Xue |
| 2022 | IJCAI | S2 Transformer for Image Captioning. | Pengpeng Zeng, Haonan Zhang, Jingkuan Song, Lianli Gao |
| 2021 | AAAI | RSGNet: Relation based Skeleton Graph Network for Crowded Scenes Pose Estimation. | Yan Dai, Xuanhan Wang, Lianli Gao, Jingkuan Song, Heng Tao Shen |
| 2021 | ICCV | From General to Specific: Informative Scene Graph Generation via Balance Adjustment. | Yuyu Guo, Lianli Gao, Xuanhan Wang, Yuxuan Hu, Xing Xu, Xu Lu, Heng Tao Shen, Jingkuan Song |
| 2021 | ICCV | Exploiting Scene Graphs for Human-Object Interaction Detection. | Tao He, Lianli Gao, Jingkuan Song, Yuan-Fang Li |
| 2021 | IJCAI | Feature Space Targeted Attacks by Statistic Alignment. | Lianli Gao, Yaya Cheng, Qilong Zhang, Xing Xu, Jingkuan Song |
| 2021 | IJCAI | Towards Unsupervised Deformable-Instances Image-to-Image Translation. | Sitong Su, Jingkuan Song, Lianli Gao, Junchen Zhu |
| 2021 | IJCAI | PoseGTAC: Graph Transformer Encoder-Decoder with Atrous Convolution for 3D Human Pose Estimation. | Yiran Zhu, Xing Xu, Fumin Shen, Yanli Ji, Lianli Gao, Heng Tao Shen |
| 2020 | AAAI | SNEQ: Semi-Supervised Attributed Network Embedding with Attention-Based Quantisation. | Tao He, Lianli Gao, Jingkuan Song, Xin Wang, Kejie Huang, Yuanfang Li |
| 2020 | AAAI | Learning Cross-Aligned Latent Embeddings for Zero-Shot Cross-Modal Retrieval. | Kaiyi Lin, Xing Xu, Lianli Gao, Zheng Wang, Heng Tao Shen |
| 2020 | CVPR | What Machines See Is Not What They Get: Fooling Scene Text Recognition Models With Adversarial Text Images. | Xing Xu, Jiefu Chen, Jinhui Xiao, Lianli Gao, Fumin Shen, Heng Tao Shen |
| 2020 | CVPR | Where Does It Exist: Spatio-Temporal Video Grounding for Multi-Form Sentences. | Zhu Zhang, Zhou Zhao, Yang Zhao, Qi Wang, Huasheng Liu, Lianli Gao |
| 2020 | ECCV | Patch-Wise Attack for Fooling Deep Neural Network. | Lianli Gao, Qilong Zhang, Jingkuan Song, Xianglong Liu, Heng Tao Shen |
| 2020 | IJCAI | Bottom-up and Top-down: Bidirectional Additive Net for Edge Detection. | Lianli Gao, Zhilong Zhou, Heng Tao Shen, Jingkuan Song |
| 2020 | IJCAI | Learning from the Scene and Borrowing from the Rich: Tackling the Long Tail in Scene Graph Generation. | Tao He, Lianli Gao, Jingkuan Song, Jianfei Cai, Yuan-Fang Li |
| 2020 | IJCAI | Label-Attended Hashing for Multi-Label Image Retrieval. | Yanzhao Xie, Yu Liu, Yangtao Wang, Lianli Gao, Peng Wang, Ke Zhou |
| 2020 | SIGIR | 3D Self-Attention for Unsupervised Video Quantization. | Jingkuan Song, Ruimin Lang, Xiaosu Zhu, Xing Xu, Lianli Gao, Heng Tao Shen |
| 2020 | SIGIR | Correlated Features Synthesis and Alignment for Zero-shot Cross-modal Retrieval. | Xing Xu, Kaiyi Lin, Huimin Lu, Lianli Gao, Heng Tao Shen |
| 2019 | AAAI | Perceptual Pyramid Adversarial Networks for Text-to-Image Synthesis. | Lianli Gao, Daiyuan Chen, Jingkuan Song, Xing Xu, Dongxiang Zhang, Heng Tao Shen |
| 2019 | AAAI | Deliberate Attention Networks for Image Captioning. | Lianli Gao, Kaixuan Fan, Jingkuan Song, Xianglong Liu, Xing Xu, Heng Tao Shen |
| 2019 | AAAI | Structured Two-Stream Attention Network for Video Question Answering. | Lianli Gao, Pengpeng Zeng, Jingkuan Song, Yuan-Fang Li, Wu Liu, Tao Mei, Heng Tao Shen |
| 2019 | AAAI | Beyond RNNs: Positional Self-Attention with Co-Attention for Video Question Answering. | Xiangpeng Li, Jingkuan Song, Lianli Gao, Xianglong Liu, Wenbing Huang, Xiangnan He, Chuang Gan |
| 2019 | AAAI | Template-Based Math Word Problem Solvers with Recursive Neural Networks. | Lei Wang, Dongxiang Zhang, Jipeng Zhang, Xing Xu, Lianli Gao, Bing Tian Dai, Heng Tao Shen |
| 2019 | CVPR | Neighbourhood Watch: Referring Expression Comprehension via Language-Guided Graph Attention Networks. | Peng Wang, Qi Wu, Jiewei Cao, Chunhua Shen, Lianli Gao, Anton van den Hengel |
| 2019 | CVPR | Social Relation Recognition From Videos via Multi-Scale Spatial-Temporal Reasoning. | Xinchen Liu, Wu Liu, Meng Zhang, Jingwen Chen, Lianli Gao, Chenggang Yan, Tao Mei |
| 2019 | IJCAI | Matching User with Item Set: Collaborative Bundle Recommendation with Deep Attention Network. | Liang Chen, Yang Liu, Xiangnan He, Lianli Gao, Zibin Zheng |
| 2019 | IJCAI | Beyond Product Quantization: Deep Progressive Quantization for Image Retrieval. | Lianli Gao, Xiaosu Zhu, Jingkuan Song, Zhou Zhao, Heng Tao Shen |
| 2019 | IJCAI | One Network for Multi-Domains: Domain Adaptive Hashing with Intersectant Generative Adversarial Networks. | Tao He, Yuan-Fang Li, Lianli Gao, Dongxiang Zhang, Jingkuan Song |
| 2019 | IJCAI | Deep Recurrent Quantization for Generating Sequential Binary Codes. | Jingkuan Song, Xiaosu Zhu, Lianli Gao, Xin-Shun Xu, Wu Liu, Heng Tao Shen |
| 2018 | AAAI | Binary Generative Adversarial Networks for Image Retrieval. | Jingkuan Song, Tao He, Lianli Gao, Xing Xu, Alan Hanjalic, Heng Tao Shen |
| 2018 | AAAI | Deep Region Hashing for Generic Instance Search from Images. | Jingkuan Song, Tao He, Lianli Gao, Xing Xu, Heng Tao Shen |
| 2018 | AAAI | MathDQN: Solving Arithmetic Word Problems via Deep Reinforcement Learning. | Lei Wang, Dongxiang Zhang, Lianli Gao, Jingkuan Song, Long Guo, Heng Tao Shen |
| 2018 | ICIP | Unpaired Image-to-Image Translation from Shared Deep Space. | Xuehui Wu, Jie Shao, Lianli Gao, Heng Tao Shen |
| 2018 | IJCAI | Coarse-to-fine Image Co-segmentation with Intra and Inter Rank Constraints. | Lianli Gao, Jingkuan Song, Dongxiang Zhang, Heng Tao Shen |
| 2018 | IJCAI | Dual Conditional GANs for Face Aging and Rejuvenation. | Jingkuan Song, Jingqiu Zhang, Lianli Gao, Xianglong Liu, Heng Tao Shen |
| 2018 | IJCAI | From Pixels to Objects: Cubic Visual Attention for Visual Question Answering. | Jingkuan Song, Pengpeng Zeng, Lianli Gao, Heng Tao Shen |
| 2017 | AAAI | Event Video Mashup: From Hundreds of Videos to Minutes of Skeleton. | Lianli Gao, Peng Wang, Jingkuan Song, Zi Huang, Jie Shao, Heng Tao Shen |
| 2017 | ADC | Jointly Learning Attentions with Semantic Cross-Modal Correlation for Visual Question Answering. | Liangfu Cao, Lianli Gao, Jingkuan Song, Xing Xu, Heng Tao Shen |
| 2017 | CIKM | Movie Fill in the Blank with Adaptive Temporal Attention and Description Update. | Jie Chen, Jie Shao, Fumin Shen, Chengkun He, Lianli Gao, Heng Tao Shen |
| 2017 | ICONIP | Sharp and Real Image Super-Resolution Using Generative Adversarial Network. | Dongyang Zhang, Jie Shao, Gang Hu, Lianli Gao |
| 2017 | IJCAI | Hierarchical LSTM with Adjusted Temporal Attention for Video Captioning. | Jingkuan Song, Lianli Gao, Zhao Guo, Wu Liu, Dongxiang Zhang, Heng Tao Shen |
| 2016 | AAAI | Graph-without-cut: An Ideal Graph Learning for Image Segmentation. | Lianli Gao, Jingkuan Song, Feiping Nie, Fuhao Zou, Nicu Sebe, Heng Tao Shen |
| 2015 | CVPR | Optimal graph learning with partial tags and multiple features for image and video annotation. | Lianli Gao, Jingkuan Song, Feiping Nie, Yan Yan, Nicu Sebe, Heng Tao Shen |