| 2026 | AAAI | Hyper-Opinion Vagueness Quantification for Robust Multimodal Learning. | Disen Hu, Xun Jiang, Xiaofeng Cao, Zheng Wang, Jingkuan Song, Heng Tao Shen, Xing Xu |
| 2026 | AAAI | De-biased Natural Language Egocentric Task Verification via Prototypical Evidence Learning. | Chong Liu, Xun Jiang, Fumin Shen, Lei Zhu, Jingkuan Song, Heng Tao Shen, Xing Xu |
| 2026 | AAAI | Learning to Curate Context: Jointly Optimizing Retrieval and Prediction for Multimodal Social Media Popularity. | Xovee Xu, Shuojun Lin, Fan Zhou, Jingkuan Song |
| 2026 | ACL | Debiased Orthogonal Boundary-Driven Efficient Noise Mitigation. | Hao Li, Jiayang Gu, Jingkuan Song, An Zhang, Lianli Gao |
| 2026 | ICDE | SINDI: An Efficient Index for Sparse Vector Approximate Maximum Inner Product Search. | Ruoxuan Li, Xiaoyao Zhong, Jiabao Jin, Peng Cheng, Wangze Ni, Zhitao Shen, Wei Jia, Xiangyu Wang, Heng Tao Shen, Jingkuan Song |
| 2025 | AAAI | Improving Multimodal Social Media Popularity Prediction via Selective Retrieval Knowledge Augmentation. | Xovee Xu, Yifan Zhang, Fan Zhou, Jingkuan Song |
| 2025 | ACL | From Observation to Understanding: Front-Door Adjustments with Uncertainty Calibration for Enhancing Egocentric Reasoning in LVLMs. | Shenshen Li, Wenxin Meng, Lei Wang, Hao Yang, Chong Peng, Peng Yan, Fumin Shen, Jingkuan Song, Heng Tao Shen, Xing Xu |
| 2025 | ACL | MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct. | Run Luo, Haonan Zhang, Longze Chen, Ting-En Lin, Xiong Liu, Yuchuan Wu, Min Yang, Yongbin Li, Minzheng Wang, Pengpeng Zeng, Lianli Gao, Heng Tao Shen, Yunshui Li, Hamid Alinejad-Rokny, Xiaobo Xia, Jingkuan Song, Fei Huang |
| 2025 | ACL | OmniCharacter: Towards Immersive Role-Playing Agents with Seamless Speech-Language Personality Interaction. | Haonan Zhang, Run Luo, Xiong Liu, Yuchuan Wu, Ting-En Lin, Pengpeng Zeng, Qiang Qu, Feiteng Fang, Min Yang, Lianli Gao, Jingkuan Song, Fei Huang, Yongbin Li |
| 2025 | ADC | Importance Sampling Facilitates Ensemble Adversarial Transferability. | Zheng Wang, Xing Xu, Pengpeng Zeng, Jingkuan Song |
| 2025 | CVPR | Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves. | Shihan Wu, Ji Zhang, Pengpeng Zeng, Lianli Gao, Jingkuan Song, Heng Tao Shen |
| 2025 | CVPR | PHGC: Procedural Heterogeneous Graph Completion for Natural Language Task Verification in Egocentric Videos. | Xun Jiang, Zhiyi Huang, Xing Xu, Jingkuan Song, Fumin Shen, Heng Tao Shen |
| 2025 | EMNLP | Unlocking Smarter Device Control: Foresighted Planning with a World Model-Driven Code Execution Approach. | Xiaoran Yin, Xu Luo, Hao Wu, Lianli Gao, Jingkuan Song |
| 2024 | AAAI | F³-Pruning: A Training-Free and Generalized Pruning Strategy towards Faster and Finer Text-to-Video Synthesis. | Sitong Su, Jianzhi Liu, Lianli Gao, Jingkuan Song |
| 2024 | CVPR | ProS: Prompting-to-Simulate Generalized Knowledge for Universal Cross-Domain Retrieval. | Kaipeng Fang, Jingkuan Song, Lianli Gao, Pengpeng Zeng, Zhi-Qi Cheng, Xiyao Li, Heng Tao Shen |
| 2024 | CVPR | DePT: Decoupled Prompt Tuning. | Ji Zhang, Shihan Wu, Lianli Gao, Heng Tao Shen, Jingkuan Song |
| 2024 | ECCV | Any Target Can be Offense: Adversarial Example Generation via Generalized Latent Infection. | Youheng Sun, Shengming Yuan, Xuanhan Wang, Lianli Gao, Jingkuan Song |
| 2024 | ECCV | RoScenes: A Large-Scale Multi-view 3D Dataset for Roadside Perception. | Xiaosu Zhu, Hualian Sheng, Sijia Cai, Bing Deng, Shaopeng Yang, Qiao Liang, Ken Chen, Lianli Gao, Jingkuan Song, Jieping Ye |
| 2024 | SIGIR | Unsupervised Cross-Domain Image Retrieval with Semantic-Attended Mixture-of-Experts. | Kai Wang, Jiayang Liu, Xing Xu, Jingkuan Song, Xin Liu, Heng Tao Shen |
| 2023 | CVPR | Prototype-Based Embedding Network for Scene Graph Generation. | Chaofan Zheng, Xinyu Lyu, Lianli Gao, Bo Dai, Jingkuan Song |
| 2023 | ICCV | Part-Aware Transformer for Generalizable Person Re-identification. | Hao Ni, Yuke Li, Lianli Gao, Heng Tao Shen, Jingkuan Song |
| 2023 | ICCV | DETA: Denoised Task Adaptation for Few-Shot Learning. | Ji Zhang, Lianli Gao, Xu Luo, Hengtao Shen, Jingkuan Song |
| 2023 | ICML | A Closer Look at Few-shot Classification Again. | Xu Luo, Hao Wu, Ji Zhang, Lianli Gao, Jing Xu, Jingkuan Song |
| 2022 | APWEB | Self-supervised Label-Visual Correlation Hashing for Multi-label Image Retrieval. | Yu Liu, Yanzhao Xie, Jingkuan Song, Rukai Wei, Ke Zhou |
| 2022 | CVPR | Rethinking Spatial Invariance of Convolutional Networks for Object Counting. | Zhi-Qi Cheng, Qi Dai, Hong Li, Jingkuan Song, Xiao Wu, Alexander G. Hauptmann |
| 2022 | CVPR | Practical Evaluation of Adversarial Robustness via Adaptive Auto Attack. | Ye Liu, Yaya Cheng, Lianli Gao, Xianglong Liu, Qilong Zhang, Jingkuan Song |
| 2022 | CVPR | Fine-Grained Predicates Learning for Scene Graph Generation. | Xinyu Lyu, Lianli Gao, Yuyu Guo, Zhou Zhao, Hao Huang, Heng Tao Shen, Jingkuan Song |
| 2022 | CVPR | Meta Distribution Alignment for Generalizable Person Re-Identification. | Hao Ni, Jingkuan Song, Xiaopeng Luo, Feng Zheng, Wen Li, Heng Tao Shen |
| 2022 | CVPR | Unified Multivariate Gaussian Mixture for Efficient Neural Image Compression. | Xiaosu Zhu, Jingkuan Song, Lianli Gao, Feng Zheng, Heng Tao Shen |
| 2022 | ECCV | Learning Dual-Fused Modality-Aware Representations for RGBD Tracking. | Shang Gao, Jinyu Yang, Zhe Li, Feng Zheng, Ales Leonardis, Jingkuan Song |
| 2022 | ECCV | Towards Open-Vocabulary Scene Graph Generation with Prompt-Based Finetuning. | Tao He, Lianli Gao, Jingkuan Song, Yuan-Fang Li |
| 2022 | ECCV | Frequency Domain Model Augmentation for Adversarial Attack. | Yuyang Long, Qilong Zhang, Boheng Zeng, Lianli Gao, Xianglong Liu, Jian Zhang, Jingkuan Song |
| 2022 | ICLR | Beyond ImageNet Attack: Towards Crafting Adversarial Examples for Black-box Domains. | Qilong Zhang, Xiaodan Li, Yuefeng Chen, Jingkuan Song, Lianli Gao, Yuan He, Hui Xue |
| 2022 | IJCAI | S2 Transformer for Image Captioning. | Pengpeng Zeng, Haonan Zhang, Jingkuan Song, Lianli Gao |
| 2021 | AAAI | RSGNet: Relation based Skeleton Graph Network for Crowded Scenes Pose Estimation. | Yan Dai, Xuanhan Wang, Lianli Gao, Jingkuan Song, Heng Tao Shen |
| 2021 | ICCV | From General to Specific: Informative Scene Graph Generation via Balance Adjustment. | Yuyu Guo, Lianli Gao, Xuanhan Wang, Yuxuan Hu, Xing Xu, Xu Lu, Heng Tao Shen, Jingkuan Song |
| 2021 | ICCV | Exploiting Scene Graphs for Human-Object Interaction Detection. | Tao He, Lianli Gao, Jingkuan Song, Yuan-Fang Li |
| 2021 | IJCAI | Feature Space Targeted Attacks by Statistic Alignment. | Lianli Gao, Yaya Cheng, Qilong Zhang, Xing Xu, Jingkuan Song |
| 2021 | IJCAI | Towards Unsupervised Deformable-Instances Image-to-Image Translation. | Sitong Su, Jingkuan Song, Lianli Gao, Junchen Zhu |
| 2020 | AAAI | SNEQ: Semi-Supervised Attributed Network Embedding with Attention-Based Quantisation. | Tao He, Lianli Gao, Jingkuan Song, Xin Wang, Kejie Huang, Yuanfang Li |
| 2020 | AAAI | Graph Attention Based Proposal 3D ConvNets for Action Detection. | Jin Li, Xianglong Liu, Zhuofan Zong, Wanru Zhao, Mingyuan Zhang, Jingkuan Song |
| 2020 | CVPR | Salience-Guided Cascaded Suppression Network for Person Re-Identification. | Xuesong Chen, Canmiao Fu, Yong Zhao, Feng Zheng, Jingkuan Song, Rongrong Ji, Yi Yang |
| 2020 | CVPR | Forward and Backward Information Retention for Accurate Binary Neural Networks. | Haotong Qin, Ruihao Gong, Xianglong Liu, Mingzhu Shen, Ziran Wei, Fengwei Yu, Jingkuan Song |
| 2020 | ECCV | Patch-Wise Attack for Fooling Deep Neural Network. | Lianli Gao, Qilong Zhang, Jingkuan Song, Xianglong Liu, Heng Tao Shen |
| 2020 | IJCAI | Bottom-up and Top-down: Bidirectional Additive Net for Edge Detection. | Lianli Gao, Zhilong Zhou, Heng Tao Shen, Jingkuan Song |
| 2020 | IJCAI | Learning from the Scene and Borrowing from the Rich: Tackling the Long Tail in Scene Graph Generation. | Tao He, Lianli Gao, Jingkuan Song, Jianfei Cai, Yuan-Fang Li |
| 2020 | SIGIR | 3D Self-Attention for Unsupervised Video Quantization. | Jingkuan Song, Ruimin Lang, Xiaosu Zhu, Xing Xu, Lianli Gao, Heng Tao Shen |
| 2019 | AAAI | Perceptual Pyramid Adversarial Networks for Text-to-Image Synthesis. | Lianli Gao, Daiyuan Chen, Jingkuan Song, Xing Xu, Dongxiang Zhang, Heng Tao Shen |
| 2019 | AAAI | Deliberate Attention Networks for Image Captioning. | Lianli Gao, Kaixuan Fan, Jingkuan Song, Xianglong Liu, Xing Xu, Heng Tao Shen |
| 2019 | AAAI | Structured Two-Stream Attention Network for Video Question Answering. | Lianli Gao, Pengpeng Zeng, Jingkuan Song, Yuan-Fang Li, Wu Liu, Tao Mei, Heng Tao Shen |
| 2019 | AAAI | Beyond RNNs: Positional Self-Attention with Co-Attention for Video Question Answering. | Xiangpeng Li, Jingkuan Song, Lianli Gao, Xianglong Liu, Wenbing Huang, Xiangnan He, Chuang Gan |
| 2019 | APWEB | Boundary Detector Encoder and Decoder with Soft Attention for Video Captioning. | Tangming Chen, Qike Zhao, Jingkuan Song |
| 2019 | APWEB | A Framework for Image Dark Data Assessment. | Yu Liu, Yangtao Wang, Ke Zhou, Yujuan Yang, Yifei Liu, Jingkuan Song, Zhili Xiao |
| 2019 | APWEB | Model of Charging Stations Construction and Electric Vehicles Development Prediction. | Qilong Zhang, Zheyong Qiu, Jingkuan Song |
| 2019 | APWEB | The Research of Chinese Ethnical Face Recognition Based on Deep Learning. | Qike Zhao, Tangming Chen, Xiaosu Zhu, Jingkuan Song |
| 2019 | IJCAI | Beyond Product Quantization: Deep Progressive Quantization for Image Retrieval. | Lianli Gao, Xiaosu Zhu, Jingkuan Song, Zhou Zhao, Heng Tao Shen |
| 2019 | IJCAI | One Network for Multi-Domains: Domain Adaptive Hashing with Intersectant Generative Adversarial Networks. | Tao He, Yuan-Fang Li, Lianli Gao, Dongxiang Zhang, Jingkuan Song |
| 2019 | IJCAI | Deep Recurrent Quantization for Generating Sequential Binary Codes. | Jingkuan Song, Xiaosu Zhu, Lianli Gao, Xin-Shun Xu, Wu Liu, Heng Tao Shen |
| 2019 | IJCAI | Localizing Unseen Activities in Video via Image Query. | Zhu Zhang, Zhou Zhao, Zhijie Lin, Jingkuan Song, Deng Cai |
| 2019 | IJCAI | Open-Ended Long-Form Video Question Answering via Hierarchical Convolutional Self-Attention Networks. | Zhu Zhang, Zhou Zhao, Zhijie Lin, Jingkuan Song, Xiaofei He |
| 2018 | AAAI | Binary Generative Adversarial Networks for Image Retrieval. | Jingkuan Song, Tao He, Lianli Gao, Xing Xu, Alan Hanjalic, Heng Tao Shen |
| 2018 | AAAI | Deep Region Hashing for Generic Instance Search from Images. | Jingkuan Song, Tao He, Lianli Gao, Xing Xu, Heng Tao Shen |
| 2018 | AAAI | MathDQN: Solving Arithmetic Word Problems via Deep Reinforcement Learning. | Lei Wang, Dongxiang Zhang, Lianli Gao, Jingkuan Song, Long Guo, Heng Tao Shen |
| 2018 | IJCAI | Complementary Binary Quantization for Joint Multiple Indexing. | Qiang Fu, Xu Han, Xianglong Liu, Jingkuan Song, Cheng Deng |
| 2018 | IJCAI | Coarse-to-fine Image Co-segmentation with Intra and Inter Rank Constraints. | Lianli Gao, Jingkuan Song, Dongxiang Zhang, Heng Tao Shen |
| 2018 | IJCAI | Dual Conditional GANs for Face Aging and Rejuvenation. | Jingkuan Song, Jingqiu Zhang, Lianli Gao, Xianglong Liu, Heng Tao Shen |
| 2018 | IJCAI | From Pixels to Objects: Cubic Visual Attention for Visual Question Answering. | Jingkuan Song, Pengpeng Zeng, Lianli Gao, Heng Tao Shen |
| 2017 | AAAI | Event Video Mashup: From Hundreds of Videos to Minutes of Skeleton. | Lianli Gao, Peng Wang, Jingkuan Song, Zi Huang, Jie Shao, Heng Tao Shen |
| 2017 | ADC | Jointly Learning Attentions with Semantic Cross-Modal Correlation for Visual Question Answering. | Liangfu Cao, Lianli Gao, Jingkuan Song, Xing Xu, Heng Tao Shen |
| 2017 | CVPR | Matrix Tri-Factorization with Manifold Regularizations for Zero-Shot Learning. | Xing Xu, Fumin Shen, Yang Yang, Dongxiang Zhang, Heng Tao Shen, Jingkuan Song |
| 2017 | ICCV | Deep Binaries: Encoding Semantic-Rich Cues for Efficient Textual-Visual Cross Retrieval. | Yuming Shen, Li Liu, Ling Shao, Jingkuan Song |
| 2017 | ICDM | Synchronization-Inspired Co-Clustering and Its Application to Gene Expression Data. | Junming Shao, Chongming Gao, Wei Zeng, Jingkuan Song, Qinli Yang |
| 2017 | IJCAI | Hierarchical LSTM with Adjusted Temporal Attention for Video Captioning. | Jingkuan Song, Lianli Gao, Zhao Guo, Wu Liu, Dongxiang Zhang, Heng Tao Shen |
| 2017 | MICCAI | Unsupervised Discovery of Spatially-Informed Lung Texture Patterns for Pulmonary Emphysema: The MESA COPD Study. | Jie Yang, Elsa D. Angelini, Pallavi P. Balte, Eric A. Hoffman, John H. M. Austin, Benjamin M. Smith, Jingkuan Song, R. Graham Barr, Andrew F. Laine |
| 2017 | SIGIR | Classification by Retrieval: Binarizing Data and Classifiers. | Fumin Shen, Yadong Mu, Yang Yang, Wei Liu, Li Liu, Jingkuan Song, Heng Tao Shen |
| 2016 | AAAI | Graph-without-cut: An Ideal Graph Learning for Image Segmentation. | Lianli Gao, Jingkuan Song, Feiping Nie, Fuhao Zou, Nicu Sebe, Heng Tao Shen |
| 2016 | ACCV | Multi-cue Information Fusion for Two-Layer Activity Recognition. | Yanli Ji, Jiaming Li, Hong Cheng, Xing Xu, Jingkuan Song |
| 2016 | ICPR | Multi-Paced Dictionary Learning for cross-domain retrieval and recognition. | Dan Xu, Jingkuan Song, Xavier Alameda-Pineda, Elisa Ricci, Nicu Sebe |
| 2015 | BMVC | Learning Deep Representations of Appearance and Motion for Anomalous Event Detection. | Dan Xu, Elisa Ricci, Yan Yan, Jingkuan Song, Nicu Sebe |
| 2015 | CVPR | Optimal graph learning with partial tags and multiple features for image and video annotation. | Lianli Gao, Jingkuan Song, Feiping Nie, Yan Yan, Nicu Sebe, Heng Tao Shen |
| 2015 | ICCV | Localize Me Anywhere, Anytime: A Multi-task Point-Retrieval Approach. | Guoyu Lu, Yan Yan, Li Ren, Jingkuan Song, Nicu Sebe, Chandra Kambhamettu |
| 2014 | ICIP | Minimizing dataset bias: Discriminative multi-task sparse coding through shared subspace learning for image classification. | Gaowen Liu, Yan Yan, Jingkuan Song, Nicu Sebe |
| 2013 | SIGMOD | Effective hashing for large-scale multimedia search. | Jingkuan Song |
| 2013 | SIGMOD | Inter-media hashing for large-scale retrieval from heterogeneous data sources. | Jingkuan Song, Yang Yang, Yi Yang, Zi Huang, Heng Tao Shen |