| 2026 | ISKE | Temporal Bipartite Graph Representation Learning for Behavior Anomaly Detection. | Yu Kong, Yuanyuan Xu, Dong Wen, Yu Zhang, Binghao Li, Wenjie Zhang |
| 2026 | WACV | Show Me: Unifying Instructional Image and Video Generation with Diffusion Models. | Yujiang Pu, Zhanbo Huang, Vishnu Boddeti, Yu Kong |
| 2025 | CVPR | H-MoRe: Learning Human-centric Motion Representation for Action Analysis. | Zhanbo Huang, Xiaoming Liu, Yu Kong |
| 2025 | CVPR | Window Token Concatenation for Efficient Visual Large Language Models. | Yifan Li, Wentao Bao, Botao Ye, Zhen Tan, Tianlong Chen, Huan Liu, Yu Kong |
| 2025 | ICCV | Svit-Split: Unleashing the Power of Vision Foundation Models Via Efficient Splitting Heads. | Yifan Li, Xin Li, Tianqin Li, Wenbin He, Yu Kong, Liu Ren |
| 2025 | WACV | Exploiting VLM Localizability and Semantics for Open Vocabulary Action Detection. | Wentao Bao, Kai Li, Yuxiao Chen, Deep Patel, Martin Renqiang Min, Yu Kong |
| 2024 | ECCV | Prompting Language-Informed Distribution for Compositional Zero-Shot Learning. | Wentao Bao, Lichang Chen, Heng Huang, Yu Kong |
| 2024 | ECCV | SHINE: Saliency-Aware Hierarchical Negative Ranking for Compositional Temporal Grounding. | Zixu Cheng, Yujiang Pu, Shaogang Gong, Parisa Kordjamshidi, Yu Kong |
| 2024 | ECCV | Learning to Localize Actions in Instructional Videos with LLM-Based Multi-pathway Text-Video Alignment. | Yuxiao Chen, Kai Li, Wentao Bao, Deep Patel, Yu Kong, Martin Renqiang Min, Dimitris N. Metaxas |
| 2024 | ECCV | Facial Affective Behavior Analysis with Instruction Tuning. | Yifan Li, Anh Dao, Wentao Bao, Zhen Tan, Tianlong Chen, Huan Liu, Yu Kong |
| 2024 | IJCAI | A Survey of Multimodal Sarcasm Detection. | Shafkat Farabi, Tharindu Ranasinghe, Diptesh Kanojia, Yu Kong, Marcos Zampieri |
| 2023 | ADC | IFGNN: An Individual Fairness Awareness Model for Missing Sensitive Information Graphs. | Kejia Xu, Zeming Fei, Jianke Yu, Yu Kong, Xiaoyang Wang, Wenjie Zhang |
| 2023 | CVPR | Catch Missing Details: Image Reconstruction with Frequency Augmented Variational Autoencoder. | Xinmiao Lin, Yikang Li, Jenhao Hsiao, Chiuman Ho, Yu Kong |
| 2023 | ICCV | Uncertainty-aware State Space Transformer for Egocentric 3D Hand Trajectory Forecasting. | Wentao Bao, Lele Chen, Libing Zeng, Zhong Li, Yi Xu, Junsong Yuan, Yu Kong |
| 2023 | WACV | Ancestor Search: Generalized Open Set Recognition via Hyperbolic Side Information Learning. | Xiwen Dengxiong, Yu Kong |
| 2022 | AAAI | A Dynamic Meta-Learning Model for Time-Sensitive Cold-Start Recommendations. | Krishna Prasad Neupane, Ervine Zheng, Yu Kong, Qi Yu |
| 2022 | CVPR | OpenTAL: Towards Open Set Temporal Action Localization. | Wentao Bao, Qi Yu, Yu Kong |
| 2022 | CVPR | GateHUB: Gated History Unit with Background Suppression for Online Action Detection. | Junwen Chen, Gaurav Mittal, Ye Yu, Yu Kong, Mei Chen |
| 2022 | CVPR | Learning of Global Objective for Network Flow in Multi-Object Tracking. | Shuai Li, Yu Kong, Hamid Rezatofighi |
| 2022 | SP | Universal 3-Dimensional Perturbations for Black-Box Attacks on Video Recognition Systems. | Shangyu Xie, Han Wang, Yu Kong, Yuan Hong |
| 2021 | BMVC | Gradient Frequency Modulation for Visually Explaining Video Understanding Models. | Xinmiao Lin, Wentao Bao, Matthew K. Wright, Yu Kong |
| 2021 | ICCV | DRIVE: Deep Reinforced Accident Anticipation with Visual Explanation. | Wentao Bao, Qi Yu, Yu Kong |
| 2021 | ICCV | Evidential Deep Learning for Open Set Action Recognition. | Wentao Bao, Qi Yu, Yu Kong |
| 2021 | IJCNN | Multiple Instance Relational Learning for Video Anomaly Detection. | Xiwen Dengxiong, Wentao Bao, Yu Kong |
| 2020 | CVPR | RIT-18: A Novel Dataset for Compositional Group Activity Understanding. | Junwen Chen, Haiting Hao, Hanbin Hong, Yu Kong |
| 2020 | ECCV | Group Activity Prediction with Sequential Relational Anticipation Model. | Junwen Chen, Wentao Bao, Yu Kong |
| 2020 | EDBT | Publishing Video Data with Indistinguishable Objects. | Han Wang, Yuan Hong, Yu Kong, Jaideep Vaidya |
| 2020 | ICPR | Privacy Attributes-aware Message Passing Neural Network for Visual Privacy Attributes Classification. | Hanbin Hong, Wentao Bao, Yuan Hong, Yu Kong |
| 2020 | IJCAI | Few-shot Human Motion Prediction via Learning Novel Motion Dynamics. | Chuanqi Zang, Mingtao Pei, Yu Kong |
| 2020 | IROS | Object-Aware Centroid Voting for Monocular 3D Object Detection. | Wentao Bao, Qi Yu, Yu Kong |
| 2019 | ICDAR | Cascaded Detail-Preserving Networks for Super-Resolution of Document Images. | Zhichao Fu, Yu Kong, Yingbin Zheng, Hao Ye, Wenxin Hu, Jing Yang, Liang He |
| 2018 | AAAI | Action Prediction From Videos via Memorizing Hard-to-Predict Samples. | Yu Kong, Shangqian Gao, Bin Sun, Yun Fu |
| 2018 | CVPR | Residual Dense Network for Image Super-Resolution. | Yulun Zhang, Yapeng Tian, Yu Kong, Bineng Zhong, Yun Fu |
| 2018 | ICDM | Clustered Lifelong Learning Via Representative Task Selection. | Gan Sun, Yang Cong, Yu Kong, Xiaowei Xu |
| 2017 | AAAI | Sparse Subspace Clustering by Learning Approximation ℓ0 Codes. | Jun Li, Yu Kong, Yun Fu |
| 2017 | CVPR | Deep Sequential Context Networks for Action Prediction. | Yu Kong, Zhiqiang Tao, Yun Fu |
| 2017 | IJCAI | Multi-Stream Deep Similarity Learning Networks for Visual Tracking. | Kunpeng Li, Yu Kong, Yun Fu |
| 2015 | CVPR | Bilinear heterogeneous information machine for RGB-D action recognition. | Yu Kong, Yun Fu |
| 2014 | ECCV | Modeling Supporting Regions for Close Human Interaction Recognition. | Yu Kong, Yun Fu |
| 2014 | ECCV | A Discriminative Model with Multiple Temporal Scales for Action Prediction. | Yu Kong, Dmitry Kit, Yun Fu |
| 2014 | IJCNN | LASOM: Location Aware Self-Organizing Map for discovering similar and unique visual features of geographical locations. | Dmitry Kit, Yu Kong, Yun Fu |
| 2012 | BMVC | Contour-HOG: A Stub Feature based Level Set Method for Learning Object Contour. | Zhi Yang, Yu Kong, Yun Fu |
| 2012 | ECCV | Learning Human Interaction by Interactive Phrases. | Yu Kong, Yunde Jia, Yun Fu |
| 2012 | ICPR | Action recognition with discriminative mid-level features. | Cuiwei Liu, Yu Kong, Xinxiao Wu, Yunde Jia |
| 2012 | ICPR | Decomposed contour prior for shape recognition. | Zhi Yang, Yu Kong, Yun Fu |
| 2010 | CVPR | A swarm intelligence based searching strategy for articulated 3D human body tracking. | Xiaoqin Zhang, Weiming Hu, Xiangyang Wang, Yu Kong, Nianhua Xie, Hanzi Wang, Haibin Ling, Stephen J. Maybank |
| 2010 | ICIP | Compact visual codebook for action recognition. | Qingdi Wei, Xiaoqin Zhang, Yu Kong, Weiming Hu, Haibin Ling |
| 2009 | ACCV | Learning Group Activity in Soccer Videos from Local Motion. | Yu Kong, Weiming Hu, Xiaoqin Zhang, Hanzi Wang, Yunde Jia |
| 2009 | ISVC | Group Action Recognition Using Space-Time Interest Points. | Qingdi Wei, Xiaoqin Zhang, Yu Kong, Weiming Hu, Haibin Ling |
| 2008 | ICPR | Group action recognition in soccer videos. | Yu Kong, Xiaoqin Zhang, Qingdi Wei, Weiming Hu, Yunde Jia |