| 2026 | AAAI | PA-FAS: Towards Interpretable and Generalizable Multimodal Face Anti-Spoofing via Path-Augmented Reinforcement Learning. | Yingjie Ma, Xun Lin, Yong Xu, Weicheng Xie, Zitong Yu |
| 2026 | AAAI | FaceShield: Explainable Face Anti-Spoofing with Multimodal Large Language Models. | Hongyang Wang, Yichen Shi, Zhuofu Tao, Yuhao Gao, Liepiao Zhang, Xun Lin, Jun Feng, Xiaochen Yuan, Zitong Yu, Xiaochun Cao |
| 2026 | AAAI | SUGAR: Learning Skeleton Representation with Visual-Motion Knowledge for Action Recognition. | Qilang Ye, Yu Zhou, Lian He, Jie Zhang, Xuanming Guo, Jiayu Zhang, Mingkui Tan, Weicheng Xie, Yue Sun, Tao Tan, Xiaochen Yuan, Ghada Khoriba, Zitong Yu |
| 2026 | AAAI | When Eyes and Ears Disagree: Can MLLMs Discern Audio-Visual Confusion? | Qilang Ye, Wei Zeng, Meng Liu, Jie Zhang, Yupeng Hu, Zitong Yu, Yu Zhou |
| 2026 | AAAI | H-GAR: A Hierarchical Interaction Framework via Goal-Driven Observation-Action Refinement for Robotic Manipulation. | Yijie Zhu, Rui Shao, Ziyang Liu, Jie He, Jizhihui Liu, Jiuru Wang, Zitong Yu |
| 2026 | ACL | Retrieving to Recover: Towards Incomplete Audio-Visual Question Answering via Semantic-consistent Purification. | Jiayu Zhang, Shuo Ye, Qilang Ye, Zihan Song, Jiajian Huang, Zitong Yu |
| 2025 | AAAI | Few-Shot Audio-Visual Class-Incremental Learning with Temporal Prompting and Regularization. | Yawen Cui, Li Liu, Zitong Yu, Guanjie Huang, Xiaopeng Hong |
| 2025 | AAAI | MSAmba: Exploring Multimodal Sentiment Analysis with State Space Models. | Xilin He, Haijian Liang, Boyi Peng, Weicheng Xie, Muhammad Haris Khan, Siyang Song, Zitong Yu |
| 2025 | AAAI | CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing. | Xiaole Xian, Xilin He, Zenghao Niu, Junliang Zhang, Weicheng Xie, Siyang Song, Zitong Yu, Linlin Shen |
| 2025 | CVPR | FSBench: A Figure Skating Benchmark for Advancing Artistic Sports Understanding. | Rong Gao, Xin Liu, Zhuozhao Hu, Bohao Xing, Baiqiang Xia, Zitong Yu, Heikki Klviinen |
| 2025 | CVPR | MoEdit: On Learning Quantity Perception for Multi-object Image Editing. | Yanfeng Li, Ka-Hou Chan, Yue Sun, Chan-Tong Lam, Tong Tong, Zitong Yu, Keren Fu, Xiaohong Liu, Tao Tan |
| 2025 | EMNLP | Dynamic Collaboration of Multi-Language Models based on Minimal Complete Semantic Units. | Chao Hao, Zezheng Wang, Yanhua Huang, Ruiwen Xu, Wenzhe Niu, Xin Liu, Zitong Yu |
| 2025 | ICASSP | EPE-P: Evidence-based Parameter-efficient Prompting for Multimodal Learning with Missing Modalities. | Zhe Chen, Xun Lin, Yawen Cui, Zitong Yu |
| 2025 | ICASSP | PGD-Imp: Rethinking and Unleashing Potential of Classic PGD with Dual Strategies for Imperceptible Adversarial Attacks. | Jin Li, Zitong Yu, Ziqiang He, Z. Jane Wang, Xiangui Kang |
| 2025 | ICASSP | Big-Moe: Bypassing Isolated Gating For Generalized Multimodal Face Anti-Spoofing. | Yingjie Ma, Zitong Yu, Xun Lin, Weicheng Xie, Linlin Shen |
| 2025 | ICCV | Enhancing Adversarial Transferability by Balancing Exploration and Exploitation with Gradient-Guided Sampling. | Zenghao Niu, Weicheng Xie, Siyang Song, Zitong Yu, Feng Liu, Linlin Shen |
| 2025 | ICCV | DADM: Dual Alignment of Domain and Modality for Face Anti-Spoofing. | Jingyi Yang, Xun Lin, Zitong Yu, Liepiao Zhang, Xin Liu, Hui Li, Xiaochen Yuan, Xiaochun Cao |
| 2025 | ICLR | Kronecker Mask and Interpretive Prompts are Language-Action Video Learners. | Jingyi Yang, Zitong Yu, Xiuming Ni, Jia He, Hui Li |
| 2025 | IJCAI | Multimodal Fake News Detection: MFND Dataset and Shallow-Deep Multitask Learning. | Ye Zhu, Yunan Wang, Zitong Yu |
| 2025 | MICCAI | BiMSRec: A Progressive Image Reconstruction Framework for Medical Image Fusion Guided by Multi-scale Deformation Fields. | Nuoer Long, Kaiwen Yang, Xinyu Xie, Zitong Yu, Tao Tan, Yue Sun |
| 2025 | MICCAI | TRRG: Towards Truthful Radiology Report Generation With Cross-Modal Disease Clue Enhanced Large Language Models. | Yuhao Wang, Yue Sun, Tao Tan, Chao Hao, Yawen Cui, Xinqi Su, Weicheng Xie, Linlin Shen, Zitong Yu |
| 2025 | MICCAI | MedIQA: A Scalable Foundation Model for Prompt-Driven Medical Image Quality Assessment. | Siyi Xun, Yue Sun, Jingkun Chen, Zitong Yu, Tong Tong, Xiaohong Liu, Mingxiang Wu, Tao Tan |
| 2025 | VTC | BeamLLM: Vision-Empowered mmWave Beam Prediction with Large Language Models. | Can Zheng, Jiguang He, Guofa Cai, Zitong Yu, Chung Gu Kang |
| 2024 | BMVC | Difflare: Removing Image Lens Flare with Latent Diffusion Models. | Tianwen Zhou, Qihao Duan, Zitong Yu |
| 2024 | CVPR | GPT as Psychologist? Preliminary Evaluations for GPT-4V on Visual Affective Computing. | Hao Lu, Xuesong Niu, Jiyao Wang, Yin Wang, Qingyong Hu, Jiaqi Tang, Yuting Zhang, Kaishen Yuan, Bin Huang, Zitong Yu, Dengbo He, Shuiguang Deng, Hao Chen, Yingcong Chen, Shiguang Shan |
| 2024 | CVPR | Suppress and Rebalance: Towards Generalized Multi-Modal Face Anti-Spoofing. | Xun Lin, Shuai Wang, Rizhao Cai, Yizhong Liu, Ying Fu, Wenzhong Tang, Zitong Yu, Alex C. Kot |
| 2024 | ECAI | Generalized Face Anti-Spoofing via Finer Domain Partition and Disentangling Liveness-Irrelevant Factors. | Jingyi Yang, Zitong Yu, Xiuming Ni, Jia He, Hui Li |
| 2024 | ECCV | DiffFAS: Face Anti-spoofing via Generative Diffusion Models. | Xinxu Ge, Xin Liu, Zitong Yu, Jingang Shi, Chun Qi, Jie Li, Heikki Klviinen |
| 2024 | ECCV | MTaDCS: Moving Trace and Feature Density-Based Confidence Sample Selection Under Label Noise. | Qingzheng Huang, Xilin He, Xiaole Xian, Qinliang Lin, Weicheng Xie, Siyang Song, Linlin Shen, Zitong Yu |
| 2024 | ECCV | CAT: Enhancing Multimodal Large Language Model to Answer Questions in Dynamic Audio-Visual Scenarios. | Qilang Ye, Zitong Yu, Rui Shao, Xinyu Xie, Philip Torr, Xiaochun Cao |
| 2024 | ECCV | AUFormer: Vision Transformers Are Parameter-Efficient Facial Action Unit Detectors. | Kaishen Yuan, Zitong Yu, Xin Liu, Weicheng Xie, Huanjing Yue, Jingyu Yang |
| 2023 | AAAI | Learning Motion-Robust Remote Photoplethysmography through Arbitrary Resolution Videos. | Jianwei Li, Zitong Yu, Jingang Shi |
| 2023 | CVPR | Neuron Structure Modeling for Generalizable Remote Physiological Measurement. | Hao Lu, Zitong Yu, Xuesong Niu, Yingcong Chen |
| 2023 | CVPR | Flexible-Modal Face Anti-Spoofing: A Benchmark. | Zitong Yu, Ajian Liu, Chenxu Zhao, Kevin H. M. Cheng, Xu Cheng, Guoying Zhao |
| 2023 | ICCV | Rehearsal-Free Domain Continual Face Anti-Spoofing: Generalize More and Forget Less. | Rizhao Cai, Yawen Cui, Zhi Li, Zitong Yu, Haoliang Li, Yongjian Hu, Alex C. Kot |
| 2023 | ICCV | Audio-Visual Deception Detection: DOLOS Dataset and Parameter-Efficient Crossmodal Learning. | Xiaobao Guo, Nithish Muthuchamy Selvaraj, Zitong Yu, Adams Wai-Kin Kong, Bingquan Shen, Alex C. Kot |
| 2022 | AAAI | Geometry-Contrastive Transformer for Generalized 3D Pose Transfer. | Haoyu Chen, Hao Tang, Zitong Yu, Nicu Sebe, Guoying Zhao |
| 2022 | CVPR | Domain Generalization via Shuffled Style Assembly for Face Anti-Spoofing. | Zhuo Wang, Zezheng Wang, Zitong Yu, Weihong Deng, Jiahong Li, Tingting Gao, Zhongyuan Wang |
| 2022 | CVPR | PhysFormer: Facial Video-based Physiological Measurement with Temporal Difference Transformer. | Zitong Yu, Yuming Shen, Jingang Shi, Hengshuang Zhao, Philip H. S. Torr, Guoying Zhao |
| 2022 | ICIP | Benchmarking 3D Face De-Identification with Preserving Facial Attributes. | Kevin H. M. Cheng, Zitong Yu, Haoyu Chen, Guoying Zhao |
| 2022 | ICIP | Vitranspad: Video Transformer Using Convolution And Self-Attention For Face Presentation Attack Detection. | Zuheng Ming, Zitong Yu, Musab Al-Ghadi, Muriel Visani, Muhammad Muzzamil Luqman, Jean-Christophe Burie |
| 2022 | IJCAI | IDPT: Interconnected Dual Pyramid Transformer for Face Super-Resolution. | Jingang Shi, Yusi Wang, Songlin Dong, Xiaopeng Hong, Zitong Yu, Fei Wang, Changxin Wang, Yihong Gong |
| 2021 | CVPR | iMiGUE: An Identity-Free Video Dataset for Micro-Gesture Understanding and Emotion Analysis. | Xin Liu, Henglin Shi, Haoyu Chen, Zitong Yu, Xiaobai Li, Guoying Zhao |
| 2021 | ICCV | Pixel Difference Networks for Efficient Edge Detection. | Zhuo Su, Wenzhe Liu, Zitong Yu, Dewen Hu, Qing Liao, Qi Tian, Matti Pietikinen, Li Liu |
| 2021 | IJCAI | Non-contact Pain Recognition from Video Sequences with Remote Physiological Measurements Prediction. | Ruijing Yang, Ziyu Guan, Zitong Yu, Xiaoyi Feng, Jinye Peng, Guoying Zhao |
| 2021 | IJCAI | Dual-Cross Central Difference Network for Face Anti-Spoofing. | Zitong Yu, Yunxiao Qin, Hengshuang Zhao, Xiaobai Li, Guoying Zhao |
| 2020 | AAAI | Learning Meta Model for Zero- and Few-Shot Face Anti-Spoofing. | Yunxiao Qin, Chenxu Zhao, Xiangyu Zhu, Zezheng Wang, Zitong Yu, Tianyu Fu, Feng Zhou, Jingping Shi, Zhen Lei |
| 2020 | CVPR | The 1st Challenge on Remote Physiological Signal Sensing (RePSS). | Xiaobai Li, Hu Han, Hao Lu, Xuesong Niu, Zitong Yu, Antitza Dantcheva, Guoying Zhao, Shiguang Shan |
| 2020 | CVPR | Deep Spatial Gradient and Temporal Depth Learning for Face Anti-Spoofing. | Zezheng Wang, Zitong Yu, Chenxu Zhao, Xiangyu Zhu, Yunxiao Qin, Qiusheng Zhou, Feng Zhou, Zhen Lei |
| 2020 | CVPR | Multi-Modal Face Anti-Spoofing Based on Central Difference Networks. | Zitong Yu, Yunxiao Qin, Xiaobai Li, Zezheng Wang, Chenxu Zhao, Zhen Lei, Guoying Zhao |
| 2020 | CVPR | Searching Central Difference Convolutional Networks for Face Anti-Spoofing. | Zitong Yu, Chenxu Zhao, Zezheng Wang, Yunxiao Qin, Zhuo Su, Xiaobai Li, Feng Zhou, Guoying Zhao |
| 2020 | ECCV | Video-Based Remote Physiological Measurement via Cross-Verified Feature Disentangling. | Xuesong Niu, Zitong Yu, Hu Han, Xiaobai Li, Shiguang Shan, Guoying Zhao |
| 2020 | ECCV | Face Anti-Spoofing with Human Material Perception. | Zitong Yu, Xiaobai Li, Xuesong Niu, Jingang Shi, Guoying Zhao |
| 2020 | ICASSP | Auto-Fas: Searching Lightweight Networks for Face Anti-Spoofing. | Zitong Yu, Yunxiao Qin, Xiaqing Xu, Chenxu Zhao, Zezheng Wang, Zhen Lei, Guoying Zhao |
| 2019 | BMVC | Remote Photoplethysmograph Signal Measurement from Facial Videos Using Spatio-Temporal Networks. | Zitong Yu, Xiaobai Li, Guoying Zhao |
| 2019 | ICCV | Remote Heart Rate Measurement From Highly Compressed Facial Videos: An End-to-End Deep Learning Solution With Video Enhancement. | Zitong Yu, Wei Peng, Xiaobai Li, Xiaopeng Hong, Guoying Zhao |