| 2026 | AAAI | CKDA: Cross-modality Knowledge Disentanglement and Alignment for Visible-Infrared Lifelong Person Re-identification. | Zhenyu Cui, Jiahuan Zhou, Yuxin Peng |
| 2026 | AAAI | HD²-SSC: High-Dimension High-Density Semantic Scene Completion for Autonomous Driving. | Zhiwen Yang, Yuxin Peng |
| 2025 | AAAI | DASK: Distribution Rehearsing via Adaptive Style Kernel Learning for Exemplar-Free Lifelong Person Re-Identification. | Kunlun Xu, Chenghao Jiang, Peixi Xiong, Yuxin Peng, Jiahuan Zhou |
| 2025 | AAAI | Selective Visual Prompting in Vision Mamba. | Yifeng Yao, Zichen Liu, Zhenyu Cui, Yuxin Peng, Jiahuan Zhou |
| 2025 | CVPR | EmoDubber: Towards High Quality and Emotion Controllable Movie Dubbing. | Gaoxiang Cong, Jiadong Pan, Liang Li, Yuankai Qi, Yuxin Peng, Anton van den Hengel, Jian Yang, Qingming Huang |
| 2025 | CVPR | DKC: Differentiated Knowledge Consolidation for Cloth-Hybrid Lifelong Person Re-identification. | Zhenyu Cui, Jiahuan Zhou, Yuxin Peng |
| 2025 | CVPR | ConMo: Controllable Motion Disentanglement and Recomposition for Zero-Shot Motion Transfer. | Jiayi Gao, Zijin Yin, Changcheng Hua, Yuxin Peng, Kongming Liang, Zhanyu Ma, Jun Guo, Yang Liu |
| 2025 | CVPR | PosterO: Structuring Layout Trees to Enable Language Models in Generalized Content-Aware Layout Generation. | HsiaoYuan Hsu, Yuxin Peng |
| 2025 | CVPR | STOP: Integrated Spatial-Temporal Dynamic Prompting for Video Understanding. | Zichen Liu, Kunlun Xu, Bing Su, Xu Zou, Yuxin Peng, Jiahuan Zhou |
| 2025 | CVPR | DyFo: A Training-Free Dynamic Focus Visual Search for Enhancing LMMs in Fine-Grained Visual Understanding. | Geng Li, Jinglin Xu, Yunzhen Zhao, Yuxin Peng |
| 2025 | CVPR | SCAP: Transductive Test-Time Adaptation via Supportive Clique-based Attribute Prompting. | Chenyu Zhang, Kunlun Xu, Zichen Liu, Yuxin Peng, Jiahuan Zhou |
| 2025 | ICCV | UPP: Unified Point-Level Prompting for Robust Point Cloud Analysis. | Zixiang Ai, Zhenyu Cui, Yuxin Peng, Jiahuan Zhou |
| 2025 | ICCV | Open-Vocabulary Hoi Detection With Interaction-Aware Prompt and Concept Calibration. | Ting Lei, Shaofeng Yin, Qingchao Chen, Yuxin Peng, Yang Liu |
| 2025 | ICCV | TRKT: Weakly Supervised Dynamic Scene Graph Generation with Temporal-Enhanced Relation-Aware Knowledge Transferring. | Zhu Xu, Ting Lei, Zhimin Li, Guan Wang, Qingchao Chen, Yuxin Peng, Yang Liu |
| 2025 | ICCV | Hierarchical Event Memory for Accurate and Low-Latency Online Video Temporal Grounding. | Minghang Zheng, Yuxin Peng, Benyuan Sun, Yi Yang, Yang Liu |
| 2025 | ICLR | MAI: A Multi-turn Aggregation-Iteration Model for Composed Image Retrieval. | Yanzhe Chen, Zhiwen Yang, Jinglin Xu, Yuxin Peng |
| 2025 | ICLR | Analyzing and Boosting the Power of Fine-Grained Visual Recognition for Multi-modal Large Language Models. | Hulingxiao He, Geng Li, Zijun Geng, Jinglin Xu, Yuxin Peng |
| 2025 | ICML | Balancing Preservation and Modification: A Region and Semantic Aware Metric for Instruction-Based Image Editing. | Zhuoying Li, Zhu Xu, Yuxin Peng, Yang Liu |
| 2025 | IJCAI | Scan-and-Print: Patch-level Data Summarization and Augmentation for Content-aware Layout Generation in Poster Design. | HsiaoYuan Hsu, Yuxin Peng |
| 2024 | AAAI | FashionERN: Enhance-and-Refine Network for Composed Fashion Image Retrieval. | Yanzhe Chen, Huasong Zhong, Xiangteng He, Yuxin Peng, Jiahuan Zhou, Lele Cheng |
| 2024 | AAAI | Continual Vision-Language Retrieval via Dynamic Knowledge Rectification. | Zhenyu Cui, Yuxin Peng, Xun Wang, Manyu Zhu, Jiahuan Zhou |
| 2024 | AAAI | Comprehensive Visual Grounding for Video Description. | Wenhui Jiang, Yibo Cheng, Linxin Liu, Yuming Fang, Yuxin Peng, Yang Liu |
| 2024 | AAAI | DART: Dual-Modal Adaptive Online Prompting and Knowledge Retention for Test-Time Adaptation. | Zichen Liu, Hongbo Sun, Yuxin Peng, Jiahuan Zhou |
| 2024 | CVPR | Learning Continual Compatible Representation for Re-indexing Free Lifelong Person Re-identification. | Zhenyu Cui, Jiahuan Zhou, Xun Wang, Manyu Zhu, Yuxin Peng |
| 2024 | CVPR | FCS: Feature Calibration and Separation for Non-Exemplar Class Incremental Learning. | Qiwei Li, Yuxin Peng, Jiahuan Zhou |
| 2024 | CVPR | FinePOSE: Fine-Grained Prompt-Driven 3D Human Pose Estimation via Diffusion Models. | Jinglin Xu, Yijie Guo, Yuxin Peng |
| 2024 | CVPR | FineParser: A Fine-Grained Spatio-Temporal Action Parser for Human-Centric Action Quality Assessment. | Jinglin Xu, Sibo Yin, Guohao Zhao, Zishuo Wang, Yuxin Peng |
| 2024 | CVPR | Distribution-Aware Knowledge Prototyping for Non-Exemplar Lifelong Person Re-Identification. | Kunlun Xu, Xu Zou, Yuxin Peng, Jiahuan Zhou |
| 2024 | CVPR | FineSports: A Multi-Person Hierarchical Sports Video Dataset for Fine-Grained Action Understanding. | Jinglin Xu, Guohao Zhao, Sibo Yin, Wenhao Zhou, Yuxin Peng |
| 2024 | ECCV | Exploring Conditional Multi-modal Prompts for Zero-Shot HOI Detection. | Ting Lei, Shaofeng Yin, Yuxin Peng, Yang Liu |
| 2024 | ECCV | Training-Free Video Temporal Grounding Using Large-Scale Pre-trained Models. | Minghang Zheng, Xinhao Cai, Qingchao Chen, Yuxin Peng, Yang Liu |
| 2024 | ICDE | Firzen: Firing Strict Cold-Start Items with Frozen Heterogeneous and Homogeneous Graphs for Recommendation. | Hulingxiao He, Xiangteng He, Yuxin Peng, Zifei Shan, Xin Su |
| 2024 | ICML | Semantic-Aware Human Object Interaction Image Generation. | Zhu Xu, Qingchao Chen, Yuxin Peng, Yang Liu |
| 2024 | IJCAI | FineFMPL: Fine-grained Feature Mining Prompt Learning for Few-Shot Class Incremental Learning. | Hongbo Sun, Jiahuan Zhou, Xiangteng He, Jinglin Xu, Yuxin Peng |
| 2024 | MMM | Self-supervised Edge Structure Learning for Multi-view Stereo and Parallel Optimization. | Pan Li, Suping Wu, Xitie Zhang, Yuxin Peng, Boyang Zhang, Bin Wang |
| 2023 | AAAI | Phrase-Level Temporal Relationship Mining for Temporal Sentence Localization. | Minghang Zheng, Sizhe Li, Qingchao Chen, Yuxin Peng, Yang Liu |
| 2023 | ACL | Generating Structured Pseudo Labels for Noise-resistant Zero-shot Video Sentence Localization. | Minghang Zheng, Shaogang Gong, Hailin Jin, Yuxin Peng, Yang Liu |
| 2023 | CVPR | PosterLayout: A New Benchmark and Approach for Content-Aware Visual-Textual Presentation Layout. | HsiaoYuan Hsu, Xiangteng He, Yuxin Peng, Hao Kong, Qing Zhang |
| 2023 | ICCV | Efficient Adaptive Human-Object Interaction Detection with Concept-guided Memory. | Ting Lei, Fabian Caba, Qingchao Chen, Hailin Jin, Yuxin Peng, Yang Liu |
| 2023 | ICCV | Confidence-aware Pseudo-label Learning for Weakly Supervised Visual Grounding. | Yang Liu, Jiahua Zhang, Qingchao Chen, Yuxin Peng |
| 2023 | ICCV | Scanning Only Once: An End-to-end Framework for Fast Temporal Grounding in Long Videos. | Yulin Pan, Xiangteng He, Biao Gong, Yiliang Lv, Yujun Shen, Yuxin Peng, Deli Zhao |
| 2023 | ICCV | Masked Retraining Teacher-Student Framework for Domain Adaptive Object Detection. | Zijing Zhao, Sitong Wei, Qingchao Chen, Dehui Li, Yifan Yang, Yuxin Peng, Yang Liu |
| 2023 | ICIG | DensityLayout: Density-Conditioned Layout GAN for Visual-Textual Presentation Designs. | HsiaoYuan Hsu, Xiangteng He, Yuxin Peng |
| 2023 | ICIG | Uncover the Body: Occluded Person Re-identification via Masked Image Modeling. | Kunlun Xu, Yuxin Peng, Jiahuan Zhou |
| 2023 | ICIP | Multi Hybrid Extractor Network for 3D Human Pose Estimation. | Zhixiang Yuan, Xitie Zhang, Suping Wu, Boyang Zhang, Yuxin Peng, Bing Wang |
| 2023 | WWW | Multi-Behavior Recommendation with Cascading Graph Convolution Networks. | Zhiyong Cheng, Sai Han, Fan Liu, Lei Zhu, Zan Gao, Yuxin Peng |
| 2022 | BMVC | Global Contextual Complementary Network for Multi-View Stereo. | Yongrong Cao, Suping Wu, Xing Zheng, Bin Wang, Pan Li, Zhixiang Yuan, Lei Lin, Yuxin Peng |
| 2022 | CVPR | Weakly Supervised Temporal Sentence Grounding with Gaussian-based Contrastive Proposal Learning. | Minghang Zheng, Yanjie Huang, Qingchao Chen, Yuxin Peng, Yang Liu |
| 2022 | SIGIR | Learn from Unlabeled Videos for Near-duplicate Video Retrieval. | Xiangteng He, Yulin Pan, Mingqian Tang, Yiliang Lv, Yuxin Peng |
| 2019 | CVPR | Object-Aware Aggregation With Bidirectional Temporal Graph for Video Captioning. | Junchao Zhang, Yuxin Peng |
| 2019 | IJCAI | IRC-GAN: Introspective Recurrent Convolutional GAN for Text-to-video Generation. | Kangle Deng, Tianyi Fei, Xin Huang, Yuxin Peng |
| 2019 | MMM | Hierarchical Vision-Language Alignment for Video Captioning. | Junchao Zhang, Yuxin Peng |
| 2018 | AAAI | Unsupervised Generative Adversarial Cross-Modal Hashing. | Jian Zhang, Yuxin Peng, Mingkuan Yuan |
| 2018 | CVPR | Deep Cross-Media Knowledge Transfer. | Xin Huang, Yuxin Peng |
| 2018 | IJCAI | Dual Adversarial Networks for Zero-shot Cross-media Retrieval. | Jingze Chi, Yuxin Peng |
| 2018 | IJCAI | StackDRL: Stacked Deep Reinforcement Learning for Fine-grained Visual Categorization. | Xiangteng He, Yuxin Peng, Junjie Zhao |
| 2018 | IJCAI | Cross-modal Bidirectional Translation via Reinforcement Learning. | Jinwei Qi, Yuxin Peng |
| 2018 | IJCAI | Cross-media Multi-level Alignment with Relation Attention Network. | Jinwei Qi, Yuxin Peng, Yuxin Yuan |
| 2018 | IJCAI | Visual Data Synthesis via GAN for Zero-Shot Video Classification. | Chenrui Zhang, Yuxin Peng |
| 2018 | IJCAI | Better and Faster: Knowledge Transfer from Multiple Self-supervised Learning Tasks via Graph Distillation for Video Classification. | Chenrui Zhang, Yuxin Peng |
| 2018 | MMM | Recursive Pyramid Network with Joint Attention for Cross-Media Retrieval. | Yuxin Yuan, Yuxin Peng |
| 2018 | MMM | Cost-Sensitive Deep Metric Learning for Fine-Grained Image Classification. | Junjie Zhao, Yuxin Peng |
| 2017 | AAAI | Weakly Supervised Learning of Part Selection Model with Spatial Constraints for Fine-Grained Image Classification. | Xiangteng He, Yuxin Peng |
| 2017 | CVPR | Fine-Grained Image Classification via Combining Vision and Language. | Xiangteng He, Yuxin Peng |
| 2017 | ICIG | Attention-Sharing Correlation Learning for Cross-Media Retrieval. | Xin Huang, Zhaoda Ye, Yuxin Peng |
| 2017 | IJCAI | Cross-modal Common Representation Learning by Hybrid Transfer Network. | Xin Huang, Yuxin Peng, Mingkuan Yuan |
| 2016 | AAAI | Group Cost-Sensitive Boosting for Multi-Resolution Pedestrian Detection. | Chao Zhu, Yuxin Peng |
| 2016 | IJCAI | Cross-Media Shared Representation by Hierarchical Learning with Multiple Deep Networks. | Yuxin Peng, Xin Huang, Jinwei Qi |
| 2016 | MMM | Cross-Media Retrieval via Semantic Entity Projection. | Lei Huang, Yuxin Peng |
| 2016 | MMM | Logo Recognition via Improved Topological Constraint. | Panpan Tang, Yuxin Peng |
| 2015 | AAAI | Adaptive Sampling with Optimal Cost for Class-Imbalance Learning. | Yuxin Peng |
| 2015 | AAAI | A Boosted Multi-Task Model for Pedestrian Detection with Occlusion Handling. | Chao Zhu, Yuxin Peng |
| 2015 | CVPR | The application of two-level attention models in deep convolutional neural network for fine-grained image classification. | Tianjun Xiao, Yichong Xu, Kuiyuan Yang, Jiaxing Zhang, Yuxin Peng, Zheng Zhang |
| 2015 | KSEM | A Hierarchical Pachinko Allocation Model for Social Sentiment Mining. | Li Liu, Zi-Gang Huang, Yuxin Peng, Ming Liu |
| 2014 | AAAI | Cross-View Feature Learning for Scalable Social Image Analysis. | Wenxuan Xie, Yuxin Peng, Jianguo Xiao |
| 2014 | AAAI | Semantic Graph Construction for Weakly-Supervised Image Parsing. | Wenxuan Xie, Yuxin Peng, Jianguo Xiao |
| 2013 | AAAI | Unified Constraint Propagation on Multi-View Data. | Zhiwu Lu, Yuxin Peng |
| 2013 | AAAI | Heterogeneous Metric Learning with Joint Graph Regularization for Cross-Media Retrieval. | Xiaohua Zhai, Yuxin Peng, Jianguo Xiao |
| 2013 | ICIP | Cross-media retrieval by cluster-based correlation analysis. | Ding Ma, Xiaohua Zhai, Yuxin Peng |
| 2013 | ICIP | Multimodal semi-supervised image classification by combining tag refinement, graph-based learning and support vector regression. | Wenxuan Xie, Zhiwu Lu, Yuxin Peng, Jianguo Xiao |
| 2013 | IJCAI | Learning Descriptive Visual Representation by Semantic Regularized Matrix Factorization. | Zhiwu Lu, Yuxin Peng |
| 2012 | ICASSP | Cross-modality correlation propagation for cross-media retrieval. | Xiaohua Zhai, Yuxin Peng, Jianguo Xiao |
| 2012 | ICDM | Heterogeneous Constraint Propagation with Constrained Sparse Representation. | Zhiwu Lu, Yuxin Peng |
| 2012 | ICPR | Tri-space and ranking based heterogeneous similarity measure for cross-media retrieval. | Li Ling, Xiaohua Zhai, Yuxin Peng |
| 2012 | MMM | Visual Vocabulary Optimization with Spatial Context for Image Annotation and Classification. | Zhiguo Yang, Yuxin Peng, Jianguo Xiao |
| 2012 | MMM | Effective Heterogeneous Similarity Measure with Nearest Neighbors for Cross-Media Retrieval. | Xiaohua Zhai, Yuxin Peng, Jianguo Xiao |
| 2011 | AAAI | Symmetric Graph Regularized Constraint Propagation. | Zhenyong Fu, Zhiwu Lu, Horace Ho-Shing Ip, Yuxin Peng, Hongtao Lu |
| 2011 | AAAI | Latent Semantic Learning by Efficient Sparse Coding with Hypergraph Regularization. | Zhiwu Lu, Yuxin Peng |
| 2011 | ICCV | Spectral learning of latent semantics for action recognition. | Zhiwu Lu, Yuxin Peng, Horace Ho-Shing Ip |
| 2010 | ICPR | Effective Multi-level Image Representation for Image Categorization. | Hao Li, Yuxin Peng |
| 2010 | MMM | Story-Based Retrieval by Learning and Measuring the Concept-Based and Content-Based Similarity. | Yuxin Peng, Jianguo Xiao |
| 2009 | ICDAR | Using Multiple Frame Integration for the Text Recognition of Video. | Jian Yi, Yuxin Peng, Jianguo Xiao |
| 2008 | AAAI | From Comparing Clusterings to Combining Clusterings. | Zhiwu Lu, Yuxin Peng, Jianguo Xiao |
| 2008 | CVPR | Unsupervised learning of finite mixtures using entropy regularization and its application to image segmentation. | Zhiwu Lu, Yuxin Peng, Jianguo Xiao |
| 2007 | ACCV | A Theoretical Approach to Construct Highly Discriminative Features with Application in AdaBoost. | Yuxin Jin, Linmi Tao, Guangyou Xu, Yuxin Peng |
| 2005 | CIKM | The earth mover's distance as a semantic measure for document similarity. | Xiaojun Wan, Yuxin Peng |