| 2026 | AAAI | Dual-Geometry Graph Network: Unifying Local and Global Priors for Few-Shot Learning. | Zheng Han, Xiaobin Zhu, Chun Yang, Jingyan Qin, Xu-Cheng Yin |
| 2026 | AAAI | VCapsBench: A Large-scale Fine-grained Benchmark for Video Caption Quality Evaluation. | Shi-Xue Zhang, Hongfa Wang, Duojun Huang, Xin Li, Xiaobin Zhu, Xu-Cheng Yin |
| 2026 | AAAI | Predicting Emergent Tool Use in LLMs Before It Emerges: A Proxy Perspective. | Bowen Zhang, Yan Yan, Guang Liu, Xu-Cheng Yin |
| 2026 | ICDE | Querying Historical $k$-Dense Subgraphs on Temporal Graphs. | Qi Zhang, Yalong Zhang, Rong-Hua Li, Xu-Cheng Yin, Guoren Wang |
| 2025 | AAAI | AtomNet: Designing Tiny Models from Operators Under Extreme MCU Constraints. | Zhiwei Dong, Mingzhu Shen, Shihao Bai, Xiuying Wei, Jinyang Guo, Ruihao Gong, Song-Lu Chen, Xianglong Liu, Xu-Cheng Yin |
| 2025 | AAAI | FaceSpeak: Expressive and High-Quality Speech Synthesis from Human Portraits of Different Styles. | Tian-Hao Zhang, Jiawei Zhang, Jun Wang, Xinyuan Qian, Xu-Cheng Yin |
| 2025 | CVPR | DPFlow: Adaptive Optical Flow Estimation with a Dual-Pyramid Framework. | Henrique Morimitsu, Xiaobin Zhu, Roberto M. Cesar, Xiangyang Ji, Xu-Cheng Yin |
| 2025 | ICASSP | Joint Feature and Kernel Fusion for Improved Depth-Aware Panoptic Segmentation. | Yulong Bai, Shu Tian, Xin Zhao, Xu-Cheng Yin |
| 2025 | ICASSP | Tool Playgrounds: A Comprehensive and Analyzable Benchmark for LLM Tool Invocation. | Zhiwei Dong, Ruihao Gong, Yang Yong, Shuo Wu, Yongqiang Yao, Song-Lu Chen, Xu-Cheng Yin |
| 2025 | ICASSP | Breaking Through the Spike: Spike Window Decoding for Accelerated and Precise Automatic Speech Recognition. | Wei Zhang, Tian-Hao Zhang, Chao Luo, Hui Zhou, Chao Yang, Xinyuan Qian, Xu-Cheng Yin |
| 2025 | ICDAR | T-LLaVA: An Effective Saliency-Aware Slicing Strategy for Text Recognition. | Mengze Wei, Chun Yang, Min Liang, Fang Zhou, Xiaobin Zhu, Xu-Cheng Yin |
| 2025 | IJCNN | SPAN: A Salient Patch-Clue Aware Network for Cross-Domain Face Anti-Spoofing. | Yan Liu, Liangfeng Zhang, Lei Chen, Kai Li, Jinhui Lin, Song-Lu Chen, Feng Chen, Xu-Cheng Yin |
| 2025 | ISMAR | Can the Perceived Capability of Your Virtual Avatar Enhance Exercise Performance? | Sen-Zhe Xu, Bo-Sheng Huang, Zian Zhou, Run-Yu Li, Song-Hai Zhang, Xu-Cheng Yin |
| 2025 | RAID | Detecting and Adapting to Stealthy Label-Inversion Drifts via Conditional Distribution Inference. | Xiaoli Zhang, Yue Xiao, Qilei Yin, Zhengyang Li, Xinyan Wang, Jianrong Zhang, Ke Xu, Qi Li, Xu-Cheng Yin |
| 2024 | AAAI | Recurrent Partial Kernel Network for Efficient Optical Flow Estimation. | Henrique Morimitsu, Xiaobin Zhu, Xiangyang Ji, Xu-Cheng Yin |
| 2024 | COLING | Arbitrary Time Information Modeling via Polynomial Approximation for Temporal Knowledge Graph Embedding. | Zhiyu Fang, Jingyan Qin, Xiaobin Zhu, Chun Yang, Xu-Cheng Yin |
| 2024 | CVPR | LayoutFormer: Hierarchical Text Detection Towards Scene Text Understanding. | Min Liang, Jia-Wei Ma, Xiaobin Zhu, Jingyan Qin, Xu-Cheng Yin |
| 2024 | ICASSP | Attention Decoupling for Query-Based Object Detection. | Jia-Wei Ma, Min Liang, Haixia Man, Shu Tian, Jingyan Qin, Xu-Cheng Yin |
| 2024 | ICDAR | Multi-task Learning for License Plate Recognition in Unconstrained Scenarios. | Zhen-Lun Mo, Song-Lu Chen, Qi Liu, Feng Chen, Xu-Cheng Yin |
| 2024 | ICRA | RAPIDFlow: Recurrent Adaptable Pyramids with Iterative Decoding for Efficient Optical Flow Estimation. | Henrique Morimitsu, Xiaobin Zhu, Roberto M. Cesar, Xiangyang Ji, Xu-Cheng Yin |
| 2024 | Interspeech | Transmitted and Aggregated Self-Attention for Automatic Speech Recognition. | Tian-Hao Zhang, Xinyuan Qian, Feng Chen, Xu-Cheng Yin |
| 2024 | MMM | Improving Small License Plate Detection with Bidirectional Vehicle-Plate Relation. | Songkang Dai, Song-Lu Chen, Qi Liu, Chao Zhu, Yan Liu, Feng Chen, Xu-Cheng Yin |
| 2024 | MMM | Irregular License Plate Recognition via Global Information Integration. | Yuan-Yuan Liu, Qi Liu, Song-Lu Chen, Feng Chen, Xu-Cheng Yin |
| 2024 | SIGIR | Transformer-based Reasoning for Learning Evolutionary Chain of Events on Temporal Knowledge Graph. | Zhiyu Fang, Shuai-Long Lei, Xiaobin Zhu, Chun Yang, Shi-Xue Zhang, Xu-Cheng Yin, Jingyan Qin |
| 2023 | CVPR | VLPD: Context-Aware Pedestrian Detection via Vision-Language Semantic Self-Supervision. | Mengyin Liu, Jie Jiang, Chao Zhu, Xu-Cheng Yin |
| 2023 | ICASSP | Self-Convolution for Automatic Speech Recognition. | Tianhao Zhang, Qi Liu, Xinyuan Qian, Song-Lu Chen, Feng Chen, Xu-Cheng Yin |
| 2023 | ICCV | Learning Correction Filter via Degradation-Adaptive Regression for Blind Single Image Super-Resolution. | Hongyang Zhou, Xiaobin Zhu, Jianqing Zhu, Zheng Han, Shi-Xue Zhang, Jingyan Qin, Xu-Cheng Yin |
| 2023 | ICDAR | End-to-End Multi-line License Plate Recognition with Cascaded Perception. | Song-Lu Chen, Qi Liu, Feng Chen, Xu-Cheng Yin |
| 2023 | ICDAR | Open-Set Text Recognition via Shape-Awareness Visual Reconstruction. | Chang Liu, Chun Yang, Xu-Cheng Yin |
| 2023 | ICIG | Complex Glyph Enhancement for License Plate Generation. | Yu-Xiang Chen, Qi Liu, Song-Lu Chen, Fang Zhou, Yan Liu, Feng Chen, Xu-Cheng Yin |
| 2023 | Interspeech | InterFormer: Interactive Local and Global Features Fusion for Automatic Speech Recognition. | Zhi-Hao Lai, Tian-Hao Zhang, Qi Liu, Xinyuan Qian, Li-Fang Wei, Feng Chen, Song-Lu Chen, Xu-Cheng Yin |
| 2023 | Interspeech | Rethinking Speech Recognition with A Multimodal Perspective via Acoustic and Semantic Cooperative Decoding. | Tian-Hao Zhang, Haibo Qin, Zhi-Hao Lai, Song-Lu Chen, Qi Liu, Feng Chen, Xinyuan Qian, Xu-Cheng Yin |
| 2023 | MMM | LiteHandNet: A Lightweight Hand Pose Estimation Network via Structural Feature Enhancement. | Zhi-Yong Huang, Song-Lu Chen, Qi Liu, Chong-Jian Zhang, Feng Chen, Xu-Cheng Yin |
| 2023 | MMM | Feature Enhancement and Reconstruction for Small Object Detection. | Chong-Jian Zhang, Song-Lu Chen, Qi Liu, Zhi-Yong Huang, Feng Chen, Xu-Cheng Yin |
| 2022 | AAAI | Learning Aligned Cross-Modal Representation for Generalized Zero-Shot Classification. | Zhiyu Fang, Xiaobin Zhu, Chun Yang, Zheng Han, Jingyan Qin, Xu-Cheng Yin |
| 2022 | CVPR | Open-Set Text Recognition via Character-Context Decoupling. | Chang Liu, Chun Yang, Xu-Cheng Yin |
| 2022 | ICASSP | Non-Autoregressive Transformer with Unified Bidirectional Decoder for Automatic Speech Recognition. | Chuan-Fei Zhang, Yan Liu, Tian-Hao Zhang, Song-Lu Chen, Feng Chen, Xu-Cheng Yin |
| 2022 | ICONIP | Adaptive Rounding Compensation for Post-training Quantization. | Jinhui Lin, Heng Wang, Yan Liu, Song-Lu Chen, Ruiyao Zhang, Zhiwei Dong, Feng Chen, Xu-Cheng Yin |
| 2022 | ICPR | Semi-Supervised Fine-Grained Classification with Web Data via Noisy Sample Selection. | Meng-Xuan Li, Yan Liu, Qi Liu, Song-Lu Chen, Feng Chen, Xu-Cheng Yin |
| 2022 | ICPR | DANet: Dynamic Attention to Spoof Patterns for Face Anti-Spoofing. | Chun-Yu Sun, Song-Lu Chen, Xinjie Li, Feng Chen, Xu-Cheng Yin |
| 2022 | UIC | Vertex Adjustment Loss for Multidirectional License Plate Detection and Recognition. | Song-Lu Chen, Shu Tian, Qi Liu, Feng Chen, Xu-Cheng Yin |
| 2022 | UIC | SCDNet: Real-time Semantic Segmentation Network with Split Connection and Flexible Dilated Convolution. | Guangyu Yao, Shu Tian, Song-Lu Chen, Xu-Cheng Yin |
| 2021 | AAAI | Adaptive Pattern-Parameter Matching for Robust Pedestrian Detection. | Mengyin Liu, Chao Zhu, Jun Wang, Xu-Cheng Yin |
| 2021 | ICCV | Adaptive Boundary Proposal Network for Arbitrary Shape Text Detection. | Shi-Xue Zhang, Xiaobin Zhu, Chun Yang, Hongfa Wang, Xu-Cheng Yin |
| 2021 | ICDAR | Fast Recognition for Multidirectional and Multi-type License Plates with 2D Spatial Attention. | Qi Liu, Song-Lu Chen, Zhen-Jia Li, Chun Yang, Feng Chen, Xu-Cheng Yin |
| 2021 | ICDAR | Dynamic Receptive Field Adaptation for Attention-Based Text Recognition. | Haibo Qin, Chun Yang, Xiaobin Zhu, Xu-Cheng Yin |
| 2021 | ICIG | Robust Chinese License Plate Generation via Foreground Text and Background Separation. | Yi-Fan Sun, Qi Liu, Song-Lu Chen, Fang Zhou, Xu-Cheng Yin |
| 2021 | ICIG | Online Scene Text Tracking with Spatial-Temporal Relation. | Yan Xiu, Hongyang Zhou, Shu Tian, Xu-Cheng Yin |
| 2020 | CVPR | Deep Relational Reasoning Graph Network for Arbitrary Shape Text Detection. | Shi-Xue Zhang, Xiaobin Zhu, Jie-Bo Hou, Chang Liu, Chun Yang, Hongfa Wang, Xu-Cheng Yin |
| 2020 | ICONIP | A Hybrid Self-Attention Model for Pedestrians Detection. | Yuan Wang, Chao Zhu, Xu-Cheng Yin |
| 2020 | ICPR | Mutual-Supervised Feature Modulation Network for Occluded Pedestrian Detection. | Ye He, Chao Zhu, Xu-Cheng Yin |
| 2020 | ICPR | Semantic Bilinear Pooling for Fine-Grained Recognition. | Xinjie Li, Chun Yang, Song-Lu Chen, Chao Zhu, Xu-Cheng Yin |
| 2020 | ICPR | Global Context-Based Network with Transformer for Image2latex. | Nuo Pang, Chun Yang, Xiaobin Zhu, Jixuan Li, Xu-Cheng Yin |
| 2019 | ICDAR | Detecting Text in News Images with Similarity Embedded Proposals. | Miaotong Jiang, Jie-Bo Hou, Chun Yang, Xiaobin Zhu, Xu-Cheng Yin |
| 2019 | ICDM | Image Generation Framework for Unbalanced License Plate Data Set. | Ming Sun, Fang Zhou, Chun Yang, Xu-Cheng Yin |
| 2019 | ICDM | Feature-Matching Speech Denoising GANs via Progressive Training. | Li Zhao, Fang Zhou, Chun Yang, Xu-Cheng Yin |
| 2019 | ICONIP | Combined Correlation Filters with Siamese Region Proposal Network for Visual Tracking. | Shugang Cui, Shu Tian, Xu-Cheng Yin |
| 2019 | ICONIP | Image Generation Framework for Unbalanced License Plate Data Set. | Ming Sun, Fang Zhou, Chun Yang, Xu-Cheng Yin |
| 2019 | Interspeech | Pyramid Memory Block and Timestep Attention for Speech Emotion Recognition. | Miao Cao, Chun Yang, Fang Zhou, Xu-Cheng Yin |
| 2018 | CIKM | TED-KISS: A Known-Item Speech Video Search Benchmark. | Fan Fang, Bo-Wen Zhang, Xu-Cheng Yin, Haixia Man, Fang Zhou |
| 2017 | ICDAR | ICDAR2017 Robust Reading Challenge on Text Extraction from Biomedical Literature Figures (DeTEXT). | Chun Yang, Xu-Cheng Yin, Hong Yu, Dimosthenis Karatzas, Yu Cao |
| 2017 | SIGIR | Building Your Own Reading List Anytime via Embedding Relevance, Quality, Timeliness and Diversity. | Bo-Wen Zhang, Xu-Cheng Yin, Fang Zhou, Jian-Lin Jin |
| 2016 | ICPR | Multi-orientation scene text detection with multi-information fusion. | Wei-Yi Pei, Chun Yang, Lih-Jen Kau, Xu-Cheng Yin |
| 2016 | IJCAI | Scene Text Detection in Video by Learning Locally and Globally. | Shu Tian, Wei-Yi Pei, Ze-Yu Zuo, Xu-Cheng Yin |
| 2015 | ICDAR | Multi-strategy tracking based text detection in scene videos. | Ze-Yu Zuo, Shu Tian, Wei-Yi Pei, Xu-Cheng Yin |
| 2014 | CIKM | Social Book Search Reranking with Generalized Content-Based Filtering. | Bo-Wen Zhang, Xu-Cheng Yin, Xiao-Ping Cui, Jiao Qu, Bin Geng, Fang Zhou, Li Song, Hong-Wei Hao |
| 2014 | ICONIP | Social Book Search with Pseudo-Relevance Feedback. | Bin Geng, Fang Zhou, Jiao Qu, Bo-Wen Zhang, Xiao-Ping Cui, Xu-Cheng Yin |
| 2014 | ICONIP | Text Categorization with Diversity Random Forests. | Chun Yang, Xu-Cheng Yin, Kaizhu Huang |
| 2014 | IJCNN | Bayesian network scores based text localization in scene images. | Khalid Iqbal, Xu-Cheng Yin, Hong-Wei Hao, Sohail Asghar, Hazrat Ali |
| 2014 | ICPR | Diversity-Based Ensemble with Sample Weight Learning. | Chun Yang, Xu-Cheng Yin, Hong-Wei Hao |
| 2014 | ICPR | Shallow Classification or Deep Learning: An Experimental Study. | Xu-Cheng Yin, Chun Yang, Wei-Yi Pei, Hong-Wei Hao |
| 2013 | ICDAR | Sorting-Based Dynamic Classifier Ensemble Selection. | Yan Yan, Xu-Cheng Yin, Zhi-Bin Wang, Xuwang Yin, Chun Yang, Hong-Wei Hao |
| 2013 | ICONIP | Dynamic Ensemble of Ensembles in Nonstationary Environments. | Xu-Cheng Yin, Kaizhu Huang, Hong-Wei Hao |
| 2013 | IJCNN | Learning Bayesian Network leveled-structure from support based XML frequent itemsets. | Khalid Iqbal, Xu-Cheng Yin, Hong-Wei Hao, Qazi Mudassar Ilyas |
| 2013 | IJCNN | Classifier comparison for MSER-based text classification in scene images. | Khalid Iqbal, Xu-Cheng Yin, Xuwang Yin, Hazrat Ali, Hong-Wei Hao |
| 2013 | IJCNN | Transfer learning based compressive tracking. | Shu Tian, Xu-Cheng Yin, Xi Xu, Hong-Wei Hao |
| 2013 | SIGIR | Accurate and robust text detection: a step-in for text retrieval in natural scene images. | Xu-Cheng Yin, Xuwang Yin, Kaizhu Huang, Hong-Wei Hao |
| 2012 | ICONIP | Pedestrian Analysis and Counting System with Videos. | Zhi-Bin Wang, Hong-Wei Hao, Yan Li, Xu-Cheng Yin, Shu Tian |
| 2012 | ICONIP | Classifier Ensemble Using a Heuristic Learning with Sparsity and Diversity. | Xu-Cheng Yin, Kaizhu Huang, Hong-Wei Hao, Khalid Iqbal, Zhi-Bin Wang |
| 2012 | ICPR | Effective text localization in natural scene images with MSER, geometry-based grouping and AdaBoost. | Xuwang Yin, Xu-Cheng Yin, Hong-Wei Hao, Khalid Iqbal |
| 2012 | IJCNN | Automatic segmentation of cervical vertebrae in X-ray images. | Xi Xu, Hong-Wei Hao, Xu-Cheng Yin, Ning Liu, Shawkat Hasan Shafin |
| 2011 | ICDAR | Robust Vanishing Point Detection for MobileCam-Based Documents. | Xu-Cheng Yin, Hong-Wei Hao, Jun Sun, Satoshi Naoi |
| 2011 | ICONIP | Learning Based Visibility Measuring with Images. | Xu-Cheng Yin, Tiantian He, Hong-Wei Hao, Xi Xu, Xiao-Zhong Cao, Qing Li |
| 2011 | IJCNN | Handwritten Chinese character identification with Bagged One-Class support vector machines. | Hong-Wei Hao, Cui-Xia Mu, Xu-Cheng Yin, Zhi-Bin Wang |
| 2011 | SMC | An improved topic relevance algorithm for focused crawling. | Hong-Wei Hao, Cui-Xia Mu, Xu-Cheng Yin, Shen Li, Zhi-Bin Wang |
| 2010 | ICIP | Ellipse Detection with an Improved Randomized Hough Transform for Intellectual Phacoemulsification Surgery Systems. | Hong-Wei Hao, Qian Liu, Xu-Cheng Yin, Zhi-Bin Wang, Kaizhu Huang |
| 2009 | ICDAR | Rejection Strategies with Multiple Classifiers for Handwritten Character Recognition. | Xu-Cheng Yin, Hong-Wei Hao, Yun-Feng Tang, Jun Sun, Satoshi Naoi |
| 2009 | ICONIP | Exchange Rate Forecasting Using Classifier Ensemble. | Zhi-Bin Wang, Hong-Wei Hao, Xu-Cheng Yin, Qian Liu, Kaizhu Huang |
| 2009 | ICONIP | A Rock Structure Recognition System Using FMI Images. | Xu-Cheng Yin, Qian Liu, Hong-Wei Hao, Zhi-Bin Wang, Kaizhu Huang |
| 2007 | ICDAR | A Multi-Stage Strategy to Perspective Rectification for Mobile Phone Camera-Based Document Images. | Xu-Cheng Yin, Jun Sun, Satoshi Naoi, Katsuhito Fujimoto, Yusaku Fujii, Koji Kurokawa, Hiroaki Takebe |
| 2005 | ICDAR | Financial Document Image Coding with Regions of Interest Using JPEG2000. | Xu-Cheng Yin, Chang-Ping Liu, Zhi Han |