| 2025 | ACL | Failing Forward: Improving Generative Error Correction for ASR with Synthetic Data and Retrieval Augmentation. | Sreyan Ghosh, Mohammad Sadegh Rasooli, Michael Levit, Peidong Wang, Jian Xue, Dinesh Manocha, Jinyu Li |
| 2025 | ICCV | Text-to-Any-Skeleton Motion Generation Without Retargeting. | Qingyuan Liu, Ke Lu, Kun Dong, Jian Xue, Zehai Niu, Jinbao Wang |
| 2025 | ICIP | Continuous Action Unit Intensity Modeling for Micro-Expression Recognition. | Hanyu Jiang, Jiayi Lyu, Xing Lan, Jian Xue |
| 2025 | Interspeech | Length Aware Speech Translation for Video Dubbing. | Aswin Shanmugam Subramanian, Harveen Singh Chadha, Vikas Joshi, Shubham Bansal, Jian Xue, Rupeshkumar Mehta, Jinyu Li |
| 2025 | SMC | DC-BEV: Depth-Completed Bird's Eye View Representation for Multi-Modal 3D Object Detection. | Tong Ning, Ke Lv, Xirui Jiang, Jian Xue |
| 2025 | SMC | Learning Multi-Scale Spatial Features Representation in Frequency Domain for Gait Recognition. | Tong Ning, Ke Lu, Jian Xue |
| 2025 | SMC | Adaptive Multi-Layer Prioritized Fictitious Self-play in Multi-Agent Reinforcement Learning. | Chao Yue, Jian Xue, Lin Zhao, Yuan Lei, Shun Mao, Ke Lu |
| 2024 | ECCV | FlexControl: Flexible and Efficient Full-Body Controllable Text-to-Motion Generation. | Qingyuan Liu, Ke Lu, Zehai Niu, Kun Dong, Jian Xue, Xiaoyu Qin, Jinbao Wang |
| 2024 | ECCV | Motion Reconstruction via Human Anatomy Diffusion from Sparse Tracking. | Zehai Niu, Ke Lu, Kun Dong, Jian Xue, Xiaoyu Qin, Jinbao Wang |
| 2024 | ICANN | SRA-YOLO: Spatial Resolution Adaptive YOLO for Semi-supervised Cross-Domain Aerial Object Detection. | Junhao Huang, Jian Xue, Yuqiu Li, Hao Wu, Ke Lu |
| 2024 | ICASSP | Leveraging Timestamp Information for Serialized Joint Streaming Recognition and Translation. | Sara Papi, Peidong Wang, Jun-Kun Chen, Jian Xue, Naoyuki Kanda, Jinyu Li, Yashesh Gaur |
| 2024 | ICASSP | Diarist: Streaming Speech Translation with Speaker Diarization. | Mu Yang, Naoyuki Kanda, Xiaofei Wang, Jun-Kun Chen, Peidong Wang, Jian Xue, Jinyu Li, Takuya Yoshioka |
| 2024 | ICIP | 3Dlaneformer: Rethinking Learning Views for 3D Lane Detection. | Kun Dong, Jian Xue, Xing Lan, Ke Lu |
| 2024 | ICONIP | MA-Mamba: Multi-Agent Reinforcement Learning with State Space Model. | Yuan Lei, Jian Xue, Lin Zhao, Chao Yue, Ke Lu |
| 2024 | IJCNN | Real-time Integration of Fine-tuned Large Language Model for Improved Decision-Making in Reinforcement Learning. | Xiancai Xiang, Jian Xue, Lin Zhao, Yuan Lei, Chao Yue, Ke Lu |
| 2024 | Interspeech | Soft Language Identification for Language-Agnostic Many-to-One End-to-End Speech Translation. | Peidong Wang, Jian Xue, Jinyu Li, Jun-Kun Chen, Aswin Shanmugam Subramanian |
| 2023 | ASRU | Improving Stability in Simultaneous Speech Translation: A Revision-Controllable Decoding Approach. | Jun-Kun Chen, Jian Xue, Peidong Wang, Jing Pan, Jinyu Li |
| 2023 | ASRU | Token-Level Serialized Output Training for Joint Streaming ASR and ST Leveraging Textual Alignments. | Sara Papi, Peidong Wang, Jun-Kun Chen, Jian Xue, Jinyu Li, Yashesh Gaur |
| 2023 | ASRU | Building High-Accuracy Multilingual ASR With Gated Language Experts and Curriculum Training. | Eric Sun, Jinyu Li, Yuxuan Hu, Yimeng Zhu, Long Zhou, Jian Xue, Peidong Wang, Linquan Liu, Shujie Liu, Edward Lin, Yifan Gong |
| 2023 | ASRU | A Weakly-Supervised Streaming Multilingual Speech Model with Truly Zero-Shot Capability. | Jian Xue, Peidong Wang, Jinyu Li, Eric Sun |
| 2023 | BMVC | BiUNet: Towards More Effective UNet with Bi-Level Routing Attention. | Kun Dong, Jian Xue, Xing Lan, Ke Lu |
| 2023 | ICASSP | Fast and Accurate Factorized Neural Transducer for Text Adaption of End-to-End Speech Recognition Models. | Rui Zhao, Jian Xue, Partha Parthasarathy, Veljko Miljanic, Jinyu Li |
| 2023 | ICIP | Semi-Supervised Contrastive Learning of Global and Local Representation for 3d Medical Image Segmentation. | Chuang Jia, Jian Xue, Ke Lu, Zhongqi Wu |
| 2023 | IJCNN | A Novel Cross-Fusion Method of Different Types of Features for Image Captioning. | Liangshan Lou, Ke Lu, Jian Xue |
| 2023 | Interspeech | LAMASSU: A Streaming Language-Agnostic Multilingual Speech Recognition and Translation Model Using Neural Transducers. | Peidong Wang, Eric Sun, Jian Xue, Yu Wu, Long Zhou, Yashesh Gaur, Shujie Liu, Jinyu Li |
| 2022 | AAAI | Shape-Adaptive Selection and Measurement for Oriented Object Detection. | Liping Hou, Ke Lu, Jian Xue, Yuqiu Li |
| 2022 | ICPR | Improved Transformer with Parallel Encoders for Image Captioning. | Liangshan Lou, Ke Lu, Jian Xue |
| 2022 | Interspeech | Large-Scale Streaming End-to-End Speech Translation with Neural Transducers. | Jian Xue, Peidong Wang, Jinyu Li, Matt Post, Yashesh Gaur |
| 2022 | SMC | Dual-Branch Point Cloud Feature Learning for 3D Object Detection. | Hengsheng Lun, Jian Xue, Ke Lu |
| 2021 | ASRU | On Addressing Practical Challenges for RNN-Transducer. | Rui Zhao, Jian Xue, Jinyu Li, Wenning Wei, Lei He, Yifan Gong |
| 2021 | ICIP | Spatiotemporal Features and Local Relationship Learning for Facial Action Unit Intensity Regression. | Chao Wei, Ke Lu, Wei Gan, Jian Xue |
| 2021 | Interspeech | Improving Multilingual Transformer Transducer Models by Reducing Language Confusions. | Eric Sun, Jinyu Li, Zhong Meng, Yu Wu, Jian Xue, Shujie Liu, Yifan Gong |
| 2020 | ICPR | A Novel Multi-feature Skeleton Representation for 3D Action Recognition. | Lian Chen, Ke Lu, Pengcheng Gao, Jian Xue, Jinbao Wang |
| 2019 | ICASSP | A Markerless Body Motion Capture System for Character Animation Based on Multi-view Cameras. | Jinbao Wang, Ke Lyu, Jian Xue, Pengcheng Gao, Yanfu Yan |
| 2019 | VCIP | A Single-stage Multi-class Object Detection Method for Remote Sensing Images. | Liping Hou, Jian Xue, Ke Lu, Li Hao, Mohammad Muntasir Rahman |
| 2018 | ICPR | A fast Cascade Shape Regression Method based on CNN-based Initialization. | Pengcheng Gao, Jian Xue, Ke Lu, Yanfu Yan |
| 2017 | Interspeech | The Opensesame NIST 2016 Speaker Recognition Evaluation System. | Gang Liu, Qi Qian, Zhibin Wang, Qingen Zhao, Tianzhou Wang, Hao Li, Jian Xue, Shenghuo Zhu, Rong Jin, Tuo Zhao |
| 2015 | ICASSP | Investigating online low-footprint speaker adaptation using generalized linear regression and click-through data. | Yong Zhao, Jinyu Li, Jian Xue, Yifan Gong |
| 2015 | ICIP | Volume visualization for out-of-core 3D images based on semi-adaptive partitioning. | Jian Xue, Ke Lii |
| 2014 | ICASSP | Singular value decomposition based low-footprint speaker adaptation and personalization for deep neural network. | Jian Xue, Jinyu Li, Dong Yu, Mike Seltzer, Yifan Gong |
| 2013 | Interspeech | Investigations on hessian-free optimization for cross-entropy training of deep neural networks. | Simon Wiesler, Jinyu Li, Jian Xue |
| 2013 | Interspeech | Restructuring of deep neural network acoustic models with singular value decomposition. | Jian Xue, Jinyu Li, Yifan Gong |
| 2011 | ICASSP | Clustering of bootstrapped acoustic model with full covariance. | Xin Chen, Xiaodong Cui, Jian Xue, Peder A. Olsen, John R. Hershey, Bowen Zhou, Yunxin Zhao |
| 2011 | Interspeech | Acoustic Modeling with Bootstrap and Restructuring Based on Full Covariance. | Xiaodong Cui, Xin Chen, Jian Xue, Peder A. Olsen, John R. Hershey, Bowen Zhou |
| 2011 | Interspeech | Towards High Performance LVCSR in Speech-to-Speech Translation System on Smart Phones. | Jian Xue, Xiaodong Cui, Gregg Daggett, Etienne Marcheret, Bowen Zhou |
| 2010 | Interspeech | Acoustic modeling with bootstrap and restructuring for low-resourced languages. | Xiaodong Cui, Jian Xue, Pierre L. Dognin, Upendra V. Chaudhari, Bowen Zhou |
| 2009 | ASRU | Improving online incremental speaker adaptation with eigen feature space MLLR. | Xiaodong Cui, Jian Xue, Bowen Zhou |
| 2009 | ICASSP | Semi-tied covariance matrices for acoustic models based on random forests of phonetic decision trees. | Jian Xue, L. Che, Yunxin Zhao |
| 2009 | Interspeech | A study of bootstrapping with multiple acoustic features for improved automatic speech recognition. | Xiaodong Cui, Jian Xue, Bing Xiang, Bowen Zhou |
| 2008 | ICASSP | Random-forests-based phonetic decision trees for conversational speech recognition. | Jian Xue, Yunxin Zhao |
| 2008 | Interspeech | High-performance low-latency speech recognition via multi-layered feature streaming and fast Gaussian computation. | Liang Gu, Jian Xue, Xiaodong Cui, Yuqing Gao |
| 2007 | ICASSP | Novel Lookahead Decision Tree State Tying for Acoustic Modeling. | Jian Xue, Yuxin Zhao |
| 2006 | ICASSP | Random Forests-Based Confidence Annotation Using Novel Features from Confusion Network. | Jian Xue, Yunxin Zhao |
| 2006 | ICASSP | An Automatic Captioning System for Telemedicine. | Yunxin Zhao, Xiaojia Zhang, Rusheng Hu, Jian Xue, Xiaolong Li, Lili Che, Rong Hu, Laura Schopp |
| 2006 | Interspeech | New improvements in decoding speed and latency for automatic captioning. | Jian Xue, Rusheng Hu, Yunxin Zhao |
| 2005 | CSCWD | The toolkit and platform for biometric information processing. | Xiaoguang He, Jie Tian, Yuliang He, Jian Xue, Xin Yang |
| 2005 | CSCWD | The design and implementation of a novel platform for medical data visualization. | Jian Xue, Jie Tian, Mingchang Zhao, Huiguang He |
| 2005 | ICASSP | Improved Confusion Network Algorithm and Shortest Path Search from Word Lattice. | Jian Xue, Yunxin Zhao |
| 2005 | Interspeech | Incremental largest margin linear regression and MAP adaptation for speech separation in telemedicine applications. | Rusheng Hu, Jian Xue, Yunxin Zhao |