| 2026 | ACL | Influence-based Online Experience Selection for Effective RLHF. | Yifan Gong, Jing Yao, Xiting Wang, Xunlong Wang, Xiaoyuan Yi, Xing Xie |
| 2026 | ACL | LLM Inductive Reasoning Through Multi-Agent Enhanced Monte Carlo Tree Search. | Xiang Li, Yucheng Zhou, Xiangzhi Wei, Zesheng Shi, Haiyuan Wan, Yifan Gong, Fangming Liu, Jing Li |
| 2025 | AAAI | LazyDiT: Lazy Learning for the Acceleration of Diffusion Transformers. | Xuan Shen, Zhao Song, Yufa Zhou, Bo Chen, Yanyu Li, Yifan Gong, Kai Zhang, Hao Tan, Jason Kuen, Henghui Ding, Zhihao Shu, Wei Niu, Pu Zhao, Yanzhi Wang, Jiuxiang Gu |
| 2025 | ACL | Reasoning is All You Need for Video Generalization: A Counterfactual Benchmark with Sub-question Evaluation. | Qiji Zhou, Yifan Gong, Guangsheng Bao, Hongjie Qiu, Jinqiang Li, Xiangrong Zhu, Huajian Zhang, Yue Zhang |
| 2025 | EMNLP | RECALL: REpresentation-aligned Catastrophic-forgetting ALLeviation via Hierarchical Model Merging. | Bowen Wang, Haiyuan Wan, Liwen Shi, Chen Yang, Peng He, Yue Ma, Haochen Han, Wenhao Li, Tiao Tan, Yongjian Li, Fangming Liu, Yifan Gong, Sheng Zhang |
| 2025 | ICCAD | Squat: Quant Small Language Models on the Edge. | Xuan Shen, Peiyan Dong, Zhenglun Kong, Yifan Gong, Changdi Yang, Zhaoyang Han, Yanyue Xie, Lei Lu, Cheng Lyu, Chao Wu, Yanzhi Wang, Pu Zhao |
| 2025 | ICCV | Compressed Diffusion: Pruning with Knowledge Distillation for Efficient Text-to-Image Generation. | Nasrin Kalanat, Ohiremen Dibua, Yan Kang, Yifan Gong, Xiaowei Jia |
| 2025 | ICLR | Sparse Learning for State Space Models on Mobile. | Xuan Shen, Hangyu Zheng, Yifan Gong, Zhenglun Kong, Changdi Yang, Zheng Zhan, Yushu Wu, Xue Lin, Yanzhi Wang, Pu Zhao, Wei Niu |
| 2025 | IJCAI | FairSMOE: Mitigating Multi-Attribute Fairness Problem with Sparse Mixture-of-Experts. | Changdi Yang, Zheng Zhan, Ci Zhang, Yifan Gong, Yize Li, Zichong Meng, Jun Liu, Xuan Shen, Hao Tang, Geng Yuan, Pu Zhao, Xue Lin, Yanzhi Wang |
| 2025 | Interspeech | Improving Practical Aspects of End-to-End Multi-Talker Speech Recognition for Online and Offline Scenarios. | Aswin Shanmugam Subramanian, Amit Das, Naoyuki Kanda, Jinyu Li, Xiaofei Wang, Yifan Gong |
| 2025 | WACV | Can Adversarial Examples be Parsed to Reveal Victim Model Information? | Yuguang Yao, Jiancheng Liu, Yifan Gong, Xiaoming Liu, Yanzhi Wang, Xue Lin, Sijia Liu |
| 2024 | DAC | LOTUS: learning-based online thermal and latency variation management for two-stage detectors on edge devices. | Yifan Gong, Yushu Wu, Zheng Zhan, Pu Zhao, Liangkai Liu, Chao Wu, Xulong Tang, Yanzhi Wang |
| 2024 | ECCV | Efficient Training with Denoised Neural Weights. | Yifan Gong, Zheng Zhan, Yanyu Li, Yerlan Idelbayev, Andrey Zharkov, Kfir Aberman, Sergey Tulyakov, Yanzhi Wang, Jian Ren |
| 2024 | EMNLP | Rethinking Token Reduction for State Space Models. | Zheng Zhan, Yushu Wu, Zhenglun Kong, Changdi Yang, Yifan Gong, Xuan Shen, Xue Lin, Pu Zhao, Yanzhi Wang |
| 2024 | ICASSP | Adapting Large Language Model with Speech for Fully Formatted End-to-End Speech Recognition. | Shaoshi Ling, Yuxuan Hu, Shuangbei Qian, Guoli Ye, Yao Qian, Yifan Gong, Ed Lin, Michael Zeng |
| 2024 | ICCAD | AyE-Edge: Automated Deployment Space Search Empowering Accuracy yet Efficient Real-Time Object Detection on the Edge. | Chao Wu, Yifan Gong, Liangkai Liu, Mengquan Li, Yushu Wu, Xuan Shen, Zhimin Li, Geng Yuan, Weisong Shi, Yanzhi Wang |
| 2024 | ICML | E2GAN: Efficient Training of Efficient GANs for Image-to-Image Translation. | Yifan Gong, Zheng Zhan, Qing Jin, Yanyu Li, Yerlan Idelbayev, Xian Liu, Andrey Zharkov, Kfir Aberman, Sergey Tulyakov, Yanzhi Wang, Jian Ren |
| 2024 | Interspeech | NOTSOFAR-1 Challenge: New Datasets, Baseline, and Tasks for Distant Meeting Transcription. | Alon Vinnikov, Amir Ivry, Aviv Hurvitz, Igor Abramovski, Sharon Koubi, Ilya Gurvich, Shai Peer, Xiong Xiao, Benjamin Martinez Elizalde, Naoyuki Kanda, Xiaofei Wang, Shalev Shaer, Stav Yagev, Yossi Asher, Sunit Sivasankaran, Yifan Gong, Min Tang, Huaming Wang, Eyal Krupka |
| 2024 | NAACL | Value FULCRA: Mapping Large Language Models to the Multidimensional Spectrum of Basic Human Value. | Jing Yao, Xiaoyuan Yi, Yifan Gong, Xiting Wang, Xing Xie |
| 2023 | ASRU | Multi Transcription-Style Speech Transcription Using Attention-Based Encoder-Decoder Model. | Yan Huang, Piyush Behre, Guoli Ye, Shawn Chang, Yifan Gong |
| 2023 | ASRU | Building High-Accuracy Multilingual ASR With Gated Language Experts and Curriculum Training. | Eric Sun, Jinyu Li, Yuxuan Hu, Yimeng Zhu, Long Zhou, Jian Xue, Peidong Wang, Linquan Liu, Shujie Liu, Edward Lin, Yifan Gong |
| 2023 | DAC | Condense: A Framework for Device and Frequency Adaptive Neural Network Models on the Edge. | Yifan Gong, Pu Zhao, Zheng Zhan, Yushu Wu, Chao Wu, Zhenglun Kong, Minghai Qin, Caiwen Ding, Yanzhi Wang |
| 2023 | ICCAD | MOC: Multi-Objective Mobile CPU-GPU Co-Optimization for Power-Efficient DNN Inference. | Yushu Wu, Yifan Gong, Zheng Zhan, Geng Yuan, Yanyu Li, Qi Wang, Chao Wu, Yanzhi Wang |
| 2023 | ICLR | Self-Ensemble Protection: Training Checkpoints Are Good Data Protectors. | Sizhe Chen, Geng Yuan, Xinwen Cheng, Yifan Gong, Minghai Qin, Yanzhi Wang, Xiaolin Huang |
| 2023 | ICML | DualHSIC: HSIC-Bottleneck and Alignment for Continual Learning. | Zifeng Wang, Zheng Zhan, Yifan Gong, Yucai Shao, Stratis Ioannidis, Yanzhi Wang, Jennifer G. Dy |
| 2022 | ECCV | Compiler-Aware Neural Architecture Search for On-Mobile Real-time Super-Resolution. | Yushu Wu, Yifan Gong, Pu Zhao, Yanyu Li, Zheng Zhan, Wei Niu, Hao Tang, Minghai Qin, Bin Ren, Yanzhi Wang |
| 2022 | ICASSP | Endpoint Detection for Streaming End-to-End Multi-Talker ASR. | Liang Lu, Jinyu Li, Yifan Gong |
| 2022 | ICASSP | Have Best of Both Worlds: Two-Pass Hybrid and E2E Cascading Framework for Speech Recognition. | Guoli Ye, Vadim Mazalov, Jinyu Li, Yifan Gong |
| 2022 | ICCAD | All-in-One: A Highly Representative DNN Pruning Framework for Edge Devices with Dynamic Power Management. | Yifan Gong, Zheng Zhan, Pu Zhao, Yushu Wu, Chao Wu, Caiwen Ding, Weiwen Jiang, Minghai Qin, Yanzhi Wang |
| 2022 | ICLR | Reverse Engineering of Imperceptible Adversarial Image Perturbations. | Yifan Gong, Yuguang Yao, Yize Li, Yimeng Zhang, Xiaoming Liu, Xue Lin, Sijia Liu |
| 2022 | Interspeech | Internal Language Model Adaptation with Text-Only Data for End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Naoyuki Kanda, Jinyu Li, Xie Chen, Yu Wu, Yifan Gong |
| 2022 | IECON | A Hardware Architecture of Feature Extraction for Real-Time Visual SLAM. | Jialin Li, Liangji Zhang, Xuewei Shen, Yifan Gong, Ying Lei, Chen Yang, Li Geng |
| 2022 | SBAC-PAD | TCUDA: A QoS-based GPU Sharing Framework for Autonomous Navigation Systems. | Pangbo Sun, Hao Wu, Jiangming Jin, Ziyue Jiang, Yifan Gong |
| 2021 | ASRU | On Addressing Practical Challenges for RNN-Transducer. | Rui Zhao, Jian Xue, Jinyu Li, Wenning Wei, Lei He, Yifan Gong |
| 2021 | CLUSTER | Accelerating GPU Message Communication for Autonomous Navigation Systems. | Hao Wu, Jiangming Jin, Jidong Zhai, Yifan Gong, Wei Liu |
| 2021 | ICASSP | Internal Language Model Training for Domain-Adaptive End-To-End Speech Recognition. | Zhong Meng, Naoyuki Kanda, Yashesh Gaur, Sarangarajan Parthasarathy, Eric Sun, Liang Lu, Xie Chen, Jinyu Li, Yifan Gong |
| 2021 | ICASSP | Sequence-Level Self-Teaching Regularization. | Eric Sun, Liang Lu, Zhong Meng, Yifan Gong |
| 2021 | ICASSP | Ensemble Combination between Different Time Segmentations. | Jeremy Heng Meng Wong, Dimitrios Dimitriadis, Ken'ichi Kumatani, Yashesh Gaur, George Polovets, Partha Parthasarathy, Eric Sun, Jinyu Li, Yifan Gong |
| 2021 | ICASSP | Hidden Markov Model Diarisation with Speaker Location Information. | Jeremy Heng Meng Wong, Xiong Xiao, Yifan Gong |
| 2021 | ICASSP | Microsoft Speaker Diarization System for the Voxceleb Speaker Recognition Challenge 2020. | Xiong Xiao, Naoyuki Kanda, Zhuo Chen, Tianyan Zhou, Takuya Yoshioka, Sanyuan Chen, Yong Zhao, Gang Liu, Yu Wu, Jian Wu, Shujie Liu, Jinyu Li, Yifan Gong |
| 2021 | ICCV | Achieving on-Mobile Real-Time Super-Resolution with Neural Architecture and Pruning Search. | Zheng Zhan, Yifan Gong, Pu Zhao, Geng Yuan, Wei Niu, Yushu Wu, Tianyun Zhang, Malith Jayaweera, David R. Kaeli, Bin Ren, Xue Lin, Yanzhi Wang |
| 2021 | Interspeech | Streaming Multi-Talker Speech Recognition with Joint Speaker Identification. | Liang Lu, Naoyuki Kanda, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | On Minimum Word Error Rate Training of the Hybrid Autoregressive Transducer. | Liang Lu, Zhong Meng, Naoyuki Kanda, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Rapid Speaker Adaptation for Conformer Transducer: Attention and Bias Are All You Need. | Yan Huang, Guoli Ye, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Improving RNN-T for Domain Scaling Using Semi-Supervised Training with Neural TTS. | Yan Deng, Rui Zhao, Zhong Meng, Xie Chen, Bing Liu, Jinyu Li, Yifan Gong, Lei He |
| 2021 | Interspeech | Multiple Softmax Architecture for Streaming Multilingual End-to-End ASR Systems. | Vikas Joshi, Amit Das, Eric Sun, Rupesh R. Mehta, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Minimum Word Error Rate Training with Language Model Fusion for End-to-End Speech Recognition. | Zhong Meng, Yu Wu, Naoyuki Kanda, Liang Lu, Xie Chen, Guoli Ye, Eric Sun, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Improving Multilingual Transformer Transducer Models by Reducing Language Confusions. | Eric Sun, Jinyu Li, Zhong Meng, Yu Wu, Jian Xue, Shujie Liu, Yifan Gong |
| 2020 | DAC | RTMobile: Beyond Real-Time Mobile Acceleration of RNNs for Speech Recognition. | Peiyan Dong, Siyue Wang, Wei Niu, Chengming Zhang, Sheng Lin, Zhengang Li, Yifan Gong, Bin Ren, Xue Lin, Dingwen Tao |
| 2020 | ICASSP | Acoustic Model Adaptation for Presentation Transcription and Intelligent Meeting Assistant Systems. | Yan Huang, Yifan Gong |
| 2020 | ICASSP | Using Personalized Speech Synthesis and Neural Language Generator for Rapid Speaker Adaptation. | Yan Huang, Lei He, Wenning Wei, William Gale, Jinyu Li, Yifan Gong |
| 2020 | ICASSP | Exploring Pre-Training with Alignments for RNN Transducer Based End-to-End Speech Recognition. | Hu Hu, Rui Zhao, Jinyu Li, Liang Lu, Yifan Gong |
| 2020 | ICASSP | Minimum Latency Training Strategies for Streaming Sequence-to-Sequence ASR. | Hirofumi Inaguma, Yashesh Gaur, Liang Lu, Jinyu Li, Yifan Gong |
| 2020 | ICASSP | High-Accuracy and Low-Latency Speech Recognition with Two-Head Contextual Layer Trajectory LSTM Model. | Jinyu Li, Rui Zhao, Eric Sun, Jeremy Heng Meng Wong, Amit Das, Zhong Meng, Yifan Gong |
| 2020 | ICASSP | L-Vector: Neural Label Embedding for Domain Adaptation. | Zhong Meng, Hu Hu, Jinyu Li, Changliang Liu, Yan Huang, Yifan Gong, Chin-Hui Lee |
| 2020 | ICASSP | Adaptation of RNN Transducer with Text-To-Speech Technology for Keyword Spotting. | Eva Sharma, Guoli Ye, Wenning Wei, Rui Zhao, Yao Tian, Jian Wu, Lei He, Ed Lin, Yifan Gong |
| 2020 | ICDCS | Safe Process Quitting for GPU Multi-Process Service (MPS). | Hao Wu, Wei Liu, Yifan Gong, Jiangming Jin |
| 2020 | ICPP | Memory-Centric Communication Mechanism for Real-time Autonomous Navigation Applications. | Wei Liu, Yifan Gong, Hao Wu, Jidong Zhai, Jiangming Jin |
| 2020 | Interspeech | Rapid RNN-T Adaptation Using Personalized Speech Synthesis and Neural Language Generator. | Yan Huang, Jinyu Li, Lei He, Wenning Wei, William Gale, Yifan Gong |
| 2020 | Interspeech | 1-D Row-Convolution LSTM: Fast Streaming ASR at Accuracy Parity with LC-BLSTM. | Kshitiz Kumar, Chaojun Liu, Yifan Gong, Jian Wu |
| 2020 | Interspeech | Bandpass Noise Generation and Augmentation for Unified ASR. | Kshitiz Kumar, Bo Ren, Yifan Gong, Jian Wu |
| 2020 | Interspeech | Developing RNN-T Models Surpassing High-Performance Hybrid Models with Customization Capability. | Jinyu Li, Rui Zhao, Zhong Meng, Yanqing Liu, Wenning Wei, Sarangarajan Parthasarathy, Vadim Mazalov, Zhenghao Wang, Lei He, Sheng Zhao, Yifan Gong |
| 2020 | Interspeech | Exploring Transformers for Large-Scale Speech Recognition. | Liang Lu, Changliang Liu, Jinyu Li, Yifan Gong |
| 2020 | Interspeech | Combination of End-to-End and Hybrid Models for Speech Recognition. | Jeremy Heng Meng Wong, Yashesh Gaur, Rui Zhao, Liang Lu, Eric Sun, Jinyu Li, Yifan Gong |
| 2020 | SBAC-PAD | A Robotic Communication Middleware Combining High Performance and High Reliability. | Wei Liu, Hao Wu, Ziyue Jiang, Yifan Gong, Jiangming Jin |
| 2019 | ASRU | Improving RNN Transducer Modeling for End-to-End Speech Recognition. | Jinyu Li, Rui Zhao, Hu Hu, Yifan Gong |
| 2019 | ASRU | Character-Aware Attention-Based End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Jinyu Li, Yifan Gong |
| 2019 | ASRU | Domain Adaptation via Teacher-Student Learning for End-to-End Speech Recognition. | Zhong Meng, Jinyu Li, Yashesh Gaur, Yifan Gong |
| 2019 | ASRU | Advances in Online Audio-Visual Meeting Transcription. | Takuya Yoshioka, Yan Huang, Aviv Hurvitz, Li Jiang, Sharon Koubi, Eyal Krupka, Ido Leichter, Changliang Liu, Partha Parthasarathy, Alon Vinnikov, Lingfeng Wu, Igor Abramovski, Xiong Xiao, Wayne Xiong, Huaming Wang, Zhenghao Wang, Jun Zhang, Yong Zhao, Tianyan Zhou, Cem Aksoylar, Zhuo Chen, Moshe David, Dimitrios Dimitriadis, Yifan Gong, Ilya Gurvich, Xuedong Huang |
| 2019 | ASRU | CNN with Phonetic Attention for Text-Independent Speaker Verification. | Tianyan Zhou, Yong Zhao, Jinyu Li, Yifan Gong, Jian Wu |
| 2019 | ICASSP | Universal Acoustic Modeling Using Neural Mixture Models. | Amit Das, Jinyu Li, Changliang Liu, Yifan Gong |
| 2019 | ICASSP | Word Characters and Phone Pronunciation Embedding for ASR Confidence Classifier. | Kshitiz Kumar, Tasos Anastasakos, Yifan Gong |
| 2019 | ICASSP | Static and Dynamic State Predictions for Acoustic Model Combination. | Kshitiz Kumar, Yifan Gong |
| 2019 | ICASSP | Improving Layer Trajectory LSTM with Future Context Frames. | Jinyu Li, Liang Lu, Changliang Liu, Yifan Gong |
| 2019 | ICASSP | Towards Code-switching ASR for End-to-end CTC Models. | Ke Li, Jinyu Li, Guoli Ye, Rui Zhao, Yifan Gong |
| 2019 | ICASSP | Adversarial Speaker Adaptation. | Zhong Meng, Jinyu Li, Yifan Gong |
| 2019 | ICASSP | Attentive Adversarial Learning for Domain-invariant Training. | Zhong Meng, Jinyu Li, Yifan Gong |
| 2019 | ICASSP | Conditional Teacher-student Learning. | Zhong Meng, Jinyu Li, Yong Zhao, Yifan Gong |
| 2019 | ICASSP | Adversarial Speaker Verification. | Zhong Meng, Yong Zhao, Jinyu Li, Yifan Gong |
| 2019 | ICASSP | Single-channel Speech Extraction Using Speaker Inventory and Attention Network. | Xiong Xiao, Zhuo Chen, Takuya Yoshioka, Hakan Erdogan, Changliang Liu, Dimitrios Dimitriadis, Jasha Droppo, Yifan Gong |
| 2019 | ICASSP | Encrypted Speech Recognition Using Deep Polynomial Networks. | Shi-Xiong Zhang, Yifan Gong, Dong Yu |
| 2019 | Interspeech | Acoustic-to-Phrase Models for Speech Recognition. | Yashesh Gaur, Jinyu Li, Zhong Meng, Yifan Gong |
| 2019 | Interspeech | Self-Teaching Networks. | Liang Lu, Eric Sun, Yifan Gong |
| 2019 | Interspeech | Speaker Adaptation for Attention-Based End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Jinyu Li, Yifan Gong |
| 2019 | Interspeech | Layer Trajectory BLSTM. | Eric Sun, Jinyu Li, Yifan Gong |
| 2019 | IWQoS | Untitled record | Yifan Gong, Baochun Li, Ben Liang, Zheng Zhan |
| 2018 | ICASSP | Efficient Integration of Fixed Beamformers and Speech Separation Networks for Multi-Channel Far-Field Speech Separation. | Zhuo Chen, Takuya Yoshioka, Xiong Xiao, Linyu Li, Michael L. Seltzer, Yifan Gong |
| 2018 | ICASSP | Advancing Connectionist Temporal Classification with Attention Modeling. | Amit Das, Jinyu Li, Rui Zhao, Yifan Gong |
| 2018 | ICASSP | Advancing Acoustic-to-Word CTC Model. | Jinyu Li, Guoli Ye, Amit Das, Rui Zhao, Yifan Gong |
| 2018 | ICASSP | Developing Far-Field Speaker System Via Teacher-Student Learning. | Jinyu Li, Rui Zhao, Zhuo Chen, Changliang Liu, Xiong Xiao, Guoli Ye, Yifan Gong |
| 2018 | ICASSP | Speaker-Invariant Training Via Adversarial Learning. | Zhong Meng, Jinyu Li, Zhuo Chen, Yang Zhao, Vadim Mazalov, Yifan Gong, Biing-Hwang Juang |
| 2018 | ICASSP | Adversarial Teacher-Student Learning for Unsupervised Domain Adaptation. | Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Juang |
| 2018 | ICASSP | Domain and Speaker Adaptation for Cortana Speech Recognition. | Yong Zhao, Jinyu Li, Shi-Xiong Zhang, Liping Chen, Yifan Gong |
| 2018 | Interspeech | Layer Trajectory LSTM. | Jinyu Li, Changliang Liu, Yifan Gong |
| 2018 | Interspeech | Cycle-Consistent Speech Enhancement. | Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Fred Juang |
| 2018 | Interspeech | Adversarial Feature-Mapping for Speech Enhancement. | Zhong Meng, Jinyu Li, Yifan Gong, Biing-Hwang Fred Juang |
| 2017 | ASRU | Cracking the cocktail party problem by multi-beam deep attractor network. | Zhuo Chen, Jinyu Li, Xiong Xiao, Takuya Yoshioka, Huaming Wang, Zhenghao Wang, Yifan Gong |
| 2017 | ASRU | Acoustic-to-word model without OOV. | Jinyu Li, Guoli Ye, Rui Zhao, Jasha Droppo, Yifan Gong |
| 2017 | ASRU | Unsupervised adaptation with domain separation networks for robust speech recognition. | Zhong Meng, Zhuo Chen, Vadim Mazalov, Jinyu Li, Yifan Gong |
| 2017 | ICASSP | Improved cepstra minimum-mean-square-error noise reduction algorithm for robust speech recognition. | Jinyu Li, Yan Huang, Yifan Gong |
| 2017 | ICASSP | Extended low-rank plus diagonal adaptation for deep and recurrent neural networks. | Yong Zhao, Jinyu Li, Kshitiz Kumar, Yifan Gong |
| 2017 | Interspeech | Improving Mask Learning Based Speech Enhancement System with Restoration Layers and Residual Connection. | Zhuo Chen, Yan Huang, Jinyu Li, Yifan Gong |
| 2017 | Interspeech | Don't Count on ASR to Transcribe for You: Breaking Bias with Two Crowds. | Michael Levit, Yan Huang, Shuangyu Chang, Yifan Gong |
| 2017 | Interspeech | Large-Scale Domain Adaptation via Teacher-Student Learning. | Jinyu Li, Michael L. Seltzer, Xi Wang, Rui Zhao, Yifan Gong |
| 2017 | SC | Efficient process mapping in geo-distributed cloud data centers. | Amelie Chi Zhou, Yifan Gong, Bingsheng He, Jidong Zhai |
| 2016 | ICASSP | Non-negative intermediate-layer DNN adaptation for a 10-KB speaker adaptation profile. | Kshitiz Kumar, Chaojun Liu, Yifan Gong |
| 2016 | ICASSP | Exploring multidimensional lstms for large vocabulary ASR. | Jinyu Li, Abdelrahman Mohamed, Geoffrey Zweig, Yifan Gong |
| 2016 | ICASSP | Investigations on speaker adaptation of LSTM RNN models for speech recognition. | Chaojun Liu, Yongqiang Wang, Kshitiz Kumar, Yifan Gong |
| 2016 | ICASSP | Simplifying long short-term memory acoustic models for fast training and decoding. | Yajie Miao, Jinyu Li, Yongqiang Wang, Shi-Xiong Zhang, Yifan Gong |
| 2016 | ICASSP | Geo-location dependent deep neural network acoustic model for speech recognition. | Guoli Ye, Chaojun Liu, Yifan Gong |
| 2016 | ICASSP | Recurrent support vector machines for speech recognition. | Shi-Xiong Zhang, Rui Zhao, Chaojun Liu, Jinyu Li, Yifan Gong |
| 2016 | ICASSP | Low-rank plus diagonal adaptation for deep neural networks. | Yong Zhao, Jinyu Li, Yifan Gong |
| 2016 | Interspeech | Semi-Supervised Training in Deep Learning Acoustic Model. | Yan Huang, Yongqiang Wang, Yifan Gong |
| 2015 | ASRU | LSTM time and frequency recurrence for automatic speech recognition. | Jinyu Li, Abdelrahman Mohamed, Geoffrey Zweig, Yifan Gong |
| 2015 | ICASSP | An analysis of convolutional neural networks for speech recognition. | Jui-Ting Huang, Jinyu Li, Yifan Gong |
| 2015 | ICASSP | Estimating confidence scores on ASR results using recurrent neural networks. | Kaustubh Kalgaonkar, Chaojun Liu, Yifan Gong, Kaisheng Yao |
| 2015 | ICASSP | Small-footprint high-performance deep neural network-based speech recognition using split-VQ. | Yongqiang Wang, Jinyu Li, Yifan Gong |
| 2015 | ICASSP | Deep neural support vector machines for speech recognition. | Shi-Xiong Zhang, Chaojun Liu, Kaisheng Yao, Yifan Gong |
| 2015 | ICASSP | Investigating online low-footprint speaker adaptation using generalized linear regression and click-through data. | Yong Zhao, Jinyu Li, Jian Xue, Yifan Gong |
| 2015 | Interspeech | Regularized sequence-level deep neural network model adaptation. | Yan Huang, Yifan Gong |
| 2015 | Interspeech | Confidence-features and confidence-scores for ASR applications in arbitration and DNN speaker adaptation. | Kshitiz Kumar, Ziad Al Bawab, Yong Zhao, Chaojun Liu, Benot Dumoulin, Yifan Gong |
| 2015 | Interspeech | Delta-melspectra features for noise robustness to DNN-based ASR systems. | Kshitiz Kumar, Chaojun Liu, Yifan Gong |
| 2015 | Interspeech | Intermediate-layer DNN adaptation for offline and session-based iterative speaker adaptation. | Kshitiz Kumar, Chaojun Liu, Kaisheng Yao, Yifan Gong |
| 2015 | Interspeech | SVD-based universal DNN modeling for multiple scenarios. | Changliang Liu, Jinyu Li, Yifan Gong |
| 2015 | SC | Monetary cost optimizations for MPI-based HPC applications on Amazon clouds: checkpoints and replicated execution. | Yifan Gong, Bingsheng He, Amelie Chi Zhou |
| 2014 | ICASSP | Factorized adaptation for deep neural network. | Jinyu Li, Jui-Ting Huang, Yifan Gong |
| 2014 | ICASSP | Singular value decomposition based low-footprint speaker adaptation and personalization for deep neural network. | Jian Xue, Jinyu Li, Dong Yu, Mike Seltzer, Yifan Gong |
| 2014 | Interspeech | Towards better performance with heterogeneous training data in acoustic modeling using deep neural networks. | Yan Huang, Malcolm Slaney, Michael L. Seltzer, Yifan Gong |
| 2014 | Interspeech | A comparative analytic study on the Gaussian mixture and context dependent deep neural network hidden Markov models. | Yan Huang, Dong Yu, Chaojun Liu, Yifan Gong |
| 2014 | Interspeech | Multi-accent deep neural network acoustic model with accent-specific top layer using the KLD-regularized model adaptation. | Yan Huang, Dong Yu, Chaojun Liu, Yifan Gong |
| 2014 | Interspeech | Normalization of ASR confidence classifier scores via confidence mapping. | Kshitiz Kumar, Chaojun Liu, Yifan Gong |
| 2014 | Interspeech | Learning small-size DNN with output-distribution-based criteria. | Jinyu Li, Rui Zhao, Jui-Ting Huang, Yifan Gong |
| 2014 | Interspeech | Variable-component deep neural network for robust speech recognition. | Rui Zhao, Jinyu Li, Yifan Gong |
| 2014 | SC | Finding Constant from Change: Revisiting Network Performance Aware Optimizations on IaaS Clouds. | Yifan Gong, Bingsheng He, Dan Li |
| 2013 | ICASSP | Recent advances in deep learning for speech research at Microsoft. | Li Deng, Jinyu Li, Jui-Ting Huang, Kaisheng Yao, Dong Yu, Frank Seide, Michael L. Seltzer, Geoffrey Zweig, Xiaodong He, Jason D. Williams, Yifan Gong, Alex Acero |
| 2013 | ICASSP | Predicting speech recognition confidence using deep learning with word identity and score features. | Po-Sen Huang, Kshitiz Kumar, Chaojun Liu, Yifan Gong, Li Deng |
| 2013 | ICASSP | Cross-language knowledge transfer using multilingual deep neural network with shared hidden layers. | Jui-Ting Huang, Jinyu Li, Dong Yu, Li Deng, Yifan Gong |
| 2013 | Interspeech | Semi-supervised GMM and DNN acoustic model training with multi-system combination and confidence re-calibration. | Yan Huang, Dong Yu, Yifan Gong, Chaojun Liu |
| 2013 | Interspeech | Restructuring of deep neural network acoustic models with singular value decomposition. | Jian Xue, Jinyu Li, Yifan Gong |
| 2012 | ICASSP | Improvements to VTS feature enhancement. | Jinyu Li, Michael L. Seltzer, Yifan Gong |
| 2012 | Interspeech | Efficient VTS Adaptation Using Jacobian Approximation. | Jinyu Li, Michael L. Seltzer, Yifan Gong |
| 2012 | Interspeech | A Feature Space Transformation Method for Personalization using Generalized I-Vector Clustering. | Kaisheng Yao, Yifan Gong, Chaojun Liu |
| 2012 | PPoPP | An overview of CMPI: network performance aware MPI in the cloud. | Yifan Gong, Bingsheng He, Jianlong Zhong |
| 2010 | Interspeech | Unscented transform with online distortion estimation for HMM adaptation. | Jinyu Li, Dong Yu, Yifan Gong, Li Deng |
| 2009 | ICASSP | A study on multilingual acoustic modeling for large vocabulary ASR. | Hui Lin, Li Deng, Dong Yu, Yifan Gong, Alex Acero, Chin-Hui Lee |
| 2009 | ICASSP | Cross-lingual speech recognition under runtime resource constraints. | Dong Yu, Li Deng, Peng Liu, Jian Wu, Yifan Gong, Alex Acero |
| 2008 | ICASSP | HMM adaptation using a phase-sensitive acoustic distortion model for environment-robust speech recognition. | Jinyu Li, Li Deng, Dong Yu, Yifan Gong, Alex Acero |
| 2008 | ICASSP | Adaptation of compressed HMM parameters for resource-constrained speech recognition. | Jinyu Li, Li Deng, Dong Yu, Jian Wu, Yifan Gong, Alex Acero |
| 2008 | ICASSP | A minimum-mean-square-error noise reduction algorithm on Mel-frequency cepstra for robust speech recognition. | Dong Yu, Li Deng, Jasha Droppo, Jian Wu, Yifan Gong, Alex Acero |
| 2008 | Interspeech | Discriminative training of variable-parameter HMMs for noise robust speech recognition. | Dong Yu, Li Deng, Yifan Gong, Alex Acero |
| 2008 | Interspeech | Parameter clustering and sharing in variable-parameter HMMs for noise robust speech recognition. | Dong Yu, Li Deng, Yifan Gong, Alex Acero |
| 2007 | ASRU | High-performance hmm adaptation with joint compensation of additive and convolutive distortions via Vector Taylor Series. | Jinyu Li, Li Deng, Dong Yu, Yifan Gong, Alex Acero |
| 2006 | ICASSP | Modeling Variance Variation in a Variable Parameter HMM Framework for Noise Robust Speech Recognition. | Xiaodong Cui, Yifan Gong |
| 2004 | ICASSP | Can back-ends be more robust than front-ends? Investigation over the Aurora-2 database. | Alexis Bernard, Yifan Gong, Xiaodong Cui |
| 2003 | ICASSP | Variable parameter Gaussian mixture hidden Markov modeling for speech recognition. | Xiaodong Cui, Yifan Gong |
| 2003 | ICASSP | Model-space compensation of microphone and noise for speaker-independent speech recognition. | Yifan Gong |
| 2002 | ICASSP | Noise-robust open-set speaker recognition using noise-dependent Gaussian mixture classifier. | Yifan Gong |
| 2002 | Interspeech | A comparative study of approximations for parallel model combination of static and dynamic parameters. | Yifan Gong |
| 2002 | Interspeech | Experiments on speaker-independent voice command recognition using in-vehicle hands free speech. | Yifan Gong, Lorin Netsch |
| 2002 | Interspeech | The effects of speech compression on speech recognition and text-to-speech synthesis. | Yeshwant K. Muthusamy, Yifan Gong, Roshan Gupta |
| 2000 | ICASSP | Implementing a high accuracy speaker-independent continuous speech recognizer on a fixed-point DSP. | Yifan Gong, Yu-Hung Kao |
| 2000 | ICASSP | HMM adaptation and microphone array processing for distant speech recognition. | Jim Kleban, Yifan Gong |
| 1999 | ICASSP | Transforming HMMs for speaker-independent hands-free speech recognition in the car. | Yifan Gong, John J. Godfrey |
| 1999 | ICASSP | Speech-enabled information retrieval in the automobile environment. | Yeshwant K. Muthusamy, Rajeev Agarwal, Yifan Gong, Vishu Viswanathan |
| 1999 | ICASSP | Speaker-dependent name dialing in a car environment with out-of-vocabulary rejection. | Coimbatore S. Ramalingam, Yifan Gong, Lorin Netsch, Wallace W. Anderson, John J. Godfrey, Yu-Hung Kao |
| 1997 | ICASSP | A unified maximum likelihood approach to acoustic mismatch compensation: application to noisy Lombard speech recognition. | Mohamed Afify, Yifan Gong, Jean-Paul Haton |
| 1997 | ICASSP | Elimination of trajectory folding phenomenon: HMM, trajectory mixture HMM and mixture stochastic trajectory model. | Irina Illina, Yifan Gong |
| 1997 | ICASSP | The importance of segmentation probability in segment based speech recognizers. | Jan P. Verhasselt, Irina Illina, Jean-Pierre Martens, Yifan Gong, Jean-Paul Haton |
| 1997 | Interspeech | Correlation based predictive adaptation of hidden Markov models. | Mohamed Afify, Yifan Gong, Jean Paul Haton |
| 1997 | Interspeech | An acoustic subword unit approach to non-linguistic speech feature identification. | Mohamed Afify, Yifan Gong, Jean Paul Haton |
| 1997 | Interspeech | Source normalization training for HMM applied to noisy telephone speech recognition. | Yifan Gong |
| 1997 | Interspeech | Speaker normalization training for mixture stochastic trajectory model. | Irina Illina, Yifan Gong |
| 1996 | ICASSP | Probabilistic mapping networks for speaker recognition. | Haizhou Li, Yifan Gong, Jean-Paul Haton |
| 1996 | ICASSP | A semi-continuous stochastic trajectory model for phoneme-based continuous speech recognition. | Olivier Siohan, Yifan Gong |
| 1996 | Interspeech | Modelling long term variability information in mixture stochastic trajectory framework. | Yifan Gong, Irina Illina, Jean Paul Haton |
| 1996 | Interspeech | Stochastic trajectory model with state-mixture for continuous speech recognition. | Irina Illina, Yifan Gong |
| 1996 | Interspeech | Improvement in n-best search for continuous speech recognition. | Irina Illina, Yifan Gong |
| 1996 | Interspeech | A study on continuous Chinese speech recognition based on stochastic trajectory models. | Xiaohui Ma, Yifan Gong, Yuqing Fu, Jiren Lu, Jean Paul Haton |
| 1995 | ICDAR | Stochastic trajectory modeling for recognition of unconstrained handwritten words. | George Saon, Abdel Belad, Yifan Gong |
| 1995 | Interspeech | Stochastic trajectory models for speech recognition: an extension to modelling time correlation. | Mohamed Afify, Yifan Gong, Jean Paul Haton |
| 1995 | Interspeech | Evaluation of Bayes decision approach to automatic determination of thresholds for speaker verification. | Yifan Gong |
| 1995 | Interspeech | On MMI learning of Gaussian mixture for speaker models. | Haizhou Li, Jean Paul Haton, Yifan Gong |
| 1995 | Interspeech | Speaker recognition with temporal transition models. | Haizhou Li, Jean Paul Haton, Jian Su, Yifan Gong |
| 1995 | Interspeech | Noise adaptation using linear regression for continuous noisy speech recognition. | Olivier Siohan, Yifan Gong, Jean Paul Haton |
| 1994 | ICASSP | Stochastic trajectory modeling for speech recognition. | Yifan Gong, Jean Paul Haton |
| 1994 | ICASSP | Noise independent speech recognition for a variety of noise types. | William C. Treurniet, Yifan Gong |
| 1994 | Interspeech | Nonlinear time alignment in stochastic trajectory models for speech recognition. | Mohamed Afify, Yifan Gong, Jean Paul Haton |
| 1994 | Interspeech | A comparison of three noisy speech recognition approaches. | Olivier Siohan, Yifan Gong, Jean Paul Haton |
| 1994 | MVA | Off-line Handwriting Recognition by Statistical Correlation. | George Saon, Abdel Belad, Yifan Gong |
| 1993 | Interspeech | Base transformation for environment adaptation in continuous speech recognition. | Yifan Gong |
| 1993 | Interspeech | Iterative transformation and alignment for speech labeling. | Yifan Gong, Jean Paul Haton |
| 1993 | Interspeech | Duration of phones as function of utterance length and its use in automatic speech recognition. | Yifan Gong, William C. Treurniet |
| 1993 | Interspeech | Use of explicit context-dependent phonemic model in continuous speech recognition. | Feriel Mouria, Yifan Gong, Jean Paul Haton |
| 1993 | Interspeech | A Bayesian approach to phone duration adaptation for lombard speech recognition. | Olivier Siohan, Yifan Gong, Jean Paul Haton |
| 1992 | ICASSP | Nonlinear vectorial interpolation for speaker recognition. | Yifan Gong, Jean-Paul Haton |
| 1992 | ICPR | Hand-written text recognition based on a new formulation. | Yifan Gong, Anne Boyer |
| 1992 | Interspeech | DTW-based phonetic labeling using explicit phoneme duration constraints. | Yifan Gong, Jean Paul Haton |
| 1992 | Interspeech | Minimization of speech alignment error by iterative transformation for speaker adaptation. | Yifan Gong, Olivier Siohan, Jean Paul Haton |
| 1991 | ICASSP | Neural network coupled with IIR sequential adapter for phoneme recognition in continuous speech. | Yifan Gong, Ying Cheng, Jean-Paul Haton |
| 1991 | ICASSP | Non-linear vector interpolation by neural network for phoneme identification in continuous speech. | Yifan Gong, Jean-Paul Haton |
| 1991 | ICASSP | Continuous speech recognition based on high plausibility regions. | Yifan Gong, Jean-Paul Haton, Feriel Mouria |
| 1991 | Interspeech | Comparing two phoneme identification methods using a continuous speech recognizer. | Yifan Gong, Jean Paul Haton |
| 1991 | Interspeech | VINICS: a continuous speech recognizer based on a new robust formulation. | Yifan Gong, Jean Paul Haton |
| 1990 | ICASSP | Text-independent speaker recognition by trajectory space comparison. | Yifan Gong, Jean-Paul Haton |
| 1990 | ICPR | Towards a general signal interpretation system-signal-to-symbol conversion level. | Yifan Gong, Jean-Paul Haton |
| 1990 | ICPR | A multiknowledge base system for continuous speech understanding. | Yifan Gong, Jean-Paul Haton |
| 1989 | Interspeech | Parallel construction of syntactic structure for continuous speech recognition. | Yifan Gong, Anne Boyer, Jean Paul Haton |
| 1988 | ICASSP | A specialist society for continuous speech understanding. | Yifan Gong, Jean-Paul Haton |
| 1987 | Interspeech | Phoneme-based continuous speech recognition without pre-segmentation. | Yifan Gong, Jean Paul Haton |