| 2025 | Interspeech | Speaker Normalization and Content Restoration for Zero-Shot Voice Conversion with Attention-Enhanced Discriminator. | Desheng Hu, Yang Xiang, Jian Lu, Xinhui Hu, Xinkang Xu |
| 2025 | Interspeech | RA-CLAP: Relation-Augmented Emotional Speaking Style Contrastive Language-Audio Pretraining For Speech Retrieval. | Haoqin Sun, Jingguang Tian, Jiaming Zhou, Hui Wang, Jiabei He, Shiwan Zhao, Xiangyu Kong, Desheng Hu, Xinkang Xu, Xinhui Hu, Yong Qin |
| 2025 | Interspeech | Discrete Audio Representations for Automated Audio Captioning. | Jingguang Tian, Haoqin Sun, Xinhui Hu, Xinkang Xu |
| 2025 | Interspeech | A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model. | Yang Xiang, Canan Huang, Desheng Hu, Jingguang Tian, Xinhui Hu, Chao Zhang |
| 2024 | ICASSP | Learning Emotion-Invariant Speaker Representations for Speaker Verification. | Jingguang Tian, Xinhui Hu, Xinkang Xu |
| 2024 | ICASSP | The Royalflush Automatic Speech Diarization and Recognition System for In-Car Multi-Channel Automatic Speech Recognition Challenge. | Jingguang Tian, Shuaishuai Ye, Shunfei Chen, Yang Xiang, Zhaohui Yin, Xinhui Hu, Xinkang Xu |
| 2024 | ICASSP | A Deep Representation Learning-Based Speech Enhancement Method Using Complex Convolution Recurrent Variational Autoencoder. | Yang Xiang, Jingguang Tian, Xinhui Hu, Xinkang Xu, Zhaohui Yin |
| 2024 | Interspeech | SC-MoE: Switch Conformer Mixture of Experts for Unified Streaming and Non-streaming Code-Switching ASR. | Shuaishuai Ye, Shunfei Chen, Xinhui Hu, Xinkang Xu |
| 2023 | ACL | Hybrid-Regressive Paradigm for Accurate and Speed-Robust Neural Machine Translation. | Qiang Wang, Xinhui Hu, Ming Chen |
| 2023 | ASRU | LE-SSL-MOS: Self-Supervised Learning MOS Prediction with Listener Enhancement. | Zili Qi, Xinhui Hu, Wangjin Zhou, Sheng Li, Hao Wu, Jian Lu, Xinkang Xu |
| 2023 | HAI | Using Experience-Based Participatory Approach to Design Interactive Voice User Interfaces for Delivering Physical Activity Programs with Older Adults. | Smit Desai, Xinhui Hu, Morgan Lundy, Jessie Chin |
| 2023 | HCI | A Scoping Review of Mental Model Research in HCI from 2010 to 2021. | Xinhui Hu, Michael B. Twidale |
| 2022 | CSCWD | Toward Designing Trustworthy Autonomous Systems: Probing the Role of Humans' Ethical Perspectives. | Xinhui Hu, Masooda N. Bashir |
| 2022 | ICASSP | The Royalflush System of Speech Recognition for M2met Challenge. | Shuaishuai Ye, Peiyao Wang, Shunfei Chen, Xinhui Hu, Xinkang Xu |
| 2022 | Interspeech | Multiple Enhancements to LSTM for Learning Emotion-Salient Features in Speech Emotion Recognition. | Desheng Hu, Xinhui Hu, Xinkang Xu |
| 2021 | ICASSP | An Investigation of Using Hybrid Modeling Units for Improving End-to-End Speech Recognition System. | Shunfei Chen, Xinhui Hu, Sheng Li, Xinkang Xu |
| 2021 | Interspeech | An End-to-End Dialect Identification System with Transfer Learning from a Multilingual Automatic Speech Recognition Model. | Ding Wang, Shuaishuai Ye, Xinhui Hu, Sheng Li, Xinkang Xu |
| 2020 | Interspeech | Data Augmentation for Code-Switch Language Modeling by Fusing Multiple Text Generation Methods. | Xinhui Hu, Qi Zhang, Lei Yang, Binbin Gu, Xinkang Xu |
| 2018 | DASFAA | A High Precision Recommendation Algorithm Based on Combination Features. | Xinhui Hu, Qizhi Liu, Lun Li, Peizhang Liu |
| 2015 | ICDCS | Competitive Strategies for Online Cloud Resource Allocation with Discounts: The 2-Dimensional Parking Permit Problem. | Xinhui Hu, Arne Ludwig, Andra W. Richa, Stefan Schmid |
| 2014 | ICASSP | Translating TED speeches by recurrent neural network based translation model. | Youzheng Wu, Xinhui Hu, Chiori Hori |
| 2013 | ICDCN | Optimal Migration Contracts in Virtual Networks: Pay-as-You-Come vs Pay-as-You-Go Pricing. | Xinhui Hu, Stefan Schmid, Andra W. Richa, Anja Feldmann |
| 2013 | MDM | Multilingual Speech-to-Speech Translation System: VoiceTra. | Shigeki Matsuda, Xinhui Hu, Yoshinori Shiga, Hideki Kashioka, Chiori Hori, Keiji Yasuda, Hideo Okuma, Masao Uchiyama, Eiichiro Sumita, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Cluster-based language model for spoken document retrieval using NMF-based document clustering. | Xinhui Hu, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Construction and evaluations of an annotated Chinese conversational corpus in travel domain for the language model of speech recognition. | Xinhui Hu, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Constructing Japanese test collections for spoken term detection. | Yoshiaki Itoh, Hiromitsu Nishizaki, Xinhui Hu, Hiroaki Nanjo, Tomoyosi Akiba, Tatsuya Kawahara, Seiichi Nakagawa, Tomoko Matsui, Yoichi Yamashita, Kiyoaki Aikawa |
| 2007 | CIKM | Mining redundancy in candidate-bearing snippets to improve web question answering. | Youzheng Wu, Xinhui Hu, Hideki Kashioka |
| 2007 | EMNLP | Learning Unsupervised SVM Classifier for Answer Selection in Web Question Answering. | Youzheng Wu, Ruiqiang Zhang, Xinhui Hu, Hideki Kashioka |
| 2007 | PIMRC | A Priority MAC Protocol for Ad Hoc Networks with Multiple Channels. | Xi Fang, Xinhui Hu, Jianhua Zhang, Feng Jiang, Ping Zhang |
| 2006 | ICASSP | Automatic Derivation of a Phoneme Set with Tone Information for Chinese Speech Recognition Based on Mutual Information Criterion. | Jinsong Zhang, Xinhui Hu, Satoshi Nakamura |
| 2006 | Interspeech | Language modeling of Chinese personal names based on character units for continuous Chinese speech recognition. | Xinhui Hu, Hirofumi Yamamoto, Gen-ichiro Kikui, Yoshinori Sagisaka |
| 1995 | Interspeech | HMM-based tone recognition of Chinese trisyllables using double codebooks on fundamental frequency and waveform power. | Keikichi Hirose, Xinhui Hu |
| 1994 | Interspeech | Recognition of Chinese tones in monosyllabic and disyllabic speech using HMM. | Xinhui Hu, Keikichi Hirose |