| 2019 | Probing the Information Encoded in X-Vectors. | Desh Raj, David Snyder, Daniel Povey, Sanjeev Khudanpur |
| 2019 | Language Model Bootstrapping Using Neural Machine Translation for Conversational Speech Recognition. | Surabhi Punjabi, Harish Arsikere, Sri Garimella |
| 2019 | Second Language Transfer Learning in Humans and Machines Using Image Supervision. | Kiran Praveen, Anshul Gupta, Akshara Soman, Sriram Ganapathy |
| 2019 | Towards Real-Time Mispronunciation Detection in Kids' Speech. | Peter Plantinga, Eric Fosler-Lussier |
| 2019 | Syllable-Dependent Discriminative Learning for Small Footprint Text-Dependent Speaker Verification. | Junyi Peng, Yuexian Zou, Na Li, Deyi Tuo, Dan Su, Meng Yu, Chunlei Zhang, Dong Yu |
| 2019 | Logistic Similarity Metric Learning via Affinity Matrix for Text-Independent Speaker Verification. | Junyi Peng, Rongzhi Gu, Yuexian Zou |
| 2019 | Hierarchical Transformers for Long Document Classification. | Raghavendra Pappagari, Piotr Zelasko, Jess Villalba, Yishay Carmiel, Najim Dehak |
| 2019 | Tacotron-Based Acoustic Model Using Phoneme Alignment for Practical Neural Text-to-Speech Systems. | Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai |
| 2019 | Improving Grapheme-to-Phoneme Conversion by Investigating Copying Mechanism in Recurrent Architectures. | Abhishek Niranjan, M. Ali Basha Shaik |
| 2019 | Low-Resource Domain Adaptation for Speaker Recognition Using Cycle-Gans. | Phani Sankar Nidadavolu, Saurabh Kataria, Jess Villalba, Najim Dehak |
| 2019 | Recognizing Long-Form Speech Using Streaming End-to-End Models. | Arun Narayanan, Rohit Prabhavalkar, Chung-Cheng Chiu, David Rybach, Tara N. Sainath, Trevor Strohman |
| 2019 | Zero-Shot Code-Switching ASR and TTS with Multilingual Machine Speech Chain. | Sahoko Nakayama, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | Data Augmentation Based on Vowel Stretch for Improving Children's Speech Recognition. | Tohru Nagano, Takashi Fukuda, Masayuki Suzuki, Gakuto Kurata |
| 2019 | Spoken Language Identification Using Bidirectional LSTM Based LID Sequential Senones. | H. Muralikrishna, Pulkit Sapra, Anuksha Jain, Dileep Aroor Dinesh |
| 2019 | Speaker Verification with Application-Aware Beamforming. | Ladislav Mosner, Oldrich Plchot, Johan Rohdin, Luks Burget, Jan Cernock |
| 2019 | Streaming End-to-End Speech Recognition with Joint CTC-Attention Based Models. | Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2019 | Development of Voice Spoofing Detection Systems for 2019 Edition of Automatic Speaker Verification and Countermeasures Challenge. | Joo Monteiro, Jahangir Alam |
| 2019 | A Cross-Corpus Study on Speech Emotion Recognition. | Rosanna Milner, Md Asif Jalal, Raymond W. M. Ng, Thomas Hain |
| 2019 | Domain Adaptation via Teacher-Student Learning for End-to-End Speech Recognition. | Zhong Meng, Jinyu Li, Yashesh Gaur, Yifan Gong |
| 2019 | Character-Aware Attention-Based End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Jinyu Li, Yifan Gong |
| 2019 | A Density Ratio Approach to Language Model Fusion in End-to-End Automatic Speech Recognition. | Erik McDermott, Hasim Sak, Ehsan Variani |
| 2019 | Generalized Large-Context Language Models Based on Forward-Backward Hierarchical Recurrent Encoder-Decoder Models. | Ryo Masumura, Mana Ihori, Tomohiro Tanaka, Itsumi Saito, Kyosuke Nishida, Takanobu Oba |
| 2019 | Improving Speech-Based End-of-Turn Detection Via Cross-Modal Representation Learning with Punctuated Text Data. | Ryo Masumura, Mana Ihori, Tomohiro Tanaka, Atsushi Ando, Ryo Ishii, Takanobu Oba, Ryuichiro Higashinaka |
| 2019 | An Investigation of LSTM-CTC based Joint Acoustic Model for Indian Language Identification. | Tirusha Mandava, Ravi Kumar Vuddagiri, Hari Krishna Vydana, Anil Kumar Vuppala |
| 2019 | Online Batch Normalization Adaptation for Automatic Speech Recognition. | Franco Mana, Felix Weninger, Roberto Gemello, Puming Zhan |