Skip to content

Sanjeev Khudanpur

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

214

Venues

17

Active years

1997–2026

Best venue rank

A*

Where they publish

Papers

214 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLCSPB: Conversational Speech Processing Benchmark for Self-supervised Speech Models.Zili Huang, Matthew Maciejewski, Leibny Paola Garca-Perera, Shinji Watanabe, Sanjeev Khudanpur
2026SIGIRClustering-Based Methods for Vector-Based Pseudo-Relevance Feedback.Xavier Velez, Andrew Yates, Eugene Yang, Trevor Adriaanse, Sanjeev Khudanpur
2025ASRUGenVC: Self-Supervised Zero-Shot Voice Conversion.Zexin Cai, Henry Li Xinyuan, Ashi Garg, Leibny Paola Garca-Perera, Kevin Duh, Sanjeev Khudanpur, Matthew Wiesner, Nicholas Andrews
2025ASRUWST: Weakly Supervised Transducer for Automatic Speech Recognition.Dongji Gao, Chenda Liao, Changliang Liu, Matthew Wiesner, Leibny Paola Garca-Perera, Daniel Povey, Sanjeev Khudanpur, Jian Wu
2025ASRURapidly Adapting to New Voice Spoofing: Few-Shot Detection of Synthesized Speech Under Distribution Shifts.Ashi Garg, Zexin Cai, Henry Li Xinyuan, Leibny Paola Garca-Perera, Sanjeev Khudanpur, Matthew Wiesner, Nicholas Andrews
2025ASRUMADASR 2.0: Multi-Lingual Multi-Dialect ASR Challenge in 8 Indian Languages.Saurabh Kumar, Sumit Sharma, Deekshitha G, Abhayjeet Singh, Amartyaveer, Sathvik Udupa, Sandhya Badiger, Sanjeev Khudanpur, Sunayana Sitaram, Srinivasan Umesh, Bhuvana Ramabhadran, Brian Kingsbury, Hema A. Murthy, Srikanth S. Narayanan, Howard Lakougna, Prasanta Kumar Ghosh
2025ASRUCASPER: A Large Scale Spontaneous Speech Dataset.Cihan Xiao, Ruixing Liang, Xiangyu Zhang, Mehmet Emre Tiryaki, Veronica Bae, Lavanya Shankar, Rong Yang, Ethan Poon, Emmanuel Dupoux, Sanjeev Khudanpur, Leibny Paola Garca-Perera
2025ASRUScalable Controllable Accented TTS.Henry Li Xinyuan, Zexin Cai, Ashi Garg, Kevin Duh, Leibny Paola Garca-Perera, Sanjeev Khudanpur, Nicholas Andrews, Matthew Wiesner
2025EMNLPWhisper-UT: A Unified Translation Framework for Speech and Text.Cihan Xiao, Matthew Wiesner, Debashish Chakraborty, Reno Kriz, Keith Cunningham, Kenton Murray, Kevin Duh, Luis Tavarez-Arce, Paul McNamee, Sanjeev Khudanpur
2025ICASSPTarget Speaker ASR with Whisper.Alexander Polok, Dominik Klement, Matthew Wiesner, Sanjeev Khudanpur, Jan Cernock, Luks Burget
2025ICASSPHLTCOE Submission to the VoicePrivacy Attacker Challenge.Henry Li Xinyuan, Ashi Garg, Zexin Cai, Kevin Duh, Leibny Paola Garca-Perera, Sanjeev Khudanpur, Nicholas Andrews, Matthew Wiesner
2025InterspeechCS-FLEURS: A Massively Multilingual and Code-Switched Speech Dataset.Brian Yan, Injy Hamed, Shuichiro Shimizu, Vasista Sai Lodagala, William Chen, Olga Iakovenko, Bashar Talafha, Amir Hussein, Alexander Polok, Kalvin Chang, Dominik Klement, Sara Althubaiti, Puyuan Peng, Matthew Wiesner, Thamar Solorio, Ahmed Ali, Sanjeev Khudanpur, Shinji Watanabe
2025NAACLBenchmarking Language Model Creativity: A Case Study on Code Generation.Yining Lu, Dixuan Wang, Tianjian Li, Dongwei Jiang, Sanjeev Khudanpur, Meng Jiang, Daniel Khashabi
2024COLINGConEC: Earnings Call Dataset with Real-world Contexts for Benchmarking Contextual Speech Recognition.Ruizhe Huang, Mahsa Yarmohammadi, Jan Trmal, Jing Liu, Desh Raj, Leibny Paola Garca, Alexei V. Ivanov, Patrick Ehlen, Mingzhi Yu, Dan Povey, Sanjeev Khudanpur
2024ICASSPLess Peaky and More Accurate CTC Forced Alignment by Label Priors.Ruizhe Huang, Xiaohui Zhang, Zhaoheng Ni, Li Sun, Moto Hira, Jeff Hwang, Vimal Manohar, Vineel Pratap, Matthew Wiesner, Shinji Watanabe, Daniel Povey, Sanjeev Khudanpur
2024ICASSPEnhancing End-to-End Conversational Speech Translation Through Target Language Context Utilization.Amir Hussein, Brian Yan, Antonios Anastasopoulos, Shinji Watanabe, Sanjeev Khudanpur
2024ICASSPSpeech Collage: Code-Switched Audio Generation by Collaging Monolingual Corpora.Amir Hussein, Dorsa Zeinali, Ondrej Klejch, Matthew Wiesner, Brian Yan, Shammur Absar Chowdhury, Ahmed Ali, Shinji Watanabe, Sanjeev Khudanpur
2024ICASSPEnhancing Code-Switching Speech Recognition With Interactive Language Biases.Hexin Liu, Leibny Paola Garca, Xiangyu Zhang, Andy W. H. Khong, Sanjeev Khudanpur
2024InterspeechImproving Neural Biasing for Contextual Speech Recognition by Early Context Injection and Text Perturbation.Ruizhe Huang, Mahsa Yarmohammadi, Sanjeev Khudanpur, Daniel Povey
2024InterspeechEnhancing Neural Transducer for Multilingual ASR with Synchronized Language Diarization.Amir Hussein, Desh Raj, Matthew Wiesner, Daniel Povey, Paola Garca, Sanjeev Khudanpur
2024InterspeechEvaluating the Santa Barbara Corpus: Challenges of the Breadth of Conversational Spoken Language.Matthew Maciejewski, Dominik Klement, Ruizhe Huang, Matthew Wiesner, Sanjeev Khudanpur
2024InterspeechMulti-Channel Multi-Speaker ASR Using Target Speaker's Solo Segment.Yiwen Shao, Shi-Xiong Zhang, Yong Xu, Meng Yu, Dong Yu, Daniel Povey, Sanjeev Khudanpur
2024NAACLKreyl-MT: Building MT for Latin American, Caribbean and Colonial African Creole Languages.Nathaniel R. Robinson, Raj Dabre, Ammon Shurtz, Rasul Dent, Onenamiyi Onesi, Claire Bizon Monroc, Loc Grobol, Hasan Muhammad, Ashi Garg, Naome A. Etori, Vijay Murari Tiyyala, Olanrewaju Samuel, Matthew Dean Stutzman, Bismarck Bamfo Odoom, Sanjeev Khudanpur, Stephen D. Richardson, Kenton Murray
2023ASRULearning From Flawed Data: Weakly Supervised Automatic Speech Recognition.Dongji Gao, Hainan Xu, Desh Raj, Leibny Paola Garca-Perera, Daniel Povey, Sanjeev Khudanpur
2023ASRUJoint Energy-Based Model for Robust Speech Classification System Against Dirty-Label Backdoor Poisoning Attacks.Martin Sustek, Sonal Joshi, Henry Li, Thomas Thebaud, Jess Villalba, Sanjeev Khudanpur, Najim Dehak
2023ASRUClustering Unsupervised Representations as Defense Against Poisoning Attacks on Speech Commands Classification System.Thomas Thebaud, Sonal Joshi, Henry Li, Martin Sustek, Jess Villalba, Sanjeev Khudanpur, Najim Dehak
2023ICASSPEuro: Espnet Unsupervised ASR Open-Source Toolkit.Dongji Gao, Jiatong Shi, Shun-Po Chuang, Leibny Paola Garca, Hung-Yi Lee, Shinji Watanabe, Sanjeev Khudanpur
2023ICASSPAdapting Self-Supervised Models to Multi-Talker Speech Recognition Using Speaker Embeddings.Zili Huang, Desh Raj, Paola Garca, Sanjeev Khudanpur
2023ICASSPBuilding Keyword Search System from End-To-End Asr Systems.Ruizhe Huang, Matthew Wiesner, Leibny Paola Garca-Perera, Daniel Povey, Jan Trmal, Sanjeev Khudanpur
2023ICASSPReducing Language Confusion for Code-Switching Speech Recognition with Token-Level Language Diarization.Hexin Liu, Haihua Xu, Leibny Paola Garca, Andy W. H. Khong, Yi He, Sanjeev Khudanpur
2023ICDARCrosslingual Handwritten Text Generation Using GANs.Chun Chieh Chang, Leibny Paola Garca-Perera, Sanjeev Khudanpur
2023InterspeechMERLIon CCS Challenge: A English-Mandarin code-switching child-directed speech corpus for language identification and diarization.Yi Han Victoria Chua, Hexin Liu, Leibny Paola Garca, Fei Ting Woon, Jinyi Wong, Xiangyu Zhang, Sanjeev Khudanpur, Andy W. H. Khong, Justin Dauwels, Suzy J. Styles
2023InterspeechBypass Temporal Classification: Weakly Supervised Automatic Speech Recognition with Imperfect Transcripts.Dongji Gao, Matthew Wiesner, Hainan Xu, Leibny Paola Garca, Daniel Povey, Sanjeev Khudanpur
2023InterspeechGPU-accelerated Guided Source Separation for Meeting Transcription.Desh Raj, Daniel Povey, Sanjeev Khudanpur
2023InterspeechInvestigating model performance in language identification: beyond simple error statistics.Suzy J. Styles, Yi Han Victoria Chua, Fei Ting Woon, Hexin Liu, Leibny Paola Garca, Sanjeev Khudanpur, Andy W. H. Khong, Justin Dauwels
2023InterspeechHK-LegiCoST: Leveraging Non-Verbatim Transcripts for Speech Translation.Cihan Xiao, Henry Li Xinyuan, Jinyi Yang, Dongji Gao, Matthew Wiesner, Kevin Duh, Sanjeev Khudanpur
2022ICASSPInvestigating Self-Supervised Learning for Speech Enhancement and Separation.Zili Huang, Shinji Watanabe, Shu-Wen Yang, Paola Garca, Sanjeev Khudanpur
2022ICASSPInjecting Text and Cross-Lingual Supervision in Few-Shot Learning from Self-Supervised Models.Matthew Wiesner, Desh Raj, Sanjeev Khudanpur
2022InterspeechDefense against Adversarial Attacks on Hybrid Speech Recognition System using Adversarial Fine-tuning with Denoiser.Sonal Joshi, Saurabh Kataria, Yiwen Shao, Piotr Zelasko, Jess Villalba, Sanjeev Khudanpur, Najim Dehak
2022InterspeechPHO-LID: A Unified Model Incorporating Acoustic-Phonetic and Phonotactic Information for Language Identification.Hexin Liu, Leibny Paola Garca-Perera, Andy W. H. Khong, Suzy J. Styles, Sanjeev Khudanpur
2022InterspeechChunking Defense for Adversarial Attacks on ASR.Yiwen Shao, Jess Villalba, Sonal Joshi, Saurabh Kataria, Sanjeev Khudanpur, Najim Dehak
2021ICASSPAn Asynchronous WFST-Based Decoder for Automatic Speech Recognition.Hang Lv, Zhehuai Chen, Hainan Xu, Daniel Povey, Lei Xie, Sanjeev Khudanpur
2021ICASSPA Parallelizable Lattice Rescoring Strategy with Neural Language Models.Ke Li, Daniel Povey, Sanjeev Khudanpur
2021ICASSPTraining Noisy Single-Channel Speech Separation with Noisy Oracle Sources: A Large Gap and a Small Step.Matthew Maciejewski, Jing Shi, Shinji Watanabe, Sanjeev Khudanpur
2021ICASSPWake Word Detection with Streaming Transformers.Yiming Wang, Hang Lv, Daniel Povey, Lei Xie, Sanjeev Khudanpur
2021InterspeechGigaSpeech: An Evolving, Multi-Domain ASR Corpus with 10, 000 Hours of Transcribed Audio.Guoguo Chen, Shuzhou Chai, Guan-Bo Wang, Jiayu Du, Wei-Qiang Zhang, Chao Weng, Dan Su, Daniel Povey, Jan Trmal, Junbo Zhang, Mingjie Jin, Sanjeev Khudanpur, Shinji Watanabe, Shuaijiang Zhao, Wei Zou, Xiangang Li, Xuchen Yao, Yongqing Wang, Zhao You, Zhiyong Yan
2021InterspeechEnd-to-End Language Diarization for Bilingual Code-Switching Speech.Hexin Liu, Leibny Paola Garca-Perera, Xinyi Zhang, Justin Dauwels, Andy W. H. Khong, Sanjeev Khudanpur, Suzy J. Styles
2021InterspeechSpeaker Verification-Based Evaluation of Single-Channel Speech Separation.Matthew Maciejewski, Shinji Watanabe, Sanjeev Khudanpur
2021InterspeechReformulating DOVER-Lap Label Mapping as a Graph Partitioning Problem.Desh Raj, Sanjeev Khudanpur
2021InterspeechTraining Hybrid Models on Noisy Transliterated Transcripts for Code-Switched Speech Recognition.Matthew Wiesner, Mousmita Sarma, Ashish Arora, Desh Raj, Dongji Gao, Ruizhe Huang, Supreet Preet, Moris Johnson, Zikra Iqbal, Nagendra Goel, Jan Trmal, Leibny Paola Garca-Perera, Sanjeev Khudanpur
2020AMTASample Selection for Large-scale MT Discriminative Training.Yuan Cao, Sanjeev Khudanpur
2020ICASSPSpeaker Diarization with Region Proposal Network.Zili Huang, Shinji Watanabe, Yusuke Fujita, Paola Garca, Yiwen Shao, Daniel Povey, Sanjeev Khudanpur
2020ICASSPAn Empirical Study of Transformer-Based Neural Language Model Adaptation.Ke Li, Zhe Liu, Tianxing He, Hongzhao Huang, Fuchun Peng, Daniel Povey, Sanjeev Khudanpur
2020ICASSPOOV Recovery with Efficient 2nd Pass Decoding and Open-vocabulary Word-level RNNLM Rescoring for Hybrid ASR.Xiaohui Zhang, Daniel Povey, Sanjeev Khudanpur
2020InterspeechAn Alternative to MFCCs for ASR.Pegah Ghahramani, Hossein Hadian, Daniel Povey, Hynek Hermansky, Sanjeev Khudanpur
2020InterspeechEfficient MDI Adaptation for n-Gram Language Models.Ruizhe Huang, Ke Li, Ashish Arora, Daniel Povey, Sanjeev Khudanpur
2020InterspeechNeural Language Modeling with Implicit Cache Pointers.Ke Li, Daniel Povey, Sanjeev Khudanpur
2020InterspeechPyChain: A Fully Parallelized PyTorch Implementation of LF-MMI for End-to-End ASR.Yiwen Shao, Yiming Wang, Daniel Povey, Sanjeev Khudanpur
2020InterspeechWake Word Detection with Alignment-Free Lattice-Free MMI.Yiming Wang, Hang Lv, Daniel Povey, Lei Xie, Sanjeev Khudanpur
2019ASRUIncremental Lattice Determinization for WFST Decoders.Zhehuai Chen, Mahsa Yarmohammadi, Hainan Xu, Hang Lv, Lei Xie, Daniel Povey, Sanjeev Khudanpur
2019ASRUProbing the Information Encoded in X-Vectors.Desh Raj, David Snyder, Daniel Povey, Sanjeev Khudanpur
2019ASRUEspresso: A Fast End-to-End Neural Speech Recognition Toolkit.Yiming Wang, Sanjeev Khudanpur, Tongfei Chen, Hainan Xu, Shuoyang Ding, Hang Lv, Yiwen Shao, Nanyun Peng, Lei Xie, Shinji Watanabe
2019ASRUZero-Shot Pronunciation Lexicons for Cross-Language Acoustic Model Transfer.Matthew Wiesner, Oliver Adams, David Yarowsky, Jan Trmal, Sanjeev Khudanpur
2019ICASSPAcoustic Modeling for Overlapping Speech Recognition: Jhu Chime-5 Challenge System.Vimal Manohar, Szu-Jui Chen, Zhiqi Wang, Yusuke Fujita, Shinji Watanabe, Sanjeev Khudanpur
2019ICASSPSpeaker Recognition for Multi-speaker Conversations Using X-vectors.David Snyder, Daniel Garcia-Romero, Gregory Sell, Alan McCree, Daniel Povey, Sanjeev Khudanpur
2019ICDARUsing ASR Methods for OCR.Ashish Arora, Paola Garca, Shinji Watanabe, Vimal Manohar, Yiwen Shao, Sanjeev Khudanpur, Chun-Chieh Chang, Babak Rekabdar, Bagher BabaAli, Daniel Povey, David Etter, Desh Raj, Hossein Hadian, Jan Trmal
2019ICDAROptical Character Recognition with Chinese and Korean Character Decomposition.Chun-Chieh Chang, Ashish Arora, Leibny Paola Garca-Perera, David Etter, Daniel Povey, Sanjeev Khudanpur
2019Interspeechx-Vector DNN Refinement with Full-Length Recordings for Speaker Recognition.Daniel Garcia-Romero, David Snyder, Gregory Sell, Alan McCree, Daniel Povey, Sanjeev Khudanpur
2019InterspeechSpeaker Recognition Benchmark Using the CHiME-5 Corpus.Daniel Garcia-Romero, David Snyder, Shinji Watanabe, Gregory Sell, Alan McCree, Daniel Povey, Sanjeev Khudanpur
2019InterspeechThe JHU Speaker Recognition System for the VOiCES 2019 Challenge.David Snyder, Jess Villalba, Nanxin Chen, Daniel Povey, Gregory Sell, Najim Dehak, Sanjeev Khudanpur
2019InterspeechState-of-the-Art Speaker Recognition for Telephone and Video Speech: The JHU-MIT Submission for NIST SRE18.Jess Villalba, Nanxin Chen, David Snyder, Daniel Garcia-Romero, Alan McCree, Gregory Sell, Jonas Borgstrom, Fred Richardson, Suwon Shon, Franois Grondin, Rda Dehak, Leibny Paola Garca-Perera, Daniel Povey, Pedro A. Torres-Carrasquillo, Sanjeev Khudanpur, Najim Dehak
2019InterspeechThe JHU ASR System for VOiCES from a Distance Challenge 2019.Yiming Wang, David Snyder, Hainan Xu, Vimal Manohar, Phani Sankar Nidadavolu, Daniel Povey, Sanjeev Khudanpur
2019InterspeechPretraining by Backtranslation for End-to-End ASR in Low-Resource Settings.Matthew Wiesner, Adithya Renduchintala, Shinji Watanabe, Chunxi Liu, Najim Dehak, Sanjeev Khudanpur
2019InterspeechAdvances in Automatic Speech Recognition for Child Speech Using Factored Time Delay Neural Network.Fei Wu, Leibny Paola Garca-Perera, Daniel Povey, Sanjeev Khudanpur
2019InterspeechMulti-PLDA Diarization on Children's Speech.Jiamin Xie, Leibny Paola Garca-Perera, Daniel Povey, Sanjeev Khudanpur
2019WACVToward Computer Vision Systems That Understand Real-World Assembly Processes.Jonathan D. Jones, Gregory D. Hager, Sanjeev Khudanpur
2018CogSciConstraints and Development in Children's Block Construction.Cathryn S. Cortesa, Jonathan D. Jones, Gregory D. Hager, Sanjeev Khudanpur, Barbara Landau, Amy Lynne Shelton
2018ICASSPCharacterizing Performance of Speaker Diarization Systems on Far-Field Speech Using Standard Methods.Matthew Maciejewski, David Snyder, Vimal Manohar, Najim Dehak, Sanjeev Khudanpur
2018ICASSPSemi-Supervised Training of Acoustic Models Using Lattice-Free MMI.Vimal Manohar, Hossein Hadian, Daniel Povey, Sanjeev Khudanpur
2018ICASSPBayesian Models for Unit Discovery on a Very Low Resource Language.Lucas Ondel, Pierre Godard, Laurent Besacier, Elin Larsen, Mark Hasegawa-Johnson, Odette Scharenborg, Emmanuel Dupoux, Luks Burget, Franois Yvon, Sanjeev Khudanpur
2018ICASSPA Time-Restricted Self-Attention Layer for ASR.Daniel Povey, Hossein Hadian, Pegah Ghahremani, Ke Li, Sanjeev Khudanpur
2018ICASSPEnhancement and Analysis of Conversational Speech: JSALT 2017.Neville Ryant, Elika Bergelson, Kenneth Church, Alejandrina Cristi, Jun Du, Sriram Ganapathy, Sanjeev Khudanpur, Diana Kowalski, Mahesh Krishnamoorthy, Rajat Kulshreshta, Mark Y. Liberman, Yu-Ding Lu, Matthew Maciejewski, Florian Metze, Jn Profant, Lei Sun, Yu Tsao, Zhou Yu
2018ICASSPX-Vectors: Robust DNN Embeddings for Speaker Recognition.David Snyder, Daniel Garcia-Romero, Gregory Sell, Daniel Povey, Sanjeev Khudanpur
2018ICASSPA Pruned Rnnlm Lattice-Rescoring Algorithm for Automatic Speech Recognition.Hainan Xu, Tongfei Chen, Dongji Gao, Yiming Wang, Ke Li, Nagendra Goel, Yishay Carmiel, Daniel Povey, Sanjeev Khudanpur
2018ICASSPNeural Network Language Modeling with Letter-Based Features and Importance Sampling.Hainan Xu, Ke Li, Yiming Wang, Jian Wang, Shiyin Kang, Xie Chen, Daniel Povey, Sanjeev Khudanpur
2018InterspeechOutput-Gate Projected Gated Recurrent Unit for Speech Recognition.Gaofeng Cheng, Daniel Povey, Lu Huang, Ji Xu, Sanjeev Khudanpur, Yonghong Yan
2018InterspeechA GPU-based WFST Decoder with Exact Lattice Generation.Zhehuai Chen, Justin Luitjens, Hainan Xu, Yiming Wang, Daniel Povey, Sanjeev Khudanpur
2018InterspeechAcoustic Modeling from Frequency Domain Representations of Speech.Pegah Ghahremani, Hossein Hadian, Hang Lv, Daniel Povey, Sanjeev Khudanpur
2018InterspeechEnd-to-end Deep Neural Network Age Estimation.Pegah Ghahremani, Phani Sankar Nidadavolu, Nanxin Chen, Jess Villalba, Daniel Povey, Sanjeev Khudanpur, Najim Dehak
2018InterspeechEnd-to-end Speech Recognition Using Lattice-free MMI.Hossein Hadian, Hossein Sameti, Daniel Povey, Sanjeev Khudanpur
2018InterspeechRecurrent Neural Network Language Model Adaptation for Conversational Speech Recognition.Ke Li, Hainan Xu, Yiming Wang, Daniel Povey, Sanjeev Khudanpur
2018InterspeechSemi-Orthogonal Low-Rank Matrix Factorization for Deep Neural Networks.Daniel Povey, Gaofeng Cheng, Yiming Wang, Ke Li, Hainan Xu, Mahsa Yarmohammadi, Sanjeev Khudanpur
2018InterspeechDiarization is Hard: Some Experiences and Lessons Learned for the JHU Team in the Inaugural DIHARD Challenge.Gregory Sell, David Snyder, Alan McCree, Daniel Garcia-Romero, Jess Villalba, Matthew Maciejewski, Vimal Manohar, Najim Dehak, Daniel Povey, Shinji Watanabe, Sanjeev Khudanpur
2018InterspeechAutomatic Speech Recognition and Topic Identification from Speech for Almost-Zero-Resource Languages.Matthew Wiesner, Chunxi Liu, Lucas Ondel, Craig Harman, Vimal Manohar, Jan Trmal, Zhongqiang Huang, Najim Dehak, Sanjeev Khudanpur
2017ASRUInvestigation of transfer learning for ASR using LF-MMI trained neural networks.Pegah Ghahremani, Vimal Manohar, Hossein Hadian, Daniel Povey, Sanjeev Khudanpur
2017ASRUJHU Kaldi system for Arabic MGB-3 ASR challenge using diarization, audio-transcript alignment and transfer learning.Vimal Manohar, Daniel Povey, Sanjeev Khudanpur
2017CogSciCharacterizing spatial construction processes: Toward computational tools to understand cognition.Cathryn S. Cortesa, Jonathan D. Jones, Gregory D. Hager, Sanjeev Khudanpur, Amy Lynne Shelton, Barbara Landau
2017ICASSPTopic identification of spoken documents using unsupervised acoustic unit discovery.Santosh Kesiraju, Raghavendra Pappagari, Lucas Ondel, Luks Burget, Najim Dehak, Sanjeev Khudanpur, Jan Cernock, Suryakanth V. Gangashetty
2017ICASSPA study on data augmentation of reverberant speech for robust speech recognition.Tom Ko, Vijayaditya Peddinti, Daniel Povey, Michael L. Seltzer, Sanjeev Khudanpur
2017ICASSPAn empirical evaluation of zero resource acoustic unit discovery.Chunxi Liu, Jinyi Yang, Ming Sun, Santosh Kesiraju, Alena Rott, Lucas Ondel, Pegah Ghahremani, Najim Dehak, Luks Burget, Sanjeev Khudanpur
2017InterspeechAn Exploration of Dropout with LSTMs.Gaofeng Cheng, Vijayaditya Peddinti, Daniel Povey, Vimal Manohar, Sanjeev Khudanpur, Yonghong Yan
2017InterspeechPhone Duration Modeling for LVCSR Using Neural Networks.Hossein Hadian, Daniel Povey, Hossein Sameti, Sanjeev Khudanpur
2017InterspeechTopic Identification for Speech Without ASR.Chunxi Liu, Jan Trmal, Matthew Wiesner, Craig Harman, Sanjeev Khudanpur
2017InterspeechDeep Neural Network Embeddings for Text-Independent Speaker Verification.David Snyder, Daniel Garcia-Romero, Daniel Povey, Sanjeev Khudanpur
2017InterspeechThe Kaldi OpenKWS System: Improving Low Resource Keyword Search.Jan Trmal, Matthew Wiesner, Vijayaditya Peddinti, Xiaohui Zhang, Pegah Ghahremani, Yiming Wang, Vimal Manohar, Hainan Xu, Daniel Povey, Sanjeev Khudanpur
2017InterspeechBackstitch: Counteracting Finite-Sample Bias via Negative Steps.Yiming Wang, Vijayaditya Peddinti, Hainan Xu, Xiaohui Zhang, Daniel Povey, Sanjeev Khudanpur
2017InterspeechAcoustic Data-Driven Lexicon Learning Based on a Greedy Pronunciation Selection Framework.Xiaohui Zhang, Vimal Manohar, Daniel Povey, Sanjeev Khudanpur
2016ICASSPAcoustic data-driven pronunciation lexicon generation for logographic languages.Guoguo Chen, Daniel Povey, Sanjeev Khudanpur
2016ICASSPContext-dependent point process models for keyword search and detection-based ASR.Chunxi Liu, Aren Jansen, Sanjeev Khudanpur
2016ICASSPAdapting ASR for under-resourced languages using mismatched transcriptions.Chunxi Liu, Preethi Jyothi, Hao Tang, Vimal Manohar, Rose Sloan, Tyler Kekona, Mark Hasegawa-Johnson, Sanjeev Khudanpur
2016ICASSPHighway long short-term memory RNNS for distant speech recognition.Yu Zhang, Guoguo Chen, Dong Yu, Kaisheng Yao, Sanjeev Khudanpur, James R. Glass
2016ICRAUnsupervised surgical data alignment with application to automatic activity annotation.Yixin Gao, S. Swaroop Vedula, Gyusung I. Lee, Mija R. Lee, Sanjeev Khudanpur, Gregory D. Hager
2016InterspeechAcoustic Modelling from the Signal Domain Using CNNs.Pegah Ghahremani, Vimal Manohar, Daniel Povey, Sanjeev Khudanpur
2016InterspeechFar-Field ASR Without Parallel Data.Vijayaditya Peddinti, Vimal Manohar, Yiming Wang, Daniel Povey, Sanjeev Khudanpur
2016InterspeechPurely Sequence-Trained Neural Networks for ASR Based on Lattice-Free MMI.Daniel Povey, Vijayaditya Peddinti, Daniel Galvez, Pegah Ghahremani, Vimal Manohar, Xingyu Na, Yiming Wang, Sanjeev Khudanpur
2016LRECNew release of Mixer-6: Improved validity for phonetic study of speaker variation and identification.Eleanor Chodroff, Matthew Maciejewski, Jan Trmal, Sanjeev Khudanpur, John Godfrey
2015ASRUJHU ASpIRE system: Robust LVCSR with TDNNS, iVector adaptation and RNN-LMS.Vijayaditya Peddinti, Guoguo Chen, Vimal Manohar, Tom Ko, Daniel Povey, Sanjeev Khudanpur
2015EMNLPA Coarse-Grained Model for Optimal Coupling of ASR and SMT Systems for Speech Translation.Gaurav Kumar, Graeme W. Blackwood, Jan Trmal, Daniel Povey, Sanjeev Khudanpur
2015ICASSPTowards machines that know when they do not know: Summary of work done at 2014 Frederick Jelinek Memorial Workshop.Hynek Hermansky, Luks Burget, Jordan Cohen, Emmanuel Dupoux, Naomi Feldman, John Godfrey, Sanjeev Khudanpur, Matthew Maciejewski, Sri Harish Reddy Mallidi, Anjali Menon, Tetsuji Ogawa, Vijayaditya Peddinti, Richard C. Rose, Richard M. Stern, Matthew Wiesner, Karel Vesel
2015ICASSPLibrispeech: An ASR corpus based on public domain audio books.Vassil Panayotov, Guoguo Chen, Daniel Povey, Sanjeev Khudanpur
2015InterspeechPronunciation and silence probability modeling for ASR.Guoguo Chen, Hainan Xu, Minhua Wu, Daniel Povey, Sanjeev Khudanpur
2015InterspeechAudio augmentation for speech recognition.Tom Ko, Vijayaditya Peddinti, Daniel Povey, Sanjeev Khudanpur
2015InterspeechSemi-supervised maximum mutual information training of deep neural network acoustic models.Vimal Manohar, Daniel Povey, Sanjeev Khudanpur
2015InterspeechReverberation robust acoustic modeling using i-vectors with time delay neural networks.Vijayaditya Peddinti, Guoguo Chen, Daniel Povey, Sanjeev Khudanpur
2015InterspeechA time delay neural network architecture for efficient modeling of long temporal contexts.Vijayaditya Peddinti, Daniel Povey, Sanjeev Khudanpur
2015InterspeechModeling phonetic context with non-random forests for speech recognition.Hainan Xu, Guoguo Chen, Daniel Povey, Sanjeev Khudanpur
2015InterspeechA diversity-penalizing ensemble training method for deep learning.Xiaohui Zhang, Daniel Povey, Sanjeev Khudanpur
2014ACLOnline Learning in Tensor Space.Yuan Cao, Sanjeev Khudanpur
2014ACLCan You Repeat That? Using Word Repetition to Improve Spoken Term Detection.Jonathan Wintrode, Sanjeev Khudanpur
2014ICASSPA pitch extraction algorithm tuned for automatic speech recognition.Pegah Ghahremani, Bagher BabaAli, Daniel Povey, Korbinian Riedhammer, Jan Trmal, Sanjeev Khudanpur
2014ICASSPSome insights from translating conversational telephone speech.Gaurav Kumar, Matt Post, Daniel Povey, Sanjeev Khudanpur
2014ICASSPLimited resource term detection for effective topic identification of speech.Jonathan Wintrode, Sanjeev Khudanpur
2014ICASSPImproving deep neural network acoustic models using generalized maxout networks.Xiaohui Zhang, Jan Trmal, Daniel Povey, Sanjeev Khudanpur
2014InterspeechLow-resource open vocabulary keyword search using point process models.Chunxi Liu, Aren Jansen, Guoguo Chen, Keith Kintzley, Jan Trmal, Sanjeev Khudanpur
2013ASRUUsing proxies for OOV keywords in the keyword search task.Guoguo Chen, Oguz Yilmaz, Jan Trmal, Daniel Povey, Sanjeev Khudanpur
2013ICASSPQuantifying the value of pronunciation lexicons for keyword search in lowresource languages.Guoguo Chen, Sanjeev Khudanpur, Daniel Povey, Jan Trmal, David Yarowsky, Oguz Yilmaz
2013ICASSPA summary of the 2012 JHU CLSP workshop on zero resource speech technologies and models of early language acquisition.Aren Jansen, Emmanuel Dupoux, Sharon Goldwater, Mark Johnson, Sanjeev Khudanpur, Kenneth Church, Naomi Feldman, Hynek Hermansky, Florian Metze, Richard C. Rose, Mike Seltzer, Pascal Clark, Ian McGraw, Balakrishnan Varadarajan, Erin Bennett, Benjamin Brschinger, Justin T. Chiu, Ewan Dunbar, Abdellah Fourtassi, David Harwath, Chia-ying Lee, Keith D. Levin, Atta Norouzian, Vijayaditya Peddinti, Rachael Richardson, Thomas Schatz, Samuel Thomas
2013MICCAIString Motif-Based Description of Tool Motion for Detecting Skill and Gestures in Robotic Surgery.Narges Ahmidi, Yixin Gao, Benjamn Bjar Haro, S. Swaroop Vedula, Sanjeev Khudanpur, Ren Vidal, Gregory D. Hager
2012ACLFast Syntactic Analysis for Statistical Language Modeling via Substructure Sharing and Uptraining.Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur
2012ICASSPSemi-supervised discriminative language modeling for Turkish ASR.Arda elebi, Hasim Sak, Erin Dikici, Murat Saraclar, Maider Lehr, Emily Tucker Prud'hommeaux, Puyang Xu, Nathan Glenn, Damianos Karakos, Sanjeev Khudanpur, Brian Roark, Kenji Sagae, Izhak Shafran, Daniel M. Bikel, Chris Callison-Burch, Yuan Cao, Keith B. Hall, Eva Hasler, Philipp Koehn, Adam Lopez, Matt Post, Darcey Riley
2012ICASSPHallucinated n-best lists for discriminative language modeling.Kenji Sagae, Maider Lehr, Emily Tucker Prud'hommeaux, Puyang Xu, Nathan Glenn, Damianos Karakos, Sanjeev Khudanpur, Brian Roark, Murat Saraclar, Izhak Shafran, Daniel M. Bikel, Chris Callison-Burch, Yuan Cao, Keith B. Hall, Eva Hasler, Philipp Koehn, Adam Lopez, Matt Post, Darcey Riley
2012ICASSPContinuous space discriminative language modeling.Puyang Xu, Sanjeev Khudanpur, Maider Lehr, Emily Tucker Prud'hommeaux, Nathan Glenn, Damianos Karakos, Brian Roark, Kenji Sagae, Murat Saraclar, Izhak Shafran, Daniel M. Bikel, Chris Callison-Burch, Yuan Cao, Keith B. Hall, Eva Hasler, Philipp Koehn, Adam Lopez, Matt Post, Darcey Riley
2012InterspeechDeriving conversation-based features from unlabeled speech for discriminative language modeling.Damianos Karakos, Brian Roark, Izhak Shafran, Kenji Sagae, Maider Lehr, Emily Tucker Prud'hommeaux, Puyang Xu, Nathan Glenn, Sanjeev Khudanpur, Murat Saraclar, Daniel M. Bikel, Mark Dredze, Chris Callison-Burch, Yuan Cao, Keith B. Hall, Eva Hasler, Philipp Koehn, Adam Lopez, Matt Post, Darcey Riley
2012InterspeechSemi-Supervised Methods for Improving Keyword Search of Unseen Terms.Scott Novotney, Ivan Bulyko, Richard M. Schwartz, Sanjeev Khudanpur, Owen Kimball
2012InterspeechEfficient Structured Language Modeling for Speech Recognition.Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur
2012InterspeechPhrasal Cohort Based Unsupervised Discriminative Language Modeling.Puyang Xu, Brian Roark, Sanjeev Khudanpur
2012NAACLRevisiting the Case for Explicit Syntactic Information in Language Models.Ariya Rastrow, Sanjeev Khudanpur, Mark Dredze
2011ASRUEstimating document frequencies in a speech corpus.Damianos Karakos, Mark Dredze, Ken Ward Church, Aren Jansen, Sanjeev Khudanpur
2011ASRUEfficient discriminative training of long-span language models.Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur
2011ASRUAdapting n-gram maximum entropy language models with conditional entropy regularization.Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur
2011ASRURandomized maximum entropy language models.Puyang Xu, Sanjeev Khudanpur, Asela Gunawardana
2011EMNLPMinimum Imputed-Risk: Unsupervised Discriminative Training for Machine Translation.Zhifei Li, Ziyuan Wang, Jason Eisner, Sanjeev Khudanpur, Brian Roark
2011EMNLPEfficient Subsampling for Training Complex Language Models.Puyang Xu, Asela Gunawardana, Sanjeev Khudanpur
2011ICASSPVariational approximation of long-span language models for lvcsr.Anoop Deoras, Toms Mikolov, Stefan Kombrink, Martin Karafit, Sanjeev Khudanpur
2011ICASSPExtensions of recurrent neural network language model.Toms Mikolov, Stefan Kombrink, Luks Burget, Jan Cernock, Sanjeev Khudanpur
2011ICASSPHill climbing on speech lattices: A new rescoring framework.Ariya Rastrow, Markus Dreyer, Abhinav Sethy, Sanjeev Khudanpur, Bhuvana Ramabhadran, Mark Dredze
2011ICASSPLearning and inference algorithms for partially observed structured switching vector autoregressive models.Balakrishnan Varadarajan, Sanjeev Khudanpur
2011ICASSPDirichlet Mixture Models of neural net posteriors for HMM-based speech recognition.Balakrishnan Varadarajan, Garimella S. V. S. Sivaram, Sanjeev Khudanpur
2011InterspeechUnsupervised Arabic Dialect Adaptation with Self-Training.Scott Novotney, Richard M. Schwartz, Sanjeev Khudanpur
2010COLINGUnsupervised Discriminative Language Model Training for Machine Translation using Simulated Confusion Sets.Zhifei Li, Ziyuan Wang, Sanjeev Khudanpur, Jason Eisner
2010ICASSPHypothesis ranking and two-pass approaches for machine translation system combination.Damianos Karakos, Jason Smith, Sanjeev Khudanpur
2010InterspeechRecurrent neural network based language model.Toms Mikolov, Martin Karafit, Luks Burget, Jan Cernock, Sanjeev Khudanpur
2010NAACLA Comparative Study of Word Co-occurrence for Term Clustering in Language Model-based Sentence Retrieval.Saeedeh Momtazi, Sanjeev Khudanpur, Dietrich Klakow
2009ACLDemonstration of Joshua: An Open Source Toolkit for Parsing-based Machine Translation.Zhifei Li, Chris Callison-Burch, Chris Dyer, Juri Ganitkevitch, Sanjeev Khudanpur, Lane Schwartz, Wren N. G. Thornton, Jonathan Weese, Omar Zaidan
2009ACLVariational Decoding for Statistical Machine Translation.Zhifei Li, Jason Eisner, Sanjeev Khudanpur
2009ASRUSelf-supervised discriminative training of statistical language models.Puyang Xu, Damianos Karakos, Sanjeev Khudanpur
2009ICASSPWEB-derived pronunciations.Arnab Ghoshal, Martin Jansche, Sanjeev Khudanpur, Michael Riley, Morgan Ulinski
2009ICASSPImpact of novel sources on content-based image and video retrieval.Arnab Ghoshal, Sanjeev Khudanpur, Dietrich Klakow
2009InterspeechUnsupervised estimation of the language model scaling factor.Christopher M. White, Ariya Rastrow, Sanjeev Khudanpur, Frederick Jelinek
2009MICCAIData-Derived Models for Segmentation with Application to Surgical Assessment and Training.Balakrishnan Varadarajan, Carol E. Reiley, Henry Lin, Sanjeev Khudanpur, Gregory D. Hager
2009NAACLEfficient Extraction of Oracle-best Translations from Hypergraphs.Zhifei Li, Sanjeev Khudanpur
2009SIGIRWeb derived pronunciations for spoken term detection.Dogan Can, Erica Cooper, Arnab Ghoshal, Martin Jansche, Sanjeev Khudanpur, Bhuvana Ramabhadran, Michael Riley, Murat Saraclar, Abhinav Sethy, Morgan Ulinski, Christopher M. White
2008ACLMachine Translation System Combination using ITG-based Alignments.Damianos Karakos, Jason Eisner, Sanjeev Khudanpur, Markus Dreyer
2008ACLUnsupervised Learning of Acoustic Sub-word Units.Balakrishnan Varadarajan, Sanjeev Khudanpur, Emmanuel Dupoux
2008AMTALarge-scale Discriminative n-gram Language Models for Statistical Machine Translation.Zhifei Li, Sanjeev Khudanpur
2008ICASSPCombination of strongly and weakly constrained recognizers for reliable detection of OOVS.Luks Burget, Petr Schwarz, Pavel Matejka, Mirko Hannemann, Ariya Rastrow, Christopher M. White, Sanjeev Khudanpur, Hynek Hermansky, Jan Cernock
2008ICASSPSample selection for automatic language identification.David Farris, Christopher M. White, Sanjeev Khudanpur
2008InterspeechAutomatically learning speaker-independent acoustic subword units.Balakrishnan Varadarajan, Sanjeev Khudanpur
2008InterspeechAn investigation of acoustic models for multilingual code-switching.Christopher M. White, Sanjeev Khudanpur, James K. Baker
2008ISITComputation of Csiszr's mutual Information of order α.Damianos Karakos, Sanjeev Khudanpur, Carey E. Priebe
2007ICASSPIterative Denoising using Jensen-Renyi Divergences with an Application to Unsupervised Document Categorization.Damianos Karakos, Sanjeev Khudanpur, Jason Eisner, Carey E. Priebe
2007InterspeechLarge-scale random forest language models for speech recognition.Yi Su, Frederick Jelinek, Sanjeev Khudanpur
2007ISITError Bounds and Improved Probability Estimation using the Maximum Likelihood Set.Damianos Karakos, Sanjeev Khudanpur
2007NAACLCross-Instance Tuning of Unsupervised Document Clustering Algorithms.Damianos Karakos, Jason Eisner, Sanjeev Khudanpur, Carey E. Priebe
2006ICASSPSource Adaptation for Improved Content-Based Video Retrieval.Arnab Ghoshal, Sanjeev Khudanpur
2006ISITLanguage Modeling with the Maximum Likelihood Set: Complexity Issues and the Back-off Formula.Damianos Karakos, Sanjeev Khudanpur
2005ICASSPUnsupervised classification via decision trees: an information-theoretic perspective.Damianos Karakos, Sanjeev Khudanpur, Jason Eisner, Carey E. Priebe
2005SIGIRHidden Markov models for automatic annotation and content-based retrieval of images and video.Arnab Ghoshal, Pavel Ircing, Sanjeev Khudanpur
2004ICASSPCross-lingual latent semantic analysis for language modeling.Woosung Kim, Sanjeev Khudanpur
2004NAACLA Smorgasbord of Features for Statistical Machine Translation.Franz Josef Och, Daniel Gildea, Sanjeev Khudanpur, Anoop Sarkar, Kenji Yamada, Alexander M. Fraser, Shankar Kumar, Libin Shen, David Smith, Katherine Eng, Viren Jain, Zhen Jin, Dragomir R. Radev
2003ACLTransliteration of Proper Names in Cross-Lingual Information Retrieval.Paola Virga, Sanjeev Khudanpur
2003EMNLPCross-Lingual Lexical Triggers in Statistical Language Modeling.Woosung Kim, Sanjeev Khudanpur
2003InterspeechLanguage model adaptation using cross-lingual information.Woosung Kim, Sanjeev Khudanpur
2003NAACLLatent Semantic Information in Maximum Entropy Language Models for Conversational Speech Recognition.Yonggang Deng, Sanjeev Khudanpur
2003NAACLDesparately Seeking Cebuano.Douglas W. Oard, David S. Doermann, Bonnie J. Dorr, Daqing He, Philip Resnik, Amy Weinberg, William J. Byrne, Sanjeev Khudanpur, David Yarowsky, Anton Leuski, Philipp Koehn, Kevin Knight
2003SIGIRTransliteration of proper names in cross-language applications.Paola Virga, Sanjeev Khudanpur
2002ICASSPBuilding a topic-dependent maximum entropy model for very large corpora.Jun Wu, Sanjeev Khudanpur
2002InterspeechUsing cross-language cues for story-specific language modeling.Sanjeev Khudanpur, Woosung Kim
2001InterspeechOn large vocabulary continuous speech recognition of highly inflectional language - czech.Pavel Ircing, Pavel Krbec, Jan Hajic, Josef Psutka, Sanjeev Khudanpur, Frederick Jelinek, William Byrne
2001InterspeechSmoothing issues in the structured language model.Woosung Kim, Sanjeev Khudanpur, Jun Wu
2001NAACLRobust Knowledge Discovery from Parallel Speech and Text Sources.Frederick Jelinek, William J. Byrne, Sanjeev Khudanpur, Barbora Hladk, Hermann Ney, Franz Josef Och, J. Curn, Josef Psutka
2001NAACLMandarin-English Information: Investigating Translingual Speech Retrieval.Helen M. Meng, Berlin Chen, Sanjeev Khudanpur, Gina-Anne Levow, Wai-Kit Lo, Douglas W. Oard, Patrick Schone, Karen Tang, Hsin-Min Wang, Jianqiang Wang
2000ICASSPTowards language independent acoustic modeling.William Byrne, Peter Beyerlein, Juan M. Huerta, Sanjeev Khudanpur, B. Marthi, John Morgan, Nino Peterek, Joe Picone, Dimitra Vergyri, W. Wang
2000ICASSPPronunciation ambiguity vs. pronunciation variability in speech recognition.Murat Saralar, Sanjeev Khudanpur
2000ICASSPSyntactic heads in statistical language modeling.Jun Wu, Sanjeev Khudanpur
2000InterspeechEfficient training methods for maximum entropy language modeling.Jun Wu, Sanjeev Khudanpur
1999ICASSPRapid speech recognizer adaptation to new speakers.Vassilios Digalakis, Heather Collier, Sid Berkowitz, Adrian Corduneanu, Enrico Bocchieri, Ashvin Kannan, Constantinos Boulis, Sanjeev Khudanpur, William Byrne, Ananth Sankar
1999ICASSPTree-structured models of parameter dependence for rapid adaptation in large vocabulary conversational speech recognition.Ashvin Kannan, Sanjeev Khudanpur
1999ICASSPA maximum entropy language model integrating N-grams and topic dependencies for conversational speech recognition.Sanjeev Khudanpur, Jun Wu
1999InterspeechPronunciation modeling by sharing gaussian densities across phonetic models.Murat Saraclar, Harriet J. Nock, Sanjeev Khudanpur
1999InterspeechCombining nonlocal, syntactic and n-gram dependencies in language modeling.Jun Wu, Sanjeev Khudanpur
1998ICASSPPronunciation modelling using a hand-labelled corpus for conversational speech recognition.William Byrne, Michael Finke, Sanjeev Khudanpur, John W. McDonough, Harriet J. Nock, Michael Riley, Murat Saralar, Charles Wooters, George Zavaliagkos
1998ICASSPLVCSR rescoring with modified loss functions: a decision theoretic perspective.Vaibhava Goel, William Byrne, Sanjeev Khudanpur
1997InterspeechStructure and performance of a dependency language model.Ciprian Chelba, David Engle, Frederick Jelinek, Victor Jimenez, Sanjeev Khudanpur, Lidia Mangu, Harry Printz, Eric Ristad, Ronald Rosenfeld, Andreas Stolcke, Dekai Wu