Bhuvana Ramabhadran
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
207
Venues
9
Active years
1998–2025
Best venue rank
A*
Where they publish
Papers
207 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASRU | MADASR 2.0: Multi-Lingual Multi-Dialect ASR Challenge in 8 Indian Languages. | Saurabh Kumar, Sumit Sharma, Deekshitha G, Abhayjeet Singh, Amartyaveer, Sathvik Udupa, Sandhya Badiger, Sanjeev Khudanpur, Sunayana Sitaram, Srinivasan Umesh, Bhuvana Ramabhadran, Brian Kingsbury, Hema A. Murthy, Srikanth S. Narayanan, Howard Lakougna, Prasanta Kumar Ghosh |
| 2025 | EMNLP | LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors. | Rao Ma, Tongzhou Chen, Kartik Audhkhasi, Bhuvana Ramabhadran |
| 2025 | ICASSP | Audio Diffusion with Large Language Models. | Yinghui Huang, Kyle Kastner, Kartik Audhkhasi, Bhuvana Ramabhadran, Andrew Rosenberg |
| 2025 | ICASSP | Speech Re-Painting for Robust ASR. | Kyle Kastner, Gary Wang, Isaac Elias, Takaaki Saeki, Pedro Moreno Mengibar, Franoise Beaufays, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2025 | ICASSP | Weak-to-Strong Generalization in Speech Recognition. | Soheil Khorram, Qian Zhang, Rohit Prabhavalkar, Kartik Audhkhasi, Bhuvana Ramabhadran |
| 2025 | ICASSP | Identifying and Mitigating Mismatched Language Code in Multilingual ASR. | Jaeyoung Kim, Sepand Mavandadi, Kartik Audhkhasi, Shikhar Bharadwaj, Brian Farris, Tongzhou Chen, Bhuvana Ramabhadran, Sriram Ganapathy |
| 2024 | ICASSP | Task Vector Algebra for ASR Models. | Gowtham Ramesh, Kartik Audhkhasi, Bhuvana Ramabhadran |
| 2024 | ICASSP | Extending Multilingual Speech Synthesis to 100+ Languages without Transcribed Data. | Takaaki Saeki, Gary Wang, Nobuyuki Morioka, Isaac Elias, Kyle Kastner, Andrew Rosenberg, Bhuvana Ramabhadran, Heiga Zen, Franoise Beaufays, Hadar Shemtov |
| 2024 | Interspeech | Speech Prefix-Tuning with RNNT Loss for Improving LLM Predictions. | Murali Karthick Baskar, Andrew Rosenberg, Bhuvana Ramabhadran, Neeraj Gaur, Zhong Meng |
| 2024 | Interspeech | ASTRA: Aligning Speech and Text Representations for Asr without Sampling. | Neeraj Gaur, Rohan Agrawal, Gary Wang, Parisa Haghani, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2024 | Interspeech | Text Injection for Neural Contextual Biasing. | Zhong Meng, Zelin Wu, Rohit Prabhavalkar, Cal Peyser, Weiran Wang, Nanxin Chen, Tara N. Sainath, Bhuvana Ramabhadran |
| 2024 | Interspeech | Contemplative Mechanism for Speech Recognition: Speech Encoders can Think. | Tien-Ju Yang, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2024 | Interspeech | Speculative Speech Recognition by Audio-Prefixed Low-Rank Adaptation of Language Models. | Bolaji Yusuf, Murali Karthick Baskar, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2023 | ASRU | Mask-Conformer: Augmenting Conformer with Mask-Predict Decoder. | Yosuke Higuchi, Andrew Rosenberg, Yuan Wang, Murali Karthick Baskar, Bhuvana Ramabhadran |
| 2023 | ICASSP | Modular Conformer Training for Flexible End-to-End ASR. | Kartik Audhkhasi, Brian Farris, Bhuvana Ramabhadran, Pedro J. Moreno |
| 2023 | ICASSP | Large-Scale Language Model Rescoring on Long-Form Data. | Tongzhou Chen, Cyril Allauzen, Yinghui Huang, Daniel S. Park, David Rybach, W. Ronny Huang, Rodrigo Cabrera, Kartik Audhkhasi, Bhuvana Ramabhadran, Pedro J. Moreno, Michael Riley |
| 2023 | ICASSP | JEIT: Joint End-to-End Model and Internal Language Model Training for Speech Recognition. | Zhong Meng, Weiran Wang, Rohit Prabhavalkar, Tara N. Sainath, Tongzhou Chen, Ehsan Variani, Yu Zhang, Bo Li, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2023 | ICASSP | Virtuoso: Massive Multilingual Speech-Text Joint Semi-Supervised Learning for Text-to-Speech. | Takaaki Saeki, Heiga Zen, Zhehuai Chen, Nobuyuki Morioka, Gary Wang, Yu Zhang, Ankur Bapna, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2023 | ICASSP | Understanding Shared Speech-Text Representations. | Gary Wang, Kyle Kastner, Ankur Bapna, Zhehuai Chen, Andrew Rosenberg, Bhuvana Ramabhadran, Yu Zhang |
| 2023 | ICASSP | Robust Knowledge Distillation from RNN-T Models with Noisy Training Labels Using Full-Sum Loss. | Mohammad Zeineldeen, Kartik Audhkhasi, Murali Karthick Baskar, Bhuvana Ramabhadran |
| 2023 | Interspeech | O-1: Self-training with Oracle and 1-best Hypothesis. | Murali Karthick Baskar, Andrew Rosenberg, Bhuvana Ramabhadran, Kartik Audhkhasi |
| 2023 | Interspeech | Using Text Injection to Improve Recognition of Personal Identifiers in Speech. | Yochai Blau, Rohan Agrawal, Lior Madmony, Gary Wang, Andrew Rosenberg, Zhehuai Chen, Zorik Gekhman, Genady Beryozkin, Parisa Haghani, Bhuvana Ramabhadran |
| 2022 | ICASSP | Tts4pretrain 2.0: Advancing the use of Text and Speech in ASR Pretraining with Consistency and Contrastive Losses. | Zhehuai Chen, Yu Zhang, Andrew Rosenberg, Bhuvana Ramabhadran, Pedro J. Moreno, Gary Wang |
| 2022 | ICASSP | Multilingual Second-Pass Rescoring for Automatic Speech Recognition Systems. | Neeraj Gaur, Tongzhou Chen, Ehsan Variani, Parisa Haghani, Bhuvana Ramabhadran, Pedro J. Moreno |
| 2022 | Interspeech | Analysis of Self-Attention Head Diversity for Conformer-based Automatic Speech Recognition. | Kartik Audhkhasi, Yinghui Huang, Bhuvana Ramabhadran, Pedro J. Moreno |
| 2022 | Interspeech | Reducing Domain mismatch in Self-supervised speech pre-training. | Murali Karthick Baskar, Andrew Rosenberg, Bhuvana Ramabhadran, Yu Zhang, Nicols Serrano |
| 2022 | Interspeech | MAESTRO: Matched Speech Text Representations through Modality Matching. | Zhehuai Chen, Yu Zhang, Andrew Rosenberg, Bhuvana Ramabhadran, Pedro J. Moreno, Ankur Bapna, Heiga Zen |
| 2022 | Interspeech | On Adaptive Weight Interpolation of the Hybrid Autoregressive Transducer. | Ehsan Variani, Michael Riley, David Rybach, Cyril Allauzen, Tongzhou Chen, Bhuvana Ramabhadran |
| 2022 | Interspeech | Improving Rare Word Recognition with LM-aware MWER Training. | Weiran Wang, Tongzhou Chen, Tara N. Sainath, Ehsan Variani, Rohit Prabhavalkar, W. Ronny Huang, Bhuvana Ramabhadran, Neeraj Gaur, Sepand Mavandadi, Cal Peyser, Trevor Strohman, Yanzhang He, David Rybach |
| 2022 | Interspeech | Non-Parallel Voice Conversion for ASR Augmentation. | Gary Wang, Andrew Rosenberg, Bhuvana Ramabhadran, Fadi Biadsy, Jesse Emond, Yinghui Huang, Pedro J. Moreno |
| 2021 | ASRU | Injecting Text in Self-Supervised Speech Pretraining. | Zhehuai Chen, Yu Zhang, Andrew Rosenberg, Bhuvana Ramabhadran, Gary Wang, Pedro J. Moreno |
| 2021 | ICASSP | Extending Parrotron: An End-to-End, Speech Conversion and Speech Recognition Model for Atypical Speech. | Rohan Doshi, Youzheng Chen, Liyang Jiang, Xia Zhang, Fadi Biadsy, Bhuvana Ramabhadran, Fang Chu, Andrew Rosenberg, Pedro J. Moreno |
| 2021 | ICASSP | Mixture of Informed Experts for Multilingual Speech Recognition. | Neeraj Gaur, Brian Farris, Parisa Haghani, Isabel Leal, Pedro J. Moreno, Manasa Prasad, Bhuvana Ramabhadran, Yun Zhu |
| 2021 | ICASSP | Convolutional Dropout and Wordpiece Augmentation for End-to-End Speech Recognition. | Hainan Xu, Yinghui Huang, Yun Zhu, Kartik Audhkhasi, Bhuvana Ramabhadran |
| 2021 | Interspeech | Mixture Model Attention: Flexible Streaming and Non-Streaming Automatic Speech Recognition. | Kartik Audhkhasi, Tongzhou Chen, Bhuvana Ramabhadran, Pedro J. Moreno |
| 2021 | Interspeech | Conformer Parrotron: A Faster and Stronger End-to-End Speech Conversion and Recognition Model for Atypical Speech. | Zhehuai Chen, Bhuvana Ramabhadran, Fadi Biadsy, Xia Zhang, Youzheng Chen, Liyang Jiang, Fang Chu, Rohan Doshi, Pedro J. Moreno |
| 2021 | Interspeech | Semi-Supervision in ASR: Sequential MixMatch and Factorized TTS-Based Augmentation. | Zhehuai Chen, Andrew Rosenberg, Yu Zhang, Heiga Zen, Mohammadreza Ghodsi, Yinghui Huang, Jesse Emond, Gary Wang, Bhuvana Ramabhadran, Pedro J. Moreno |
| 2021 | Interspeech | Self-Adaptive Distillation for Multilingual Speech Recognition: Leveraging Student Independence. | Isabel Leal, Neeraj Gaur, Parisa Haghani, Brian Farris, Pedro J. Moreno, Manasa Prasad, Bhuvana Ramabhadran, Yun Zhu |
| 2021 | Interspeech | Regularizing Word Segmentation by Creating Misspellings. | Hainan Xu, Kartik Audhkhasi, Yinghui Huang, Jesse Emond, Bhuvana Ramabhadran |
| 2020 | ICASSP | Language-Agnostic Multilingual Modeling. | Arindrima Datta, Bhuvana Ramabhadran, Jesse Emond, Anjuli Kannan, Brian Roark |
| 2020 | ICASSP | Generating Diverse and Natural Text-to-Speech Samples Using a Quantized Fine-Grained VAE and Autoregressive Prosody Prior. | Guangzhi Sun, Yu Zhang, Ron J. Weiss, Yuan Cao, Heiga Zen, Andrew Rosenberg, Bhuvana Ramabhadran, Yonghui Wu |
| 2020 | ICASSP | Neural Oracle Search on N-BEST Hypotheses. | Ehsan Variani, Tongzhou Chen, James Apfel, Bhuvana Ramabhadran, Seungji Lee, Pedro J. Moreno |
| 2020 | ICASSP | Improving Speech Recognition Using Consistent Predictions on Synthesized Speech. | Gary Wang, Andrew Rosenberg, Zhehuai Chen, Yu Zhang, Bhuvana Ramabhadran, Yonghui Wu, Pedro J. Moreno |
| 2020 | Interspeech | Improving Speech Recognition Using GAN-Based Speech Synthesis and Contrastive Unspoken Text Selection. | Zhehuai Chen, Andrew Rosenberg, Yu Zhang, Gary Wang, Bhuvana Ramabhadran, Pedro J. Moreno |
| 2020 | Interspeech | SCADA: Stochastic, Consistent and Adversarial Data Augmentation to Improve ASR. | Gary Wang, Andrew Rosenberg, Zhehuai Chen, Yu Zhang, Bhuvana Ramabhadran, Pedro J. Moreno |
| 2020 | Interspeech | Multilingual Speech Recognition with Self-Attention Structured Parameterization. | Yun Zhu, Parisa Haghani, Anshuman Tripathi, Bhuvana Ramabhadran, Brian Farris, Hainan Xu, Han Lu, Hasim Sak, Isabel Leal, Neeraj Gaur, Pedro J. Moreno, Qian Zhang |
| 2019 | ASRU | Speech Recognition with Augmented Synthesized Speech. | Andrew Rosenberg, Yu Zhang, Bhuvana Ramabhadran, Ye Jia, Pedro J. Moreno, Yonghui Wu, Zelin Wu |
| 2019 | ICASSP | Comparison of Data Augmentation and Adaptation Strategies for Code-switched Automatic Speech Recognition. | Min Ma, Bhuvana Ramabhadran, Jesse Emond, Andrew Rosenberg, Fadi Biadsy |
| 2019 | Interspeech | Large-Scale Multilingual Speech Recognition with a Streaming End-to-End Model. | Anjuli Kannan, Arindrima Datta, Tara N. Sainath, Eugene Weinstein, Bhuvana Ramabhadran, Yonghui Wu, Ankur Bapna, Zhifeng Chen, Seungji Lee |
| 2019 | Interspeech | Learning to Speak Fluently in a Foreign Language: Multilingual Speech Synthesis and Cross-Language Voice Cloning. | Yu Zhang, Ron J. Weiss, Heiga Zen, Yonghui Wu, Zhifeng Chen, R. J. Skerry-Ryan, Ye Jia, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2018 | ICASSP | Building Competitive Direct Acoustics-to-Word Models for English Conversational Speech Recognition. | Kartik Audhkhasi, Brian Kingsbury, Bhuvana Ramabhadran, George Saon, Michael Picheny |
| 2018 | ICASSP | Whole Sentence Neural Language Models. | Yinghui Huang, Abhinav Sethy, Kartik Audhkhasi, Bhuvana Ramabhadran |
| 2018 | ICASSP | Measuring the Effect of Linguistic Resources on Prosody Modeling for Speech Synthesis. | Andrew Rosenberg, Raul Fernandez, Bhuvana Ramabhadran |
| 2018 | ICASSP | Joint Modeling of Accents and Acoustics for Multi-Accent Speech Recognition. | Xuesong Yang, Kartik Audhkhasi, Andrew Rosenberg, Samuel Thomas, Bhuvana Ramabhadran, Mark Hasegawa-Johnson |
| 2018 | Interspeech | Data Augmentation Improves Recognition of Foreign Accented Speech. | Takashi Fukuda, Raul Fernandez, Andrew Rosenberg, Samuel Thomas, Bhuvana Ramabhadran, Alexander Sorin, Gakuto Kurata |
| 2018 | Interspeech | Open Problems in Speech Recognition. | Bhuvana Ramabhadran |
| 2017 | ASRU | Language modeling with highway LSTM. | Gakuto Kurata, Bhuvana Ramabhadran, George Saon, Abhinav Sethy |
| 2017 | ICASSP | End-to-end ASR-free keyword search from speech. | Kartik Audhkhasi, Andrew Rosenberg, Abhinav Sethy, Bhuvana Ramabhadran, Brian Kingsbury |
| 2017 | ICASSP | Training variance and performance evaluation of neural networks in speech. | Ewout van den Berg, Bhuvana Ramabhadran, Michael Picheny |
| 2017 | ICASSP | Knowledge distillation across ensembles of multilingual models for low-resource languages. | Jia Cui, Brian Kingsbury, Bhuvana Ramabhadran, George Saon, Tom Sercu, Kartik Audhkhasi, Abhinav Sethy, Markus Nubaum-Thom, Andrew Rosenberg |
| 2017 | ICASSP | Voice-transformation-based data augmentation for prosodic classification. | Raul Fernandez, Andrew Rosenberg, Alexander Sorin, Bhuvana Ramabhadran, Ron Hoory |
| 2017 | ICASSP | Effective joint training of denoising feature space transforms and Neural Network based acoustic models. | Takashi Fukuda, Osamu Ichikawa, Gakuto Kurata, Ryuki Tachibana, Samuel Thomas, Bhuvana Ramabhadran |
| 2017 | ICASSP | Harmonic feature fusion for robust neural network-based acoustic modeling. | Osamu Ichikawa, Takashi Fukuda, Masayuki Suzuki, Gakuto Kurata, Bhuvana Ramabhadran |
| 2017 | ICASSP | End-to-end speech recognition and keyword search on low-resource languages. | Andrew Rosenberg, Kartik Audhkhasi, Abhinav Sethy, Bhuvana Ramabhadran, Michael Picheny |
| 2017 | ICASSP | Network architectures for multilingual speech representation learning. | Tom Sercu, George Saon, Jia Cui, Xiaodong Cui, Bhuvana Ramabhadran, Brian Kingsbury, Abhinav Sethy |
| 2017 | Interspeech | Direct Acoustics-to-Word Models for English Conversational Speech Recognition. | Kartik Audhkhasi, Bhuvana Ramabhadran, George Saon, Michael Picheny, David Nahamoo |
| 2017 | Interspeech | Efficient Knowledge Distillation from an Ensemble of Teachers. | Takashi Fukuda, Masayuki Suzuki, Gakuto Kurata, Samuel Thomas, Jia Cui, Bhuvana Ramabhadran |
| 2017 | Interspeech | Fast Neural Network Language Model Lookups at N-Gram Speeds. | Yinghui Huang, Abhinav Sethy, Bhuvana Ramabhadran |
| 2017 | Interspeech | Empirical Exploration of Novel Architectures and Objectives for Language Models. | Gakuto Kurata, Abhinav Sethy, Bhuvana Ramabhadran, George Saon |
| 2017 | Interspeech | Weakly-Supervised Phrase Assignment from Text in a Speech-Synthesis System Using Noisy Labels. | Asaf Rendel, Raul Fernandez, Zvi Kons, Andrew Rosenberg, Ron Hoory, Bhuvana Ramabhadran |
| 2017 | Interspeech | Bias and Statistical Significance in Evaluating Speech Synthesis with Mean Opinion Scores. | Andrew Rosenberg, Bhuvana Ramabhadran |
| 2017 | Interspeech | English Conversational Telephone Speech Recognition by Humans and Machines. | George Saon, Gakuto Kurata, Tom Sercu, Kartik Audhkhasi, Samuel Thomas, Dimitrios Dimitriadis, Xiaodong Cui, Bhuvana Ramabhadran, Michael Picheny, Lynn-Li Lim, Bergul Roomi, Phil Hall |
| 2017 | Interspeech | Symbol Sequence Search from Telephone Conversation. | Masayuki Suzuki, Gakuto Kurata, Abhinav Sethy, Bhuvana Ramabhadran, Kenneth Ward Church, Mark Drake |
| 2016 | ICASSP | Semantic word embedding neural network language models for automatic speech recognition. | Kartik Audhkhasi, Abhinav Sethy, Bhuvana Ramabhadran |
| 2016 | ICASSP | Efficient one-vs-one kernel ridge regression for speech recognition. | Jie Chen, Lingfei Wu, Kartik Audhkhasi, Brian Kingsbury, Bhuvana Ramabhadran |
| 2016 | ICASSP | Using continuous lexical embeddings to improve symbolic-prosody prediction in a text-to-speech front-end. | Asaf Rendel, Raul Fernandez, Ron Hoory, Bhuvana Ramabhadran |
| 2016 | Interspeech | Acoustic Modeling Using Bidirectional Gated Recurrent Convolutional Units. | Markus Nubaum-Thom, Jia Cui, Bhuvana Ramabhadran, Vaibhava Goel |
| 2016 | Interspeech | Domain Adaptation of CNN Based Acoustic Models Under Limited Resource Settings. | Masayuki Suzuki, Ryuki Tachibana, Samuel Thomas, Bhuvana Ramabhadran, George Saon |
| 2016 | Interspeech | Multilingual Data Selection for Low Resource Speech Recognition. | Samuel Thomas, Kartik Audhkhasi, Jia Cui, Brian Kingsbury, Bhuvana Ramabhadran |
| 2015 | ASRU | Multilingual representations for low resource speech recognition and keyword search. | Jia Cui, Brian Kingsbury, Bhuvana Ramabhadran, Abhinav Sethy, Kartik Audhkhasi, Xiaodong Cui, Ellen Kislal, Lidia Mangu, Markus Nubaum-Thom, Michael Picheny, Zoltn Tske, Pavel Golik, Ralf Schlter, Hermann Ney, Mark J. F. Gales, Kate M. Knill, Anton Ragni, Haipeng Wang, Philip C. Woodland |
| 2015 | ICASSP | Bidirectional recurrent neural network language models for automatic speech recognition. | Ebru Arisoy, Abhinav Sethy, Bhuvana Ramabhadran, Stanley F. Chen |
| 2015 | ICASSP | Unnormalized exponential and neural network language models. | Abhinav Sethy, Stanley F. Chen, Ebru Arisoy, Bhuvana Ramabhadran |
| 2015 | Interspeech | Efficient GPU implementation of convolutional neural networks for speech recognition. | Ewout van den Berg, Daniel Brand, Rajesh Bordawekar, Leonid Rachevsky, Bhuvana Ramabhadran |
| 2015 | Interspeech | A multi-region deep neural network model in speech recognition. | Jia Cui, George Saon, Bhuvana Ramabhadran, Brian Kingsbury |
| 2015 | Interspeech | Using deep bidirectional recurrent neural networks for prosodic-target prediction in a unit-selection text-to-speech system. | Raul Fernandez, Asaf Rendel, Bhuvana Ramabhadran, Ron Hoory |
| 2015 | Interspeech | Modeling phrasing and prominence using deep recurrent learning. | Andrew Rosenberg, Raul Fernandez, Bhuvana Ramabhadran |
| 2014 | ICASSP | Semi-supervised term-weighted value rescoring for keyword search. | Kartik Audhkhasi, Abhinav Sethy, Bhuvana Ramabhadran, Shrikanth S. Narayanan |
| 2014 | ICASSP | Automatic keyword selection for keyword search development and tuning. | Jia Cui, Jonathan Mamou, Brian Kingsbury, Bhuvana Ramabhadran |
| 2014 | ICASSP | Kernel methods match Deep Neural Networks on TIMIT. | Po-Sen Huang, Haim Avron, Tara N. Sainath, Vikas Sindhwani, Bhuvana Ramabhadran |
| 2014 | ICASSP | Deep Scattering Spectrum with deep neural networks. | Vijayaditya Peddinti, Tara N. Sainath, Shay Maymon, Bhuvana Ramabhadran, David Nahamoo, Vaibhava Goel |
| 2014 | ICASSP | Improvements to filterbank and delta learning within a deep neural network framework. | Tara N. Sainath, Brian Kingsbury, Abdel-rahman Mohamed, George Saon, Bhuvana Ramabhadran |
| 2014 | ICASSP | Static interpolation of exponential n-gram models using features of features. | Abhinav Sethy, Stanley F. Chen, Bhuvana Ramabhadran, Paul Vozila |
| 2014 | Interspeech | Dictionary-based pitch tracking with dynamic programming. | Ewout van den Berg, Bhuvana Ramabhadran |
| 2014 | Interspeech | Improving deep neural network acoustic modeling for audio corpus indexing under the IARPA babel program. | Xiaodong Cui, Brian Kingsbury, Jia Cui, Bhuvana Ramabhadran, Andrew Rosenberg, Mohammad Sadegh Rasooli, Owen Rambow, Nizar Habash, Vaibhava Goel |
| 2014 | Interspeech | Recent improvements in neural network acoustic modeling for LVCSR in low resource languages. | Jia Cui, Bhuvana Ramabhadran, Xiaodong Cui, Andrew Rosenberg, Brian Kingsbury, Abhinav Sethy |
| 2014 | Interspeech | Exploiting vocal-source features to improve ASR accuracy for low-resource languages. | Raul Fernandez, Jia Cui, Andrew Rosenberg, Bhuvana Ramabhadran, Xiaodong Cui |
| 2014 | Interspeech | Prosody contour prediction with long short-term memory, bi-directional, deep recurrent neural networks. | Raul Fernandez, Asaf Rendel, Bhuvana Ramabhadran, Ron Hoory |
| 2014 | Interspeech | Parallel deep neural network training for LVCSR tasks using blue gene/Q. | Tara N. Sainath, I-Hsin Chung, Bhuvana Ramabhadran, Michael Picheny, John A. Gunnels, Brian Kingsbury, George Saon, Vernon Austel, Upendra V. Chaudhari |
| 2014 | Interspeech | Deep scattering spectra with deep neural networks for LVCSR tasks. | Tara N. Sainath, Vijayaditya Peddinti, Brian Kingsbury, Petr Fousek, Bhuvana Ramabhadran, David Nahamoo |
| 2014 | SC | Parallel Deep Neural Network Training for Big Data on Blue Gene/Q. | I-Hsin Chung, Tara N. Sainath, Bhuvana Ramabhadran, Michael Picheny, John A. Gunnels, Vernon Austel, Upendra V. Chaudhari, Brian Kingsbury |
| 2013 | ASRU | Accelerating Hessian-free optimization for Deep Neural Networks by implicit preconditioning and sampling. | Tara N. Sainath, Lior Horesh, Brian Kingsbury, Aleksandr Y. Aravkin, Bhuvana Ramabhadran |
| 2013 | ASRU | Improvements to Deep Convolutional Neural Networks for LVCSR. | Tara N. Sainath, Brian Kingsbury, Abdel-rahman Mohamed, George E. Dahl, George Saon, Hagen Soltau, Toms Beran, Aleksandr Y. Aravkin, Bhuvana Ramabhadran |
| 2013 | ASRU | Learning filter banks within a deep neural network framework. | Tara N. Sainath, Brian Kingsbury, Abdel-rahman Mohamed, Bhuvana Ramabhadran |
| 2013 | ASRU | An empirical study of confusion modeling in keyword search for low resource languages. | Murat Saraclar, Abhinav Sethy, Bhuvana Ramabhadran, Lidia Mangu, Jia Cui, Xiaodong Cui, Brian Kingsbury, Jonathan Mamou |
| 2013 | ASRU | Joint training of interpolated exponential n-gram models. | Abhinav Sethy, Stanley F. Chen, Ebru Arisoy, Bhuvana Ramabhadran, Kartik Audhkhasi, Shrikanth S. Narayanan, Paul Vozila |
| 2013 | ICASSP | Converting Neural Network Language Models into back-off language models for efficient decoding in automatic speech recognition. | Ebru Arisoy, Stanley F. Chen, Bhuvana Ramabhadran, Abhinav Sethy |
| 2013 | ICASSP | Developing speech recognition systems for corpus indexing under the IARPA Babel program. | Jia Cui, Xiaodong Cui, Bhuvana Ramabhadran, Janice Kim, Brian Kingsbury, Jonathan Mamou, Lidia Mangu, Michael Picheny, Tara N. Sainath, Abhinav Sethy |
| 2013 | ICASSP | F0 contour prediction with a deep belief network-Gaussian process hybrid model. | Raul Fernandez, Asaf Rendel, Bhuvana Ramabhadran, Ron Hoory |
| 2013 | ICASSP | A high-performance Cantonese keyword search system. | Brian Kingsbury, Jia Cui, Xiaodong Cui, Mark J. F. Gales, Kate M. Knill, Jonathan Mamou, Lidia Mangu, David Nolden, Michael Picheny, Bhuvana Ramabhadran, Ralf Schlter, Abhinav Sethy, Philip C. Woodland |
| 2013 | ICASSP | System combination and score normalization for spoken term detection. | Jonathan Mamou, Jia Cui, Xiaodong Cui, Mark J. F. Gales, Brian Kingsbury, Kate M. Knill, Lidia Mangu, David Nolden, Michael Picheny, Bhuvana Ramabhadran, Ralf Schlter, Abhinav Sethy, Philip C. Woodland |
| 2013 | ICASSP | An evaluation of posterior modeling techniques for phonetic recognition. | Rohit Prabhavalkar, Tara N. Sainath, David Nahamoo, Bhuvana Ramabhadran, Dimitri Kanevsky |
| 2013 | ICASSP | Low-rank matrix factorization for Deep Neural Network training with high-dimensional output targets. | Tara N. Sainath, Brian Kingsbury, Vikas Sindhwani, Ebru Arisoy, Bhuvana Ramabhadran |
| 2013 | ICASSP | Deep convolutional neural networks for LVCSR. | Tara N. Sainath, Abdel-rahman Mohamed, Brian Kingsbury, Bhuvana Ramabhadran |
| 2012 | ICASSP | Creating ensemble of diverse maximum entropy models. | Kartik Audhkhasi, Abhinav Sethy, Bhuvana Ramabhadran, Shrikanth S. Narayanan |
| 2012 | ICASSP | Prediction of F0 contours from symbolic and numerical variables using continuous conditional random fields. | Raul Fernandez, Steve Minnis, Bhuvana Ramabhadran |
| 2012 | ICASSP | Constructing ensembles of dissimilar acoustic models using hidden attributes of training data. | Takashi Fukuda, Ryuki Tachibana, Upendra V. Chaudhari, Bhuvana Ramabhadran, Puming Zhan |
| 2012 | ICASSP | N-best entropy based data selection for acoustic modeling. | Nobuyasu Itoh, Tara N. Sainath, Dan-Ning Jiang, Jie Zhou, Bhuvana Ramabhadran |
| 2012 | ICASSP | Improved pre-training of Deep Belief Networks using Sparse Encoding Symmetric Machines. | Christian Plahl, Tara N. Sainath, Bhuvana Ramabhadran, David Nahamoo |
| 2012 | ICASSP | Auto-encoder bottleneck features using deep belief networks. | Tara N. Sainath, Brian Kingsbury, Bhuvana Ramabhadran |
| 2012 | Interspeech | Phrase Boundary Assignment from Text in Multiple Domains. | Andrew Rosenberg, Raul Fernandez, Bhuvana Ramabhadran |
| 2012 | Interspeech | Enhancing Exemplar-Based Posteriors for Speech Recognition Tasks. | Tara N. Sainath, David Nahamoo, Dimitri Kanevsky, Bhuvana Ramabhadran |
| 2012 | NAACL | Deep Neural Network Language Models. | Ebru Arisoy, Tara N. Sainath, Brian Kingsbury, Bhuvana Ramabhadran |
| 2011 | ASRU | Pruning exponential language models. | Stanley F. Chen, Abhinav Sethy, Bhuvana Ramabhadran |
| 2011 | ASRU | Making Deep Belief Networks effective for large vocabulary continuous speech recognition. | Tara N. Sainath, Brian Kingsbury, Bhuvana Ramabhadran, Petr Fousek, Petr Novk, Abdel-rahman Mohamed |
| 2011 | ASRU | A convex hull approach to sparse representations for exemplar-based speech recognition. | Tara N. Sainath, David Nahamoo, Dimitri Kanevsky, Bhuvana Ramabhadran, Parikshit M. Shah |
| 2011 | ASRU | Frame-level AnyBoost for LVCSR with the MMI Criterion. | Ryuki Tachibana, Takashi Fukuda, Upendra V. Chaudhari, Bhuvana Ramabhadran, Puming Zhan |
| 2011 | ICASSP | Exploiting active-learning strategies for annotating prosodic events with limited labeled data. | Raul Fernandez, Bhuvana Ramabhadran |
| 2011 | ICASSP | A-Functions: A generalization of Extended Baum-Welch transformations to convex optimization. | Dimitri Kanevsky, David Nahamoo, Tara N. Sainath, Bhuvana Ramabhadran, Peder A. Olsen |
| 2011 | ICASSP | Named entity recognition from Conversational Telephone Speech leveraging Word Confusion Networks for training and recognition. | Gakuto Kurata, Nobuyasu Itoh, Masafumi Nishimura, Abhinav Sethy, Bhuvana Ramabhadran |
| 2011 | ICASSP | Deep Belief Networks using discriminative features for phone recognition. | Abdel-rahman Mohamed, Tara N. Sainath, George E. Dahl, Bhuvana Ramabhadran, Geoffrey E. Hinton, Michael A. Picheny |
| 2011 | ICASSP | Hill climbing on speech lattices: A new rescoring framework. | Ariya Rastrow, Markus Dreyer, Abhinav Sethy, Sanjeev Khudanpur, Bhuvana Ramabhadran, Mark Dredze |
| 2011 | ICASSP | Exemplar-based Sparse Representation phone identification features. | Tara N. Sainath, David Nahamoo, Bhuvana Ramabhadran, Dimitri Kanevsky, Vaibhava Goel, Parikshit M. Shah |
| 2011 | ICASSP | Deep belief nets for natural language call-routing. | Ruhi Sarikaya, Geoffrey E. Hinton, Bhuvana Ramabhadran |
| 2011 | ICASSP | Distributed training of large scale exponential language models. | Abhinav Sethy, Stanley F. Chen, Bhuvana Ramabhadran |
| 2011 | ICASSP | Speech processing and retrieval in a personal memory aid system for the elderly. | Alexander Sorin, Hagai Aronowitz, Jonathan Mamou, Orith Toledo-Ronen, Ron Hoory, Michael Kuritzky, Yael Erez, Bhuvana Ramabhadran, Abhinav Sethy |
| 2011 | ICASSP | Application specific loss minimization using gradient boosting. | Bin Zhang, Abhinav Sethy, Tara N. Sainath, Bhuvana Ramabhadran |
| 2011 | Interspeech | Feature Combination Approaches for Discriminative Language Models. | Ebru Arisoy, Bhuvana Ramabhadran, Hong-Kwang Jeff Kuo |
| 2011 | Interspeech | Convergence of Line Search A-Function Methods. | Dimitri Kanevsky, David Nahamoo, Tara N. Sainath, Bhuvana Ramabhadran |
| 2011 | Interspeech | Improved Spoken Query Transcription Using Co-Occurrence Information. | Jonathan Mamou, Abhinav Sethy, Bhuvana Ramabhadran, Ron Hoory, Paul Vozila |
| 2011 | Interspeech | Clustering with Modified Cosine Distance Learned from Constraints. | Leonid Rachevsky, Dimitri Kanevsky, Ruhi Sarikaya, Bhuvana Ramabhadran |
| 2011 | Interspeech | "What is... Dengue Fever?" - Modeling and Predicting Pronunciation Errors in a Text-to-Speech System. | Andrew Rosenberg, Raul Fernandez, Bhuvana Ramabhadran |
| 2011 | Interspeech | Reducing Computational Complexities of Exemplar-Based Sparse Representations with Applications to Large Vocabulary Speech Recognition. | Tara N. Sainath, Bhuvana Ramabhadran, David Nahamoo, Dimitri Kanevsky |
| 2011 | Interspeech | Shrinkage-Based Features for Natural Language Call Routing. | Ruhi Sarikaya, Stanley F. Chen, Bhuvana Ramabhadran |
| 2010 | FUSION | Kalman filtering for compressed sensing. | Dimitri Kanevsky, Avishy Carmi, Lior Horesh, Pini Gurfil, Bhuvana Ramabhadran, Tara N. Sainath |
| 2010 | ICASSP | The Use of isometric transformations and bayesian estimation in compressive sensing for fMRI classification. | Avishy Carmi, Tara N. Sainath, Pini Gurfil, Dimitri Kanevsky, David Nahamoo, Bhuvana Ramabhadran |
| 2010 | ICASSP | Improved language modeling for conversational applications using sentence quality. | Mark E. Epstein, Bhuvana Ramabhadran, Rajesh Balchandran |
| 2010 | ICASSP | Balancing false alarms and hits in Spoken Term Detection. | Carolina Parada, Abhinav Sethy, Bhuvana Ramabhadran |
| 2010 | ICASSP | Bayesian compressive sensing for phonetic classification. | Tara N. Sainath, Avishy Carmi, Dimitri Kanevsky, Bhuvana Ramabhadran |
| 2010 | ICASSP | Continuous space language modeling techniques. | Ruhi Sarikaya, Ahmad Emami, Mohamed Afify, Bhuvana Ramabhadran |
| 2010 | ICASSP | An autoencoder neural-network based low-dimensionality approach to excitation modeling for HMM-based text-to-speech. | Srikanth Vishnubhotla, Raul Fernandez, Bhuvana Ramabhadran |
| 2010 | Interspeech | Techniques for topic detection based processing in spoken dialog systems. | Rajesh Balchandran, Leonid Rachevsky, Bhuvana Ramabhadran, Miroslav Novak |
| 2010 | Interspeech | Discriminative training and unsupervised adaptation for labeling prosodic events with limited training data. | Raul Fernandez, Bhuvana Ramabhadran |
| 2010 | Interspeech | Incorporating sparse representation phone identification features in automatic speech recognition using exponential families. | Vaibhava Goel, Tara N. Sainath, Bhuvana Ramabhadran, Peder A. Olsen, David Nahamoo, Dimitri Kanevsky |
| 2010 | Interspeech | An analysis of sparseness and regularization in exemplar-based methods for speech classification. | Dimitri Kanevsky, Tara N. Sainath, Bhuvana Ramabhadran, David Nahamoo |
| 2010 | Interspeech | Sparse representations for text categorization. | Tara N. Sainath, Sameer Maskey, Dimitri Kanevsky, Bhuvana Ramabhadran, David Nahamoo, Julia Hirschberg |
| 2010 | Interspeech | Sparse representation features for speech recognition. | Tara N. Sainath, Bhuvana Ramabhadran, David Nahamoo, Dimitri Kanevsky, Abhinav Sethy |
| 2010 | Interspeech | Impact of word classing on shrinkage-based language models. | Ruhi Sarikaya, Stanley F. Chen, Abhinav Sethy, Bhuvana Ramabhadran |
| 2010 | Interspeech | Data selection for language modeling using sparse representations. | Abhinav Sethy, Tara N. Sainath, Bhuvana Ramabhadran, Dimitri Kanevsky |
| 2010 | NAACL | Unsupervised Model Adaptation using Information-Theoretic Criterion. | Ariya Rastrow, Frederick Jelinek, Abhinav Sethy, Bhuvana Ramabhadran |
| 2009 | ASRU | Scaling shrinkage-based language models. | Stanley F. Chen, Lidia Mangu, Bhuvana Ramabhadran, Ruhi Sarikaya, Abhinav Sethy |
| 2009 | ASRU | Query-by-example Spoken Term Detection For OOV terms. | Carolina Parada, Abhinav Sethy, Bhuvana Ramabhadran |
| 2009 | ASRU | Constrained discriminative training of N-gram language models. | Ariya Rastrow, Abhinav Sethy, Bhuvana Ramabhadran |
| 2009 | ASRU | An exploration of large vocabulary tools for small vocabulary phonetic recognition. | Tara N. Sainath, Bhuvana Ramabhadran, Michael Picheny |
| 2009 | ICASSP | Map approach to learning sparse Gaussian Markov networks. | Narges Bani Asadi, Irina Rish, Katya Scheinberg, Dimitri Kanevsky, Bhuvana Ramabhadran |
| 2009 | ICASSP | Effect of pronounciations on OOV queries in spoken term detection. | Dogan Can, Erica Cooper, Abhinav Sethy, Christopher M. White, Bhuvana Ramabhadran, Murat Saraclar |
| 2009 | ICASSP | A generalized family of parameter estimation techniques. | Dimitri Kanevsky, Tara N. Sainath, Bhuvana Ramabhadran |
| 2009 | ICASSP | A new method for OOV detection using hybrid word/fragment system. | Ariya Rastrow, Abhinav Sethy, Bhuvana Ramabhadran |
| 2009 | ICASSP | Unsupervised pronunciation validation. | Christopher M. White, Abhinav Sethy, Bhuvana Ramabhadran, Patrick J. Wolfe, Erica Cooper, Murat Saraclar, James K. Baker |
| 2009 | Interspeech | Towards using hybrid word and fragment units for vocabulary independent LVCSR systems. | Ariya Rastrow, Abhinav Sethy, Bhuvana Ramabhadran, Frederick Jelinek |
| 2009 | Interspeech | Iterative sentence-pair extraction from quasi-parallel corpora for machine translation. | Ruhi Sarikaya, Sameer Maskey, R. Zhang, Ea-Ee Jan, D. Wang, Bhuvana Ramabhadran, Salim Roukos |
| 2009 | IWANN | Multimodal Classification of Activities of Daily Living Inside Smart Homes. | Vit Libal, Bhuvana Ramabhadran, Nadia Mana, Fabio Pianesi, Paul Chippendale, Oswald Lanz, Gerasimos Potamianos |
| 2009 | NAACL | Fast decoding for open vocabulary spoken term detection. | Bhuvana Ramabhadran, Abhinav Sethy, Jonathan Mamou, Brian Kingsbury, Upendra V. Chaudhari |
| 2009 | SIGIR | Web derived pronunciations for spoken term detection. | Dogan Can, Erica Cooper, Arnab Ghoshal, Martin Jansche, Sanjeev Khudanpur, Bhuvana Ramabhadran, Michael Riley, Murat Saraclar, Abhinav Sethy, Morgan Ulinski, Christopher M. White |
| 2008 | ICASSP | Boosted MMI for model and feature-space discriminative training. | Daniel Povey, Dimitri Kanevsky, Brian Kingsbury, Bhuvana Ramabhadran, George Saon, Karthik Visweswariah |
| 2008 | ICASSP | Gradient steepness metrics using extended Baum-Welch transformations for universal pattern recognition tasks. | Tara N. Sainath, Dimitri Kanevsky, Bhuvana Ramabhadran |
| 2008 | Interspeech | A study of unsupervised clustering techniques for language modeling. | Sangyun Hahn, Abhinav Sethy, Hong-Kwang Jeff Kuo, Bhuvana Ramabhadran |
| 2008 | Interspeech | Generalization of extended baum-welch parameter estimation for discriminative training and decoding. | Dimitri Kanevsky, Tara N. Sainath, Bhuvana Ramabhadran, David Nahamoo |
| 2008 | Interspeech | Phonetic query expansion for spoken document retrieval. | Jonathan Mamou, Bhuvana Ramabhadran |
| 2008 | Interspeech | Bag-of-word normalized n-gram models. | Abhinav Sethy, Bhuvana Ramabhadran |
| 2007 | ASRU | Fast audio search using vector space modelling. | Brett Matthews, Upendra V. Chaudhari, Bhuvana Ramabhadran |
| 2007 | ASRU | The IBM 2007 speech transcription system for European parliamentary speeches. | Bhuvana Ramabhadran, Olivier Siohan, Abhinav Sethy |
| 2007 | ASRU | Broad phonetic class recognition in a Hidden Markov model framework using extended Baum-Welch transformations. | Tara N. Sainath, Dimitri Kanevsky, Bhuvana Ramabhadran |
| 2007 | ICASSP | Data Driven Approach for Language Model Adaptation using Stepwise Relative Entropy Minimization. | Abhinav Sethy, Shrikanth S. Narayanan, Bhuvana Ramabhadran |
| 2007 | SIGIR | Vocabulary independent spoken term detection. | Jonathan Mamou, Bhuvana Ramabhadran, Olivier Siohan |
| 2006 | ICASSP | Automated Quality Monitoring in the Call Center with ASR and Maximum Entropy. | Geoffrey Zweig, Olivier Siohan, George Saon, Bhuvana Ramabhadran, Daniel Povey, Lidia Mangu, Brian Kingsbury |
| 2006 | Interspeech | The IBM 2006 speech transcription system for european parliamentary speeches. | Bhuvana Ramabhadran, Olivier Siohan, Lidia Mangu, Geoffrey Zweig, Martin Westphal, Henrik Schulz, Alvaro Soneiro |
| 2006 | NAACL | Automated Quality Monitoring for Call Centers using Speech and NLP Technologies. | Geoffrey Zweig, Olivier Siohan, George Saon, Bhuvana Ramabhadran, Daniel Povey, Lidia Mangu, Brian Kingsbury |
| 2005 | ICASSP | Contructing Ensembles of ASR Systems Using Randomized Decision Trees. | Olivier Siohan, Bhuvana Ramabhadran, Brian Kingsbury |
| 2005 | Interspeech | Exploiting large quantities of spontaneous speech for unsupervised training of acoustic models. | Bhuvana Ramabhadran |
| 2004 | Interspeech | Use of metadata to improve recognition of spontaneous speech and named entities. | Bhuvana Ramabhadran, Olivier Siohan, Geoffrey Zweig |
| 2004 | Interspeech | Measuring convergence in language model estimation using relative entropy. | Abhinav Sethy, Shrikanth S. Narayanan, Bhuvana Ramabhadran |
| 2004 | Interspeech | Speech recognition error analysis on the English MALACH corpus. | Olivier Siohan, Bhuvana Ramabhadran, Geoffrey Zweig |
| 2004 | SIGIR | Building an information retrieval test collection for spontaneous conversational speech. | Douglas W. Oard, Dagobert Soergel, David S. Doermann, Xiaoli Huang, G. Craig Murray, Jianqiang Wang, Bhuvana Ramabhadran, Martin Franz, Samuel Gustman, James Mayfield, Liliya Kharevych, Stephanie M. Strassel |
| 2003 | ICASSP | Towards automatic transcription of large spoken archives - English ASR for the MALACH project. | Bhuvana Ramabhadran, Jing Huang, Michael Picheny |
| 2003 | Interspeech | Automated transcription and topic segmentation of large spoken archives. | Martin Franz, Bhuvana Ramabhadran, Todd Ward, Michael Picheny |
| 2003 | Interspeech | Impact of audio segmentation and segment clustering on automated transcription accuracy of large spoken archives. | Bhuvana Ramabhadran, Jing Huang, Upendra V. Chaudhari, Giridharan Iyengar, Harriet J. Nock |
| 2001 | ICASSP | Speech recognition for DARPA Communicator. | Andrew Aaron, Scott Saobing Chen, Paul S. Cohen, Satya Dharanipragada, Ellen Eide, Martin Franz, Jean-Michel LeRoux, X. Luo, Benot Maison, Lidia Mangu, T. Mathes, Miroslav Novak, Peder A. Olsen, Michael Picheny, Harry Printz, Bhuvana Ramabhadran, Andrej Sakrajda, George Saon, Borivoj Tydlitt, Karthik Visweswariah, D. Yuk |
| 2001 | ICASSP | Innovative approaches for large vocabulary name recognition. | Yuqing Gao, Bhuvana Ramabhadran, C. Julian Chen, Hakan Erdogan, Michael Picheny |
| 2000 | Interspeech | Decision tree based rate of speech modeling for speech recognition. | Bhuvana Ramabhadran, Yuqing Gao |
| 2000 | Interspeech | Dynamic selection of feature spaces for robust speech recognition. | Bhuvana Ramabhadran, Yuqing Gao, Michael Picheny |
| 1999 | Interspeech | Acoustics-based baseform generation with pronunciation and/or phonotactic models. | Bhuvana Ramabhadran, Sabine Deligne, Abraham Ittycheriah |
| 1999 | Interspeech | Enhanced likelihood computation using regression. | Peter V. de Souza, Bhuvana Ramabhadran, Yuqing Gao, Michael Picheny |
| 1998 | ICASSP | Speech recognition performance on a voicemail transcription task. | Mukund Padmanabhan, Ellen Eide, Bhuvana Ramabhadran, Ganesh N. Ramaswamy, Lalit R. Bahl |
| 1998 | ICASSP | Acoustics-only based automatic phonetic baseform generation. | Bhuvana Ramabhadran, Lalit R. Bahl, Peter DeSouza, Mukund Padmanabhan |
| 1998 | Interspeech | Factor analysis invariant to linear transformations of data. | Ramesh A. Gopinath, Bhuvana Ramabhadran, Satya Dharanipragada |
| 1998 | Interspeech | Speech recognition performance on a new voicemail transcription task. | Mukund Padmanabhan, Bhuvana Ramabhadran, Sankar Basu |
| 1998 | Interspeech | Phonological rules for enhancing acoustic enrollment of unknown words. | Bhuvana Ramabhadran, Abraham Ittycheriah |