Skip to content

Ron J. Weiss

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

44

Venues

6

Active years

2006–2021

Best venue rank

A*

Where they publish

Papers

44 indexed papers, newest first.

YearVenueTitleAuthors
2021ICASSPParallel Tacotron: Non-Autoregressive and Controllable TTS.Isaac Elias, Heiga Zen, Jonathan Shen, Yu Zhang, Ye Jia, Ron J. Weiss, Yonghui Wu
2021ICASSPWave-Tacotron: Spectrogram-Free End-to-End Text-to-Speech Synthesis.Ron J. Weiss, R. J. Skerry-Ryan, Eric Battenberg, Soroosh Mariooryad, Diederik P. Kingma
2021ICLRWaveGrad: Estimating Gradients for Waveform Generation.Nanxin Chen, Yu Zhang, Heiga Zen, Ron J. Weiss, Mohammad Norouzi, William Chan
2021InterspeechWaveGrad 2: Iterative Refinement for Text-to-Speech Synthesis.Nanxin Chen, Yu Zhang, Heiga Zen, Ron J. Weiss, Mohammad Norouzi, Najim Dehak, William Chan
2021InterspeechMultitask Training with Text Data for End-to-End Speech Recognition.Peidong Wang, Tara N. Sainath, Ron J. Weiss
2020ICASSPAn Attention-Based Joint Acoustic and Text on-Device End-To-End Model.Tara N. Sainath, Ruoming Pang, Ron J. Weiss, Yanzhang He, Chung-Cheng Chiu, Trevor Strohman
2020ICASSPGenerating Diverse and Natural Text-to-Speech Samples Using a Quantized Fine-Grained VAE and Autoregressive Prosody Prior.Guangzhi Sun, Yu Zhang, Ron J. Weiss, Yuan Cao, Heiga Zen, Andrew Rosenberg, Bhuvana Ramabhadran, Yonghui Wu
2020ICASSPFully-Hierarchical Fine-Grained Prosody Modeling For Interpretable Speech Synthesis.Guangzhi Sun, Yu Zhang, Ron J. Weiss, Yuan Cao, Heiga Zen, Yonghui Wu
2019ICASSPAudio Texture Synthesis with Random Neural Networks: Improving Diversity and Quality.Joseph M. Antognini, Matt Hoffman, Ron J. Weiss
2019ICASSPA Spelling Correction Model for End-to-end Speech Recognition.Jinxi Guo, Tara N. Sainath, Ron J. Weiss
2019ICASSPDisentangling Correlated Speaker and Noise for Speech Synthesis via Data Augmentation and Adversarial Factorization.Wei-Ning Hsu, Yu Zhang, Ron J. Weiss, Yu-An Chung, Yuxuan Wang, Yonghui Wu, James R. Glass
2019ICASSPLeveraging Weakly Supervised Data to Improve End-to-end Speech-to-text Translation.Ye Jia, Melvin Johnson, Wolfgang Macherey, Ron J. Weiss, Yuan Cao, Chung-Cheng Chiu, Naveen Ari, Stella Laurenzo, Yonghui Wu
2019ICLRHierarchical Generative Modeling for Controllable Speech Synthesis.Wei-Ning Hsu, Yu Zhang, Ron J. Weiss, Heiga Zen, Yonghui Wu, Yuxuan Wang, Yuan Cao, Ye Jia, Zhifeng Chen, Jonathan Shen, Patrick Nguyen, Ruoming Pang
2019InterspeechParrotron: An End-to-End Speech-to-Speech Conversion Model and its Applications to Hearing-Impaired Speech and Speech Separation.Fadi Biadsy, Ron J. Weiss, Pedro J. Moreno, Dimitri Kanvesky, Ye Jia
2019InterspeechDirect Speech-to-Speech Translation with a Sequence-to-Sequence Model.Ye Jia, Ron J. Weiss, Fadi Biadsy, Wolfgang Macherey, Melvin Johnson, Zhifeng Chen, Yonghui Wu
2019InterspeechVoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking.Quan Wang, Hannah Muckenhirn, Kevin W. Wilson, Prashant Sridhar, Zelin Wu, John R. Hershey, Rif A. Saurous, Ron J. Weiss, Ye Jia, Ignacio Lpez-Moreno
2019InterspeechLibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech.Heiga Zen, Viet Dang, Rob Clark, Yu Zhang, Ron J. Weiss, Ye Jia, Zhifeng Chen, Yonghui Wu
2019InterspeechLearning to Speak Fluently in a Foreign Language: Multilingual Speech Synthesis and Cross-Language Voice Cloning.Yu Zhang, Ron J. Weiss, Heiga Zen, Yonghui Wu, Zhifeng Chen, R. J. Skerry-Ryan, Ye Jia, Andrew Rosenberg, Bhuvana Ramabhadran
2018ICASSPState-of-the-Art Speech Recognition with Sequence-to-Sequence Models.Chung-Cheng Chiu, Tara N. Sainath, Yonghui Wu, Rohit Prabhavalkar, Patrick Nguyen, Zhifeng Chen, Anjuli Kannan, Ron J. Weiss, Kanishka Rao, Ekaterina Gonina, Navdeep Jaitly, Bo Li, Jan Chorowski, Michiel Bacchiani
2018ICASSPOn Using Backpropagation for Speech Texture Generation and Voice Conversion.Jan Chorowski, Ron J. Weiss, Rif A. Saurous, Samy Bengio
2018ICASSPNatural TTS Synthesis by Conditioning Wavenet on MEL Spectrogram Predictions.Jonathan Shen, Ruoming Pang, Ron J. Weiss, Mike Schuster, Navdeep Jaitly, Zongheng Yang, Zhifeng Chen, Yu Zhang, Yuxuan Wang, R. J. Skerry-Ryan, Rif A. Saurous, Yannis Agiomyrgiannakis, Yonghui Wu
2018ICASSPMultilingual Speech Recognition with a Single End-to-End Model.Shubham Toshniwal, Tara N. Sainath, Ron J. Weiss, Bo Li, Pedro J. Moreno, Eugene Weinstein, Kanishka Rao
2018ICMLTowards End-to-End Prosody Transfer for Expressive Speech Synthesis with Tacotron.R. J. Skerry-Ryan, Eric Battenberg, Ying Xiao, Yuxuan Wang, Daisy Stanton, Joel Shor, Ron J. Weiss, Rob Clark, Rif A. Saurous
2017ICASSPCNN architectures for large-scale audio classification.Shawn Hershey, Sourish Chaudhuri, Daniel P. W. Ellis, Jort F. Gemmeke, Aren Jansen, R. Channing Moore, Manoj Plakal, Devin Platt, Rif A. Saurous, Bryan Seybold, Malcolm Slaney, Ron J. Weiss, Kevin W. Wilson
2017ICMLOnline and Linear-Time Attention by Enforcing Monotonic Alignments.Colin Raffel, Minh-Thang Luong, Peter J. Liu, Ron J. Weiss, Douglas Eck
2017InterspeechAcoustic Modeling for Google Home.Bo Li, Tara N. Sainath, Arun Narayanan, Joe Caroselli, Michiel Bacchiani, Ananya Misra, Izhak Shafran, Hasim Sak, Golan Pundak, Kean K. Chin, Khe Chai Sim, Ron J. Weiss, Kevin W. Wilson, Ehsan Variani, Chanwoo Kim, Olivier Siohan, Mitchel Weintraub, Erik McDermott, Richard Rose, Matt Shannon
2017InterspeechTacotron: Towards End-to-End Speech Synthesis.Yuxuan Wang, R. J. Skerry-Ryan, Daisy Stanton, Yonghui Wu, Ron J. Weiss, Navdeep Jaitly, Zongheng Yang, Ying Xiao, Zhifeng Chen, Samy Bengio, Quoc V. Le, Yannis Agiomyrgiannakis, Rob Clark, Rif A. Saurous
2017InterspeechSequence-to-Sequence Models Can Directly Translate Foreign Speech.Ron J. Weiss, Jan Chorowski, Navdeep Jaitly, Yonghui Wu, Zhifeng Chen
2016ICASSPFactored spatial and spectral multichannel raw waveform CLDNNs.Tara N. Sainath, Ron J. Weiss, Kevin W. Wilson, Arun Narayanan, Michiel Bacchiani
2016InterspeechNeural Network Adaptive Beamforming for Robust Multichannel Speech Recognition.Bo Li, Tara N. Sainath, Ron J. Weiss, Kevin W. Wilson, Michiel Bacchiani
2016InterspeechReducing the Computational Complexity of Multimicrophone Acoustic Models with Integrated Feature Extraction.Tara N. Sainath, Arun Narayanan, Ron J. Weiss, Ehsan Variani, Kevin W. Wilson, Michiel Bacchiani, Izhak Shafran
2015ASRUSpeaker location and microphone spacing invariant acoustic modeling from raw multichannel waveforms.Tara N. Sainath, Ron J. Weiss, Kevin W. Wilson, Arun Narayanan, Michiel Bacchiani, Andrew W. Senior
2015ICASSPSpeech acoustic modeling from raw multichannel waveforms.Yedid Hoshen, Ron J. Weiss, Kevin W. Wilson
2015InterspeechLearning the speech front-end with raw waveform CLDNNs.Tara N. Sainath, Ron J. Weiss, Andrew W. Senior, Kevin W. Wilson, Oriol Vinyals
2014ICMLAffinity Weighted Embedding.Jason Weston, Ron J. Weiss, Hector Yee
2013RecSysNonlinear latent factorization by embedding multiple user interests.Jason Weston, Ron J. Weiss, Hector Yee
2013RecSysLearning to rank recommendations with the k-order statistic loss.Jason Weston, Hector Yee, Ron J. Weiss
2012ICMLLatent Collaborative Retrieval.Jason Weston, Chong Wang, Ron J. Weiss, Adam Berenzweig
2011ICASSPEvaluating music sequence models through missing data.Thierry Bertin-Mahieux, Graham Grindlay, Ron J. Weiss, Daniel P. W. Ellis
2009ICASSPA variational EM algorithm for learning eigenvoice parameters in mixed signals.Ron J. Weiss, Daniel P. W. Ellis
2008InterspeechDySANA: dynamic speech and noise adaptation for voice activity detection.Ron J. Weiss, Trausti T. Kristjansson
2008InterspeechSource separation based on binaural cues and source model constraints.Ron J. Weiss, Michael I. Mandel, Daniel P. W. Ellis
2006ICASSPModel-Based Monaural Source Separation Using a Vector-Quantized Phase-Vocoder Representation.Daniel P. W. Ellis, Ron J. Weiss
2006InterspeechEstimating single-channel source separation masks: relevance vector machine classifiers vs. pitch-based masking.Ron J. Weiss, Daniel P. W. Ellis