Ron J. Weiss
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
44
Venues
6
Active years
2006–2021
Best venue rank
A*
Where they publish
Papers
44 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2021 | ICASSP | Parallel Tacotron: Non-Autoregressive and Controllable TTS. | Isaac Elias, Heiga Zen, Jonathan Shen, Yu Zhang, Ye Jia, Ron J. Weiss, Yonghui Wu |
| 2021 | ICASSP | Wave-Tacotron: Spectrogram-Free End-to-End Text-to-Speech Synthesis. | Ron J. Weiss, R. J. Skerry-Ryan, Eric Battenberg, Soroosh Mariooryad, Diederik P. Kingma |
| 2021 | ICLR | WaveGrad: Estimating Gradients for Waveform Generation. | Nanxin Chen, Yu Zhang, Heiga Zen, Ron J. Weiss, Mohammad Norouzi, William Chan |
| 2021 | Interspeech | WaveGrad 2: Iterative Refinement for Text-to-Speech Synthesis. | Nanxin Chen, Yu Zhang, Heiga Zen, Ron J. Weiss, Mohammad Norouzi, Najim Dehak, William Chan |
| 2021 | Interspeech | Multitask Training with Text Data for End-to-End Speech Recognition. | Peidong Wang, Tara N. Sainath, Ron J. Weiss |
| 2020 | ICASSP | An Attention-Based Joint Acoustic and Text on-Device End-To-End Model. | Tara N. Sainath, Ruoming Pang, Ron J. Weiss, Yanzhang He, Chung-Cheng Chiu, Trevor Strohman |
| 2020 | ICASSP | Generating Diverse and Natural Text-to-Speech Samples Using a Quantized Fine-Grained VAE and Autoregressive Prosody Prior. | Guangzhi Sun, Yu Zhang, Ron J. Weiss, Yuan Cao, Heiga Zen, Andrew Rosenberg, Bhuvana Ramabhadran, Yonghui Wu |
| 2020 | ICASSP | Fully-Hierarchical Fine-Grained Prosody Modeling For Interpretable Speech Synthesis. | Guangzhi Sun, Yu Zhang, Ron J. Weiss, Yuan Cao, Heiga Zen, Yonghui Wu |
| 2019 | ICASSP | Audio Texture Synthesis with Random Neural Networks: Improving Diversity and Quality. | Joseph M. Antognini, Matt Hoffman, Ron J. Weiss |
| 2019 | ICASSP | A Spelling Correction Model for End-to-end Speech Recognition. | Jinxi Guo, Tara N. Sainath, Ron J. Weiss |
| 2019 | ICASSP | Disentangling Correlated Speaker and Noise for Speech Synthesis via Data Augmentation and Adversarial Factorization. | Wei-Ning Hsu, Yu Zhang, Ron J. Weiss, Yu-An Chung, Yuxuan Wang, Yonghui Wu, James R. Glass |
| 2019 | ICASSP | Leveraging Weakly Supervised Data to Improve End-to-end Speech-to-text Translation. | Ye Jia, Melvin Johnson, Wolfgang Macherey, Ron J. Weiss, Yuan Cao, Chung-Cheng Chiu, Naveen Ari, Stella Laurenzo, Yonghui Wu |
| 2019 | ICLR | Hierarchical Generative Modeling for Controllable Speech Synthesis. | Wei-Ning Hsu, Yu Zhang, Ron J. Weiss, Heiga Zen, Yonghui Wu, Yuxuan Wang, Yuan Cao, Ye Jia, Zhifeng Chen, Jonathan Shen, Patrick Nguyen, Ruoming Pang |
| 2019 | Interspeech | Parrotron: An End-to-End Speech-to-Speech Conversion Model and its Applications to Hearing-Impaired Speech and Speech Separation. | Fadi Biadsy, Ron J. Weiss, Pedro J. Moreno, Dimitri Kanvesky, Ye Jia |
| 2019 | Interspeech | Direct Speech-to-Speech Translation with a Sequence-to-Sequence Model. | Ye Jia, Ron J. Weiss, Fadi Biadsy, Wolfgang Macherey, Melvin Johnson, Zhifeng Chen, Yonghui Wu |
| 2019 | Interspeech | VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking. | Quan Wang, Hannah Muckenhirn, Kevin W. Wilson, Prashant Sridhar, Zelin Wu, John R. Hershey, Rif A. Saurous, Ron J. Weiss, Ye Jia, Ignacio Lpez-Moreno |
| 2019 | Interspeech | LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech. | Heiga Zen, Viet Dang, Rob Clark, Yu Zhang, Ron J. Weiss, Ye Jia, Zhifeng Chen, Yonghui Wu |
| 2019 | Interspeech | Learning to Speak Fluently in a Foreign Language: Multilingual Speech Synthesis and Cross-Language Voice Cloning. | Yu Zhang, Ron J. Weiss, Heiga Zen, Yonghui Wu, Zhifeng Chen, R. J. Skerry-Ryan, Ye Jia, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2018 | ICASSP | State-of-the-Art Speech Recognition with Sequence-to-Sequence Models. | Chung-Cheng Chiu, Tara N. Sainath, Yonghui Wu, Rohit Prabhavalkar, Patrick Nguyen, Zhifeng Chen, Anjuli Kannan, Ron J. Weiss, Kanishka Rao, Ekaterina Gonina, Navdeep Jaitly, Bo Li, Jan Chorowski, Michiel Bacchiani |
| 2018 | ICASSP | On Using Backpropagation for Speech Texture Generation and Voice Conversion. | Jan Chorowski, Ron J. Weiss, Rif A. Saurous, Samy Bengio |
| 2018 | ICASSP | Natural TTS Synthesis by Conditioning Wavenet on MEL Spectrogram Predictions. | Jonathan Shen, Ruoming Pang, Ron J. Weiss, Mike Schuster, Navdeep Jaitly, Zongheng Yang, Zhifeng Chen, Yu Zhang, Yuxuan Wang, R. J. Skerry-Ryan, Rif A. Saurous, Yannis Agiomyrgiannakis, Yonghui Wu |
| 2018 | ICASSP | Multilingual Speech Recognition with a Single End-to-End Model. | Shubham Toshniwal, Tara N. Sainath, Ron J. Weiss, Bo Li, Pedro J. Moreno, Eugene Weinstein, Kanishka Rao |
| 2018 | ICML | Towards End-to-End Prosody Transfer for Expressive Speech Synthesis with Tacotron. | R. J. Skerry-Ryan, Eric Battenberg, Ying Xiao, Yuxuan Wang, Daisy Stanton, Joel Shor, Ron J. Weiss, Rob Clark, Rif A. Saurous |
| 2017 | ICASSP | CNN architectures for large-scale audio classification. | Shawn Hershey, Sourish Chaudhuri, Daniel P. W. Ellis, Jort F. Gemmeke, Aren Jansen, R. Channing Moore, Manoj Plakal, Devin Platt, Rif A. Saurous, Bryan Seybold, Malcolm Slaney, Ron J. Weiss, Kevin W. Wilson |
| 2017 | ICML | Online and Linear-Time Attention by Enforcing Monotonic Alignments. | Colin Raffel, Minh-Thang Luong, Peter J. Liu, Ron J. Weiss, Douglas Eck |
| 2017 | Interspeech | Acoustic Modeling for Google Home. | Bo Li, Tara N. Sainath, Arun Narayanan, Joe Caroselli, Michiel Bacchiani, Ananya Misra, Izhak Shafran, Hasim Sak, Golan Pundak, Kean K. Chin, Khe Chai Sim, Ron J. Weiss, Kevin W. Wilson, Ehsan Variani, Chanwoo Kim, Olivier Siohan, Mitchel Weintraub, Erik McDermott, Richard Rose, Matt Shannon |
| 2017 | Interspeech | Tacotron: Towards End-to-End Speech Synthesis. | Yuxuan Wang, R. J. Skerry-Ryan, Daisy Stanton, Yonghui Wu, Ron J. Weiss, Navdeep Jaitly, Zongheng Yang, Ying Xiao, Zhifeng Chen, Samy Bengio, Quoc V. Le, Yannis Agiomyrgiannakis, Rob Clark, Rif A. Saurous |
| 2017 | Interspeech | Sequence-to-Sequence Models Can Directly Translate Foreign Speech. | Ron J. Weiss, Jan Chorowski, Navdeep Jaitly, Yonghui Wu, Zhifeng Chen |
| 2016 | ICASSP | Factored spatial and spectral multichannel raw waveform CLDNNs. | Tara N. Sainath, Ron J. Weiss, Kevin W. Wilson, Arun Narayanan, Michiel Bacchiani |
| 2016 | Interspeech | Neural Network Adaptive Beamforming for Robust Multichannel Speech Recognition. | Bo Li, Tara N. Sainath, Ron J. Weiss, Kevin W. Wilson, Michiel Bacchiani |
| 2016 | Interspeech | Reducing the Computational Complexity of Multimicrophone Acoustic Models with Integrated Feature Extraction. | Tara N. Sainath, Arun Narayanan, Ron J. Weiss, Ehsan Variani, Kevin W. Wilson, Michiel Bacchiani, Izhak Shafran |
| 2015 | ASRU | Speaker location and microphone spacing invariant acoustic modeling from raw multichannel waveforms. | Tara N. Sainath, Ron J. Weiss, Kevin W. Wilson, Arun Narayanan, Michiel Bacchiani, Andrew W. Senior |
| 2015 | ICASSP | Speech acoustic modeling from raw multichannel waveforms. | Yedid Hoshen, Ron J. Weiss, Kevin W. Wilson |
| 2015 | Interspeech | Learning the speech front-end with raw waveform CLDNNs. | Tara N. Sainath, Ron J. Weiss, Andrew W. Senior, Kevin W. Wilson, Oriol Vinyals |
| 2014 | ICML | Affinity Weighted Embedding. | Jason Weston, Ron J. Weiss, Hector Yee |
| 2013 | RecSys | Nonlinear latent factorization by embedding multiple user interests. | Jason Weston, Ron J. Weiss, Hector Yee |
| 2013 | RecSys | Learning to rank recommendations with the k-order statistic loss. | Jason Weston, Hector Yee, Ron J. Weiss |
| 2012 | ICML | Latent Collaborative Retrieval. | Jason Weston, Chong Wang, Ron J. Weiss, Adam Berenzweig |
| 2011 | ICASSP | Evaluating music sequence models through missing data. | Thierry Bertin-Mahieux, Graham Grindlay, Ron J. Weiss, Daniel P. W. Ellis |
| 2009 | ICASSP | A variational EM algorithm for learning eigenvoice parameters in mixed signals. | Ron J. Weiss, Daniel P. W. Ellis |
| 2008 | Interspeech | DySANA: dynamic speech and noise adaptation for voice activity detection. | Ron J. Weiss, Trausti T. Kristjansson |
| 2008 | Interspeech | Source separation based on binaural cues and source model constraints. | Ron J. Weiss, Michael I. Mandel, Daniel P. W. Ellis |
| 2006 | ICASSP | Model-Based Monaural Source Separation Using a Vector-Quantized Phase-Vocoder Representation. | Daniel P. W. Ellis, Ron J. Weiss |
| 2006 | Interspeech | Estimating single-channel source separation masks: relevance vector machine classifiers vs. pitch-based masking. | Ron J. Weiss, Daniel P. W. Ellis |