Ye Jia
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
26
Venues
10
Active years
2018–2025
Best venue rank
A*
Where they publish
Papers
26 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | SimulTron: On-Device Simultaneous Speech to Speech Translation. | Alex Agranovich, Eliya Nachmani, Oleg Rybakov, Yifan Ding, Ye Jia, Nadav Bar, Heiga Zen, Michelle Tadmor Ramanovich |
| 2025 | KDD | HiBench: Benchmarking LLMs Capability on Hierarchical Structure Reasoning. | Zhuohang Jiang, Pangjing Wu, Ziran Liang, Peter Q. Chen, Xu Yuan, Ye Jia, Jiancheng Tu, Chen Li, Peter H. F. Ng, Qing Li |
| 2025 | UIST | Can You Move These Over There? Exploring an LLM-based VR Mover to Support Natural Multi-object Manipulation. | Xiangzhi Eric Wang, Zackary P. T. Sin, Ye Jia, Dan Archer, Wynonna H. Y. Fong, Qing Li, Chen Li |
| 2024 | VR | illumotion: An Optical-illusion-based VR Locomotion Technique for Long-Distance 3D Movement. | Zackary P. T. Sin, Ye Jia, Richard Chen Li, Hong Va Leong, Qing Li, Peter H. F. Ng |
| 2023 | ICASSP | Textless Direct Speech-to-Speech Translation with Discrete Speech Representation. | Xinjian Li, Ye Jia, Chung-Cheng Chiu |
| 2023 | Interspeech | Speech Aware Dialog System Technology Challenge (DSTC11). | Hagen Soltau, Izhak Shafran, Mingqiu Wang, Abhinav Rastogi, Jeffrey Zhao, Ye Jia, Wei Han, Yuan Cao, Aramys Miranda |
| 2022 | CVPR | More than Words: In-the-Wild Visually-Driven Prosody for Text-to-Speech. | Michael Hassid, Michelle Tadmor Ramanovich, Brendan Shillingford, Miaosen Wang, Ye Jia, Tal Remez |
| 2022 | ICML | Translatotron 2: High-quality direct speech-to-speech translation with voice preservation. | Ye Jia, Michelle Tadmor Ramanovich, Tal Remez, Roi Pomerantz |
| 2022 | Interspeech | XTREME-S: Evaluating Cross-lingual Speech Representations. | Alexis Conneau, Ankur Bapna, Yu Zhang, Min Ma, Patrick von Platen, Anton Lozhkov, Colin Cherry, Ye Jia, Clara Rivera, Mihir Kale, Daan van Esch, Vera Axelrod, Simran Khanuja, Jonathan H. Clark, Orhan Firat, Michael Auli, Sebastian Ruder, Jason Riesa, Melvin Johnson |
| 2022 | Interspeech | Training Text-To-Speech Systems From Synthetic Data: A Practical Approach For Accent Transfer Tasks. | Lev Finkelstein, Heiga Zen, Norman Casagrande, Chun-an Chan, Ye Jia, Tom Kenter, Alexey Petelin, Jonathan Shen, Vincent Wan, Yu Zhang, Yonghui Wu, Rob Clark |
| 2022 | Interspeech | Leveraging unsupervised and weakly-supervised data to improve direct speech-to-speech translation. | Ye Jia, Yifan Ding, Ankur Bapna, Colin Cherry, Yu Zhang, Alexis Conneau, Nobu Morioka |
| 2022 | LREC | CVSS Corpus and Massively Multilingual Speech-to-Speech Translation. | Ye Jia, Michelle Tadmor Ramanovich, Quan Wang, Heiga Zen |
| 2021 | ASRU | Textual Echo Cancellation. | Shaojin Ding, Ye Jia, Ke Hu, Quan Wang |
| 2021 | ICASSP | Parallel Tacotron: Non-Autoregressive and Controllable TTS. | Isaac Elias, Heiga Zen, Jonathan Shen, Yu Zhang, Ye Jia, Ron J. Weiss, Yonghui Wu |
| 2021 | Interspeech | Parallel Tacotron 2: A Non-Autoregressive Neural TTS Model with Differentiable Duration Modeling. | Isaac Elias, Heiga Zen, Jonathan Shen, Yu Zhang, Ye Jia, R. J. Skerry-Ryan, Yonghui Wu |
| 2021 | Interspeech | PnG BERT: Augmented BERT on Phonemes and Graphemes for Neural TTS. | Ye Jia, Heiga Zen, Jonathan Shen, Yu Zhang, Yonghui Wu |
| 2020 | Interspeech | Improved Noisy Student Training for Automatic Speech Recognition. | Daniel S. Park, Yu Zhang, Ye Jia, Wei Han, Chung-Cheng Chiu, Bo Li, Yonghui Wu, Quoc V. Le |
| 2019 | ASRU | Speech Recognition with Augmented Synthesized Speech. | Andrew Rosenberg, Yu Zhang, Bhuvana Ramabhadran, Ye Jia, Pedro J. Moreno, Yonghui Wu, Zelin Wu |
| 2019 | ICASSP | Leveraging Weakly Supervised Data to Improve End-to-end Speech-to-text Translation. | Ye Jia, Melvin Johnson, Wolfgang Macherey, Ron J. Weiss, Yuan Cao, Chung-Cheng Chiu, Naveen Ari, Stella Laurenzo, Yonghui Wu |
| 2019 | ICLR | Hierarchical Generative Modeling for Controllable Speech Synthesis. | Wei-Ning Hsu, Yu Zhang, Ron J. Weiss, Heiga Zen, Yonghui Wu, Yuxuan Wang, Yuan Cao, Ye Jia, Zhifeng Chen, Jonathan Shen, Patrick Nguyen, Ruoming Pang |
| 2019 | Interspeech | Parrotron: An End-to-End Speech-to-Speech Conversion Model and its Applications to Hearing-Impaired Speech and Speech Separation. | Fadi Biadsy, Ron J. Weiss, Pedro J. Moreno, Dimitri Kanvesky, Ye Jia |
| 2019 | Interspeech | Direct Speech-to-Speech Translation with a Sequence-to-Sequence Model. | Ye Jia, Ron J. Weiss, Fadi Biadsy, Wolfgang Macherey, Melvin Johnson, Zhifeng Chen, Yonghui Wu |
| 2019 | Interspeech | VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking. | Quan Wang, Hannah Muckenhirn, Kevin W. Wilson, Prashant Sridhar, Zelin Wu, John R. Hershey, Rif A. Saurous, Ron J. Weiss, Ye Jia, Ignacio Lpez-Moreno |
| 2019 | Interspeech | LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech. | Heiga Zen, Viet Dang, Rob Clark, Yu Zhang, Ron J. Weiss, Ye Jia, Zhifeng Chen, Yonghui Wu |
| 2019 | Interspeech | Learning to Speak Fluently in a Foreign Language: Multilingual Speech Synthesis and Cross-Language Voice Cloning. | Yu Zhang, Ron J. Weiss, Heiga Zen, Yonghui Wu, Zhifeng Chen, R. J. Skerry-Ryan, Ye Jia, Andrew Rosenberg, Bhuvana Ramabhadran |
| 2018 | ICML | Style Tokens: Unsupervised Style Modeling, Control and Transfer in End-to-End Speech Synthesis. | Yuxuan Wang, Daisy Stanton, Yu Zhang, R. J. Skerry-Ryan, Eric Battenberg, Joel Shor, Ying Xiao, Ye Jia, Fei Ren, Rif A. Saurous |