Zhaoheng Ni
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
23
Venues
5
Active years
2018–2025
Best venue rank
A*
Where they publish
Papers
23 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASRU | Long-Form Fuzzy Speech-to-Text Alignment for 1000+ Languages. | Ruizhe Huang, Xiaohui Zhang, Zhaoheng Ni, Moto Hira, Jeff Hwang, Vineel Pratap, Ju Lin, Ming Sun, Florian Metze |
| 2025 | ASRU | Less is More: Data Curation Matters in Scaling Speech Enhancement. | Chenda Li, Wangyou Zhang, Wei Wang, Robin Scheibler, Kohei Saijo, Samuele Cornell, Yihui Fu, Marvin Sach, Zhaoheng Ni, Anurag Kumar, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian |
| 2025 | ASRU | URGENT-PK: Perceptually-Aligned Ranking Model Designed for Speech Enhancement Competition. | Jiahe Wang, Chenda Li, Wei Wang, Wangyou Zhang, Samuele Cornell, Marvin Sach, Robin Scheibler, Kohei Saijo, Yihui Fu, Zhaoheng Ni, Anurag Kumar, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian |
| 2025 | ICASSP | Adapting Whisper for Code-Switching through Encoding Refining and Language-Aware Decoding. | Jiahui Zhao, Hao Shi, Chenrui Cui, Tianrui Wang, Hexin Liu, Zhaoheng Ni, Lingxuan Ye, Longbiao Wang |
| 2025 | Interspeech | Interspeech 2025 URGENT Speech Enhancement Challenge. | Kohei Saijo, Wangyou Zhang, Samuele Cornell, Robin Scheibler, Chenda Li, Zhaoheng Ni, Anurag Kumar, Marvin Sach, Yihui Fu, Wei Wang, Tim Fingscheidt, Shinji Watanabe |
| 2025 | Interspeech | Lessons Learned from the URGENT 2024 Speech Enhancement Challenge. | Wangyou Zhang, Kohei Saijo, Samuele Cornell, Robin Scheibler, Chenda Li, Zhaoheng Ni, Anurag Kumar, Marvin Sach, Wei Wang, Yihui Fu, Shinji Watanabe, Tim Fingscheidt, Yanmin Qian |
| 2024 | ICASSP | On the Open Prompt Challenge in Conditional Audio Generation. | Ernie Chang, Sidd Srinivasan, Mahi Luthra, Pin-Jie Lin, Varun Nagaraja, Forrest N. Iandola, Zechun Liu, Zhaoheng Ni, Changsheng Zhao, Yangyang Shi, Vikas Chandra |
| 2024 | ICASSP | Less Peaky and More Accurate CTC Forced Alignment by Label Priors. | Ruizhe Huang, Xiaohui Zhang, Zhaoheng Ni, Li Sun, Moto Hira, Jeff Hwang, Vimal Manohar, Vineel Pratap, Matthew Wiesner, Shinji Watanabe, Daniel Povey, Sanjeev Khudanpur |
| 2024 | ICASSP | Stack-and-Delay: A New Codebook Pattern for Music Generation. | Gal Le Lan, Varun Nagaraja, Ernie Chang, David Kant, Zhaoheng Ni, Yangyang Shi, Forrest N. Iandola, Vikas Chandra |
| 2024 | ICASSP | Folding Attention: Memory and Power Optimization for On-Device Transformer-Based Streaming Speech Recognition. | Yang Li, Liangzhen Lai, Yuan Shangguan, Forrest N. Iandola, Zhaoheng Ni, Ernie Chang, Yangyang Shi, Vikas Chandra |
| 2024 | ICASSP | An Empirical Study on the Impact of Positional Encoding in Transformer-Based Monaural Speech Enhancement. | Qiquan Zhang, Meng Ge, Hongxu Zhu, Eliathamby Ambikairajah, Qi Song, Zhaoheng Ni, Haizhou Li |
| 2024 | Interspeech | URGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement. | Wangyou Zhang, Robin Scheibler, Kohei Saijo, Samuele Cornell, Chenda Li, Zhaoheng Ni, Jan Pirklbauer, Marvin Sach, Shinji Watanabe, Tim Fingscheidt, Yanmin Qian |
| 2023 | ACL | ESPnet-ST-v2: Multipurpose Spoken Language Translation Toolkit. | Brian Yan, Jiatong Shi, Yun Tang, Hirofumi Inaguma, Yifan Peng, Siddharth Dalmia, Peter Polak, Patrick Fernandes, Dan Berrebbi, Tomoki Hayashi, Xiaohui Zhang, Zhaoheng Ni, Moto Hira, Soumi Maiti, Juan Pino, Shinji Watanabe |
| 2023 | ASRU | TorchAudio 2.1: Advancing Speech Recognition, Self-Supervised Learning, and Audio Processing Components for Pytorch. | Jeff Hwang, Moto Hira, Caroline Chen, Xiaohui Zhang, Zhaoheng Ni, Guangzhi Sun, Pingchuan Ma, Ruizhe Huang, Vineel Pratap, Yuekai Zhang, Anurag Kumar, Chin-Yun Yu, Chuang Zhu, Chunxi Liu, Jacob Kahn, Mirco Ravanelli, Peng Sun, Shinji Watanabe, Yangyang Shi, Yumeng Tao |
| 2023 | ICASSP | Torchaudio-Squim: Reference-Less Speech Quality and Intelligibility Measures in Torchaudio. | Anurag Kumar, Ke Tan, Zhaoheng Ni, Pranay Manocha, Xiaohui Zhang, Ethan Henderson, Buye Xu |
| 2023 | ICASSP | Ripple Sparse Self-Attention for Monaural Speech Enhancement. | Qiquan Zhang, Hongxu Zhu, Qi Song, Xinyuan Qian, Zhaoheng Ni, Haizhou Li |
| 2023 | Interspeech | Reducing Barriers to Self-Supervised Learning: HuBERT Pre-training with Academic Compute. | William Chen, Xuankai Chang, Yifan Peng, Zhaoheng Ni, Soumi Maiti, Shinji Watanabe |
| 2022 | ICASSP | Towards Low-Distortion Multi-Channel Speech Enhancement: The ESPNET-Se Submission to the L3DAS22 Challenge. | Yen-Ju Lu, Samuele Cornell, Xuankai Chang, Wangyou Zhang, Chenda Li, Zhaoheng Ni, Zhong-Qiu Wang, Shinji Watanabe |
| 2022 | ICASSP | Torchaudio: Building Blocks for Audio and Speech Processing. | Yao-Yuan Yang, Moto Hira, Zhaoheng Ni, Artyom Astafurov, Caroline Chen, Christian Puhrsch, David Pollack, Dmitriy Genzel, Donny Greenberg, Edward Z. Yang, Jason Lian, Jeff Hwang, Ji Chen, Peter Goldsborough, Sean Narenthiran, Shinji Watanabe, Soumith Chintala, Vincent Quenneville-Blair |
| 2022 | ICASSP | Time-Frequency Attention for Monaural Speech Enhancement. | Qiquan Zhang, Qi Song, Zhaoheng Ni, Aaron Nicolson, Haizhou Li |
| 2022 | Interspeech | ESPnet-SE++: Speech Enhancement for Robust Speech Recognition, Translation, and Understanding. | Yen-Ju Lu, Xuankai Chang, Chenda Li, Wangyou Zhang, Samuele Cornell, Zhaoheng Ni, Yoshiki Masuyama, Brian Yan, Robin Scheibler, Zhong-Qiu Wang, Yu Tsao, Yanmin Qian, Shinji Watanabe |
| 2020 | ICASSP | Mask-Dependent Phase Estimation for Monaural Speaker Separation. | Zhaoheng Ni, Michael I. Mandel |
| 2018 | LREC | Sound Signal Processing with Seq2Tree Network. | Weicheng Ma, Kai Cao, Zhaoheng Ni, Peter Chin, Xiang Li |