Zengwei Yao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
13
Venues
5
Active years
2022–2026
Best venue rank
A*
Where they publish
Papers
13 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | ZipVoice-Dialog: Non-Autoregressive Spoken Dialogue Generation with Flow Matching. | Han Zhu, Wei Kang, Liyong Guo, Zengwei Yao, Fangjun Kuang, Weiji Zhuang, Zhaoqing Li, Zhifeng Han, Dong Zhang, Xin Zhang, Xingchen Song, Lingxuan Ye, Long Lin, Daniel Povey |
| 2025 | ASRU | ZipVoice: Fast and High-Quality Zero-Shot Text-to-Speech with Flow Matching. | Zhu Han, Wei Kang, Zengwei Yao, Liyong Guo, Fangjun Kuang, Zhaoqing Li, Weiji Zhuang, Long Lin, Daniel Povey |
| 2025 | ICLR | CR-CTC: Consistency regularization on CTC for improved speech recognition. | Zengwei Yao, Wei Kang, Xiaoyu Yang, Fangjun Kuang, Liyong Guo, Han Zhu, Zengrui Jin, Zhaoqing Li, Long Lin, Daniel Povey |
| 2024 | ICASSP | Libriheavy: A 50, 000 Hours ASR Corpus with Punctuation Casing and Context. | Wei Kang, Xiaoyu Yang, Zengwei Yao, Fangjun Kuang, Yifan Yang, Liyong Guo, Long Lin, Daniel Povey |
| 2024 | ICASSP | PromptASR for Contextualized ASR with Controllable Style. | Xiaoyu Yang, Wei Kang, Zengwei Yao, Yifan Yang, Liyong Guo, Fangjun Kuang, Long Lin, Daniel Povey |
| 2024 | ICLR | Zipformer: A faster and better encoder for automatic speech recognition. | Zengwei Yao, Liyong Guo, Xiaoyu Yang, Wei Kang, Fangjun Kuang, Yifan Yang, Zengrui Jin, Long Lin, Daniel Povey |
| 2024 | Interspeech | LibriheavyMix: A 20, 000-Hour Dataset for Single-Channel Reverberant Multi-Talker Speech Separation, ASR and Speaker Diarization. | Zengrui Jin, Yifan Yang, Mohan Shi, Wei Kang, Xiaoyu Yang, Zengwei Yao, Fangjun Kuang, Liyong Guo, Lingwei Meng, Long Lin, Yong Xu, Shi-Xiong Zhang, Daniel Povey |
| 2023 | ICASSP | Predicting Multi-Codebook Vector Quantization Indexes for Knowledge Distillation. | Liyong Guo, Xiaoyu Yang, Quandong Wang, Yuxiang Kong, Zengwei Yao, Fan Cui, Fangjun Kuang, Wei Kang, Long Lin, Mingshuang Luo, Piotr Zelasko, Daniel Povey |
| 2023 | ICASSP | Fast and Parallel Decoding for Transducer. | Wei Kang, Liyong Guo, Fangjun Kuang, Long Lin, Mingshuang Luo, Zengwei Yao, Xiaoyu Yang, Piotr Zelasko, Daniel Povey |
| 2023 | ICASSP | Delay-Penalized Transducer for Low-Latency Streaming ASR. | Wei Kang, Zengwei Yao, Fangjun Kuang, Liyong Guo, Xiaoyu Yang, Long Lin, Piotr Zelasko, Daniel Povey |
| 2023 | Interspeech | Blank-regularized CTC for Frame Skipping in Neural Transducer. | Yifan Yang, Xiaoyu Yang, Liyong Guo, Zengwei Yao, Wei Kang, Fangjun Kuang, Long Lin, Xie Chen, Daniel Povey |
| 2023 | Interspeech | Delay-penalized CTC Implemented Based on Finite State Transducer. | Zengwei Yao, Wei Kang, Fangjun Kuang, Liyong Guo, Xiaoyu Yang, Yifan Yang, Long Lin, Daniel Povey |
| 2022 | Interspeech | Pruned RNN-T for fast, memory-efficient ASR training. | Fangjun Kuang, Liyong Guo, Wei Kang, Long Lin, Mingshuang Luo, Zengwei Yao, Daniel Povey |