Shuo-Yiin Chang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
36
Venues
3
Active years
2008–2024
Best venue rank
Multiconference
Where they publish
Papers
36 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | ICASSP | Multilingual and Fully Non-Autoregressive ASR with Large Language Model Fusion: A Comprehensive Study. | W. Ronny Huang, Cyril Allauzen, Tongzhou Chen, Kilol Gupta, Ke Hu, James Qin, Yu Zhang, Yongqiang Wang, Shuo-Yiin Chang, Tara N. Sainath |
| 2023 | ASRU | Improved Long-Form Speech Recognition By Jointly Modeling The Primary And Non-Primary Speakers. | Guru Prakash Arumugam, Shuo-Yiin Chang, Tara N. Sainath, Rohit Prabhavalkar, Quan Wang, Shaan Bijwadia |
| 2023 | ASRU | Towards General-Purpose Text-Instruction-Guided Voice Conversion. | Chun-Yi Kuan, Chen-An Li, Tsu-Yuan Hsu, Tse-Yang Lin, Ho-Lam Chung, Kai-Wei Chang, Shuo-Yiin Chang, Hung-Yi Lee |
| 2023 | ICASSP | Context-Aware end-to-end ASR Using Self-Attentive Embedding and Tensor Fusion. | Shuo-Yiin Chang, Chao Zhang, Tara N. Sainath, Bo Li, Trevor Strohman |
| 2023 | ICASSP | E2E Segmentation in a Two-Pass Cascaded Encoder ASR Model. | W. Ronny Huang, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, David Rybach, Robert David, Rohit Prabhavalkar, Cyril Allauzen, Cal Peyser, Trevor D. Strohman |
| 2023 | ICASSP | Multi-Output RNN-T Joint Networks for Multi-Task Learning of ASR and Auxiliary Tasks. | Weiran Wang, Ding Zhao, Shaojin Ding, Hao Zhang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Yanzhang He, Ian McGraw, Shankar Kumar |
| 2023 | ICASSP | UML: A Universal Monolingual Output Layer For Multilingual Asr. | Chao Zhang, Bo Li, Tara N. Sainath, Trevor Strohman, Shuo-Yiin Chang |
| 2023 | Interspeech | Text Injection for Capitalization and Turn-Taking Prediction in Speech Models. | Shaan Bijwadia, Shuo-Yiin Chang, Weiran Wang, Zhong Meng, Hao Zhang |
| 2023 | Interspeech | How to Estimate Model Transferability of Pre-Trained Speech Models? | Zih-Ching Chen, Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Shuo-Yiin Chang, Rohit Prabhavalkar, Hung-yi Lee, Tara N. Sainath |
| 2023 | Interspeech | Semantic Segmentation with Bidirectional Language Models Improves Long-form ASR. | W. Ronny Huang, Hao Zhang, Shankar Kumar, Shuo-Yiin Chang, Tara N. Sainath |
| 2022 | ICASSP | Improving The Latency And Quality Of Cascaded Encoders. | Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Weiran Wang, David Qiu, Chung-Cheng Chiu, Rohit Prabhavalkar, Alexander Gruenstein, Anmol Gulati, Bo Li, David Rybach, Emmanuel Guzman, Ian McGraw, James Qin, Krzysztof Choromanski, Qiao Liang, Robert David, Ruoming Pang, Shuo-Yiin Chang, Trevor Strohman, W. Ronny Huang, Wei Han, Yonghui Wu, Yu Zhang |
| 2022 | ICASSP | Improving the Fusion of Acoustic and Text Representations in RNN-T. | Chao Zhang, Bo Li, Zhiyun Lu, Tara N. Sainath, Shuo-Yiin Chang |
| 2022 | Interspeech | Turn-Taking Prediction for Natural Conversational Speech. | Shuo-Yiin Chang, Bo Li, Tara N. Sainath, Chao Zhang, Trevor Strohman, Qiao Liang, Yanzhang He |
| 2022 | Interspeech | Streaming Intended Query Detection using E2E Modeling for Continued Conversation. | Shuo-Yiin Chang, Guru Prakash, Zelin Wu, Tara N. Sainath, Bo Li, Qiao Liang, Adam Stambler, Shyam Upadhyay, Manaal Faruqui, Trevor Strohman |
| 2022 | Interspeech | E2E Segmenter: Joint Segmenting and Decoding for Long-Form ASR. | W. Ronny Huang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Rohit Prabhavalkar, Cal Peyser, Zhiyun Lu, Cyril Allauzen |
| 2022 | Interspeech | A Language Agnostic Multilingual Streaming On-Device ASR System. | Bo Li, Tara N. Sainath, Ruoming Pang, Shuo-Yiin Chang, Qiumin Xu, Trevor Strohman, Vince Chen, Qiao Liang, Heguang Liu, Yanzhang He, Parisa Haghani, Sameer Bidichandani |
| 2022 | Interspeech | Streaming End-to-End Multilingual Speech Recognition with Joint Language Identification. | Chao Zhang, Bo Li, Tara N. Sainath, Trevor Strohman, Sepand Mavandadi, Shuo-Yiin Chang, Parisa Haghani |
| 2021 | ICASSP | A Better and Faster end-to-end Model for Streaming ASR. | Bo Li, Anmol Gulati, Jiahui Yu, Tara N. Sainath, Chung-Cheng Chiu, Arun Narayanan, Shuo-Yiin Chang, Ruoming Pang, Yanzhang He, James Qin, Wei Han, Qiao Liang, Yu Zhang, Trevor Strohman, Yonghui Wu |
| 2021 | ICASSP | FastEmit: Low-Latency Streaming ASR with Sequence-Level Emission Regularization. | Jiahui Yu, Chung-Cheng Chiu, Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, Arun Narayanan, Wei Han, Anmol Gulati, Yonghui Wu, Ruoming Pang |
| 2021 | Interspeech | An Efficient Streaming Non-Recurrent On-Device End-to-End Model with Improvements to Rare-Word Modeling. | Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Ruoming Pang, David Rybach, Cyril Allauzen, Ehsan Variani, James Qin, Quoc-Nam Le-The, Shuo-Yiin Chang, Bo Li, Anmol Gulati, Jiahui Yu, Chung-Cheng Chiu, Diamantino Caseiro, Wei Li, Qiao Liang, Pat Rondon |
| 2020 | ICASSP | Towards Fast and Accurate Streaming End-To-End ASR. | Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Ruoming Pang, Yanzhang He, Trevor Strohman, Yonghui Wu |
| 2020 | ICASSP | A Streaming On-Device End-To-End Model Surpassing Server-Side Conventional Model Quality and Latency. | Tara N. Sainath, Yanzhang He, Bo Li, Arun Narayanan, Ruoming Pang, Antoine Bruguier, Shuo-Yiin Chang, Wei Li, Raziel Alvarez, Zhifeng Chen, Chung-Cheng Chiu, David Garcia, Alexander Gruenstein, Ke Hu, Anjuli Kannan, Qiao Liang, Ian McGraw, Cal Peyser, Rohit Prabhavalkar, Golan Pundak, David Rybach, Yuan Shangguan, Yash Sheth, Trevor Strohman, Mirk Visontai, Yonghui Wu, Yu Zhang, Ding Zhao |
| 2020 | Interspeech | Low Latency Speech Recognition Using End-to-End Prefetching. | Shuo-Yiin Chang, Bo Li, David Rybach, Yanzhang He, Wei Li, Tara N. Sainath, Trevor Strohman |
| 2019 | ASRU | A Unified Endpointer Using Multitask and Multidomain Training. | Shuo-Yiin Chang, Bo Li, Gabor Simko |
| 2019 | ICASSP | Joint Endpointing and Decoding with End-to-end Models. | Shuo-Yiin Chang, Rohit Prabhavalkar, Yanzhang He, Tara N. Sainath, Gabor Simko |
| 2019 | ICASSP | Streaming End-to-end Speech Recognition for Mobile Devices. | Yanzhang He, Tara N. Sainath, Rohit Prabhavalkar, Ian McGraw, Raziel Alvarez, Ding Zhao, David Rybach, Anjuli Kannan, Yonghui Wu, Ruoming Pang, Qiao Liang, Deepti Bhatia, Yuan Shangguan, Bo Li, Golan Pundak, Khe Chai Sim, Tom Bagby, Shuo-Yiin Chang, Kanishka Rao, Alexander Gruenstein |
| 2018 | ICASSP | Temporal Modeling Using Dilated Convolution and Gating for Voice-Activity-Detection. | Shuo-Yiin Chang, Bo Li, Gabor Simko, Tara N. Sainath, Anshuman Tripathi, Aron van den Oord, Oriol Vinyals |
| 2017 | Interspeech | Endpoint Detection Using Grid Long Short-Term Memory Networks for Streaming Speech Recognition. | Shuo-Yiin Chang, Bo Li, Tara N. Sainath, Gabor Simko, Carolina Parada |
| 2017 | Interspeech | Improved End-of-Query Detection for Streaming Speech Recognition. | Matt Shannon, Gabor Simko, Shuo-Yiin Chang, Carolina Parada |
| 2015 | ICASSP | On the importance of modeling and robustness for deep neural network feature. | Shuo-Yiin Chang, Steven Wegmann |
| 2014 | Interspeech | Robust CNN-based speech recognition with Gabor filter kernels. | Shuo-Yiin Chang, Nelson Morgan |
| 2013 | ICASSP | Spectro-temporal features for noise-robust speech recognition using power-law nonlinearity and power-bias subtraction. | Shuo-Yiin Chang, Bernd T. Meyer, Nelson Morgan |
| 2013 | ICASSP | The blame game in meeting room ASR: An analysis of feature versus model errors in noisy and mismatched conditions. | Sree Hari Krishnan Parthasarathi, Shuo-Yiin Chang, Jordan Cohen, Nelson Morgan, Steven Wegmann |
| 2013 | Interspeech | Informative spectro-temporal bottleneck features for noise-robust speech recognition. | Shuo-Yiin Chang, Nelson Morgan |
| 2009 | ICASSP | Improved clustered hierarchical tandem system with bottom-up processing. | Shuo-Yiin Chang, Lin-Shan Lee |
| 2008 | Interspeech | Data-driven clustered hierarchical tandem system for LVCSR. | Shuo-Yiin Chang, Lin-Shan Lee |