Skip to content

Shuo-Yiin Chang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

3

Active years

2008–2024

Best venue rank

Multiconference

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2024ICASSPMultilingual and Fully Non-Autoregressive ASR with Large Language Model Fusion: A Comprehensive Study.W. Ronny Huang, Cyril Allauzen, Tongzhou Chen, Kilol Gupta, Ke Hu, James Qin, Yu Zhang, Yongqiang Wang, Shuo-Yiin Chang, Tara N. Sainath
2023ASRUImproved Long-Form Speech Recognition By Jointly Modeling The Primary And Non-Primary Speakers.Guru Prakash Arumugam, Shuo-Yiin Chang, Tara N. Sainath, Rohit Prabhavalkar, Quan Wang, Shaan Bijwadia
2023ASRUTowards General-Purpose Text-Instruction-Guided Voice Conversion.Chun-Yi Kuan, Chen-An Li, Tsu-Yuan Hsu, Tse-Yang Lin, Ho-Lam Chung, Kai-Wei Chang, Shuo-Yiin Chang, Hung-Yi Lee
2023ICASSPContext-Aware end-to-end ASR Using Self-Attentive Embedding and Tensor Fusion.Shuo-Yiin Chang, Chao Zhang, Tara N. Sainath, Bo Li, Trevor Strohman
2023ICASSPE2E Segmentation in a Two-Pass Cascaded Encoder ASR Model.W. Ronny Huang, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, David Rybach, Robert David, Rohit Prabhavalkar, Cyril Allauzen, Cal Peyser, Trevor D. Strohman
2023ICASSPMulti-Output RNN-T Joint Networks for Multi-Task Learning of ASR and Auxiliary Tasks.Weiran Wang, Ding Zhao, Shaojin Ding, Hao Zhang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Yanzhang He, Ian McGraw, Shankar Kumar
2023ICASSPUML: A Universal Monolingual Output Layer For Multilingual Asr.Chao Zhang, Bo Li, Tara N. Sainath, Trevor Strohman, Shuo-Yiin Chang
2023InterspeechText Injection for Capitalization and Turn-Taking Prediction in Speech Models.Shaan Bijwadia, Shuo-Yiin Chang, Weiran Wang, Zhong Meng, Hao Zhang
2023InterspeechHow to Estimate Model Transferability of Pre-Trained Speech Models?Zih-Ching Chen, Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Shuo-Yiin Chang, Rohit Prabhavalkar, Hung-yi Lee, Tara N. Sainath
2023InterspeechSemantic Segmentation with Bidirectional Language Models Improves Long-form ASR.W. Ronny Huang, Hao Zhang, Shankar Kumar, Shuo-Yiin Chang, Tara N. Sainath
2022ICASSPImproving The Latency And Quality Of Cascaded Encoders.Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Weiran Wang, David Qiu, Chung-Cheng Chiu, Rohit Prabhavalkar, Alexander Gruenstein, Anmol Gulati, Bo Li, David Rybach, Emmanuel Guzman, Ian McGraw, James Qin, Krzysztof Choromanski, Qiao Liang, Robert David, Ruoming Pang, Shuo-Yiin Chang, Trevor Strohman, W. Ronny Huang, Wei Han, Yonghui Wu, Yu Zhang
2022ICASSPImproving the Fusion of Acoustic and Text Representations in RNN-T.Chao Zhang, Bo Li, Zhiyun Lu, Tara N. Sainath, Shuo-Yiin Chang
2022InterspeechTurn-Taking Prediction for Natural Conversational Speech.Shuo-Yiin Chang, Bo Li, Tara N. Sainath, Chao Zhang, Trevor Strohman, Qiao Liang, Yanzhang He
2022InterspeechStreaming Intended Query Detection using E2E Modeling for Continued Conversation.Shuo-Yiin Chang, Guru Prakash, Zelin Wu, Tara N. Sainath, Bo Li, Qiao Liang, Adam Stambler, Shyam Upadhyay, Manaal Faruqui, Trevor Strohman
2022InterspeechE2E Segmenter: Joint Segmenting and Decoding for Long-Form ASR.W. Ronny Huang, Shuo-Yiin Chang, David Rybach, Tara N. Sainath, Rohit Prabhavalkar, Cal Peyser, Zhiyun Lu, Cyril Allauzen
2022InterspeechA Language Agnostic Multilingual Streaming On-Device ASR System.Bo Li, Tara N. Sainath, Ruoming Pang, Shuo-Yiin Chang, Qiumin Xu, Trevor Strohman, Vince Chen, Qiao Liang, Heguang Liu, Yanzhang He, Parisa Haghani, Sameer Bidichandani
2022InterspeechStreaming End-to-End Multilingual Speech Recognition with Joint Language Identification.Chao Zhang, Bo Li, Tara N. Sainath, Trevor Strohman, Sepand Mavandadi, Shuo-Yiin Chang, Parisa Haghani
2021ICASSPA Better and Faster end-to-end Model for Streaming ASR.Bo Li, Anmol Gulati, Jiahui Yu, Tara N. Sainath, Chung-Cheng Chiu, Arun Narayanan, Shuo-Yiin Chang, Ruoming Pang, Yanzhang He, James Qin, Wei Han, Qiao Liang, Yu Zhang, Trevor Strohman, Yonghui Wu
2021ICASSPFastEmit: Low-Latency Streaming ASR with Sequence-Level Emission Regularization.Jiahui Yu, Chung-Cheng Chiu, Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Yanzhang He, Arun Narayanan, Wei Han, Anmol Gulati, Yonghui Wu, Ruoming Pang
2021InterspeechAn Efficient Streaming Non-Recurrent On-Device End-to-End Model with Improvements to Rare-Word Modeling.Tara N. Sainath, Yanzhang He, Arun Narayanan, Rami Botros, Ruoming Pang, David Rybach, Cyril Allauzen, Ehsan Variani, James Qin, Quoc-Nam Le-The, Shuo-Yiin Chang, Bo Li, Anmol Gulati, Jiahui Yu, Chung-Cheng Chiu, Diamantino Caseiro, Wei Li, Qiao Liang, Pat Rondon
2020ICASSPTowards Fast and Accurate Streaming End-To-End ASR.Bo Li, Shuo-Yiin Chang, Tara N. Sainath, Ruoming Pang, Yanzhang He, Trevor Strohman, Yonghui Wu
2020ICASSPA Streaming On-Device End-To-End Model Surpassing Server-Side Conventional Model Quality and Latency.Tara N. Sainath, Yanzhang He, Bo Li, Arun Narayanan, Ruoming Pang, Antoine Bruguier, Shuo-Yiin Chang, Wei Li, Raziel Alvarez, Zhifeng Chen, Chung-Cheng Chiu, David Garcia, Alexander Gruenstein, Ke Hu, Anjuli Kannan, Qiao Liang, Ian McGraw, Cal Peyser, Rohit Prabhavalkar, Golan Pundak, David Rybach, Yuan Shangguan, Yash Sheth, Trevor Strohman, Mirk Visontai, Yonghui Wu, Yu Zhang, Ding Zhao
2020InterspeechLow Latency Speech Recognition Using End-to-End Prefetching.Shuo-Yiin Chang, Bo Li, David Rybach, Yanzhang He, Wei Li, Tara N. Sainath, Trevor Strohman
2019ASRUA Unified Endpointer Using Multitask and Multidomain Training.Shuo-Yiin Chang, Bo Li, Gabor Simko
2019ICASSPJoint Endpointing and Decoding with End-to-end Models.Shuo-Yiin Chang, Rohit Prabhavalkar, Yanzhang He, Tara N. Sainath, Gabor Simko
2019ICASSPStreaming End-to-end Speech Recognition for Mobile Devices.Yanzhang He, Tara N. Sainath, Rohit Prabhavalkar, Ian McGraw, Raziel Alvarez, Ding Zhao, David Rybach, Anjuli Kannan, Yonghui Wu, Ruoming Pang, Qiao Liang, Deepti Bhatia, Yuan Shangguan, Bo Li, Golan Pundak, Khe Chai Sim, Tom Bagby, Shuo-Yiin Chang, Kanishka Rao, Alexander Gruenstein
2018ICASSPTemporal Modeling Using Dilated Convolution and Gating for Voice-Activity-Detection.Shuo-Yiin Chang, Bo Li, Gabor Simko, Tara N. Sainath, Anshuman Tripathi, Aron van den Oord, Oriol Vinyals
2017InterspeechEndpoint Detection Using Grid Long Short-Term Memory Networks for Streaming Speech Recognition.Shuo-Yiin Chang, Bo Li, Tara N. Sainath, Gabor Simko, Carolina Parada
2017InterspeechImproved End-of-Query Detection for Streaming Speech Recognition.Matt Shannon, Gabor Simko, Shuo-Yiin Chang, Carolina Parada
2015ICASSPOn the importance of modeling and robustness for deep neural network feature.Shuo-Yiin Chang, Steven Wegmann
2014InterspeechRobust CNN-based speech recognition with Gabor filter kernels.Shuo-Yiin Chang, Nelson Morgan
2013ICASSPSpectro-temporal features for noise-robust speech recognition using power-law nonlinearity and power-bias subtraction.Shuo-Yiin Chang, Bernd T. Meyer, Nelson Morgan
2013ICASSPThe blame game in meeting room ASR: An analysis of feature versus model errors in noisy and mismatched conditions.Sree Hari Krishnan Parthasarathi, Shuo-Yiin Chang, Jordan Cohen, Nelson Morgan, Steven Wegmann
2013InterspeechInformative spectro-temporal bottleneck features for noise-robust speech recognition.Shuo-Yiin Chang, Nelson Morgan
2009ICASSPImproved clustered hierarchical tandem system with bottom-up processing.Shuo-Yiin Chang, Lin-Shan Lee
2008InterspeechData-driven clustered hierarchical tandem system for LVCSR.Shuo-Yiin Chang, Lin-Shan Lee