Skip to content

1-bit stochastic gradient descent and its application to data-parallel distributed training of speech DNNs.

Frank Seide, Hao Fu, Jasha Droppo, Gang Li, Dong Yu

Year2014
ProceedingsINTERSPEECH

Browse the full Interspeech paper archive.