Skip to content

Hasim Sak

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

41

Venues

5

Active years

2007–2024

Best venue rank

A*

Where they publish

Papers

41 indexed papers, newest first.

YearVenueTitleAuthors
2024ICASSPMonte Carlo Self-Training for Speech Recognition.Anshuman Tripathi, Soheil Khorram, Han Lu, Jaeyoung Kim, Qian Zhang, Hasim Sak
2023ICASSPCross-Training: A Semi-Supervised Training Scheme for Speech Recognition.Soheil Khorram, Anshuman Tripathi, Jaeyoung Kim, Han Lu, Qian Zhang, Rohit Prabhavalkar, Hasim Sak
2022ICASSPContrastive Siamese Network for Semi-Supervised Speech Recognition.Soheil Khorram, Jaeyoung Kim, Anshuman Tripathi, Han Lu, Qian Zhang, Hasim Sak
2022ICASSPTurn-to-Diarize: Online Speaker Diarization Constrained by Transformer Transducer Speaker Turn Detection.Wei Xia, Han Lu, Quan Wang, Anshuman Tripathi, Yiling Huang, Ignacio Lpez-Moreno, Hasim Sak
2021InterspeechReducing Streaming ASR Model Delay with Self Alignment.Jaeyoung Kim, Han Lu, Anshuman Tripathi, Qian Zhang, Hasim Sak
2020ICASSPEnd-To-End Multi-Talker Overlapping Speech Recognition.Anshuman Tripathi, Han Lu, Hasim Sak
2020ICASSPTransformer Transducer: A Streamable Speech Recognition Model with Transformer Encoders and RNN-T Loss.Qian Zhang, Han Lu, Hasim Sak, Anshuman Tripathi, Erik McDermott, Stephen Koo, Shankar Kumar
2020InterspeechMultilingual Speech Recognition with Self-Attention Structured Parameterization.Yun Zhu, Parisa Haghani, Anshuman Tripathi, Bhuvana Ramabhadran, Brian Farris, Hainan Xu, Han Lu, Hasim Sak, Isabel Leal, Neeraj Gaur, Pedro J. Moreno, Qian Zhang
2019ASRUA Density Ratio Approach to Language Model Fusion in End-to-End Automatic Speech Recognition.Erik McDermott, Hasim Sak, Ehsan Variani
2019ASRUMonotonic Recurrent Neural Network Transducer and Decoding Strategies.Anshuman Tripathi, Han Lu, Hasim Sak, Hagen Soltau
2019InterspeechLarge-Scale Visual Speech Recognition.Brendan Shillingford, Yannis M. Assael, Matthew W. Hoffman, Thomas Paine, Can Hughes, Utsav Prabhu, Hank Liao, Hasim Sak, Kanishka Rao, Lorrayne Bennett, Marie Mulville, Misha Denil, Ben Coppin, Ben Laurie, Andrew W. Senior, Nando de Freitas
2018InterspeechSpeech Recognition for Medical Conversations.Chung-Cheng Chiu, Anshuman Tripathi, Katherine Chou, Chris Co, Navdeep Jaitly, Diana Jaunzeikare, Anjuli Kannan, Patrick Nguyen, Hasim Sak, Ananth Sankar, Justin Tansuwan, Nathan Wan, Yonghui Wu, Xuedong Zhang
2017ASRUExploring architectures, data and units for streaming end-to-end speech recognition with RNN-transducer.Kanishka Rao, Hasim Sak, Rohit Prabhavalkar
2017ASRUReducing the computational complexity for whole word models.Hagen Soltau, Hank Liao, Hasim Sak
2017ICASSPMulti-accent speech recognition with hierarchical grapheme based models.Kanishka Rao, Hasim Sak
2017InterspeechAcoustic Modeling for Google Home.Bo Li, Tara N. Sainath, Arun Narayanan, Joe Caroselli, Michiel Bacchiani, Ananya Misra, Izhak Shafran, Hasim Sak, Golan Pundak, Kean K. Chin, Khe Chai Sim, Ron J. Weiss, Kevin W. Wilson, Ehsan Variani, Chanwoo Kim, Olivier Siohan, Mitchel Weintraub, Erik McDermott, Richard Rose, Matt Shannon
2017InterspeechRecurrent Neural Aligner: An Encoder-Decoder Neural Network Model for Sequence to Sequence Mapping.Hasim Sak, Matt Shannon, Kanishka Rao, Franoise Beaufays
2017InterspeechNeural Speech Recognizer: Acoustic-to-Word LSTM Model for Large Vocabulary Speech Recognition.Hagen Soltau, Hank Liao, Hasim Sak
2016ICASSPPersonalized speech recognition on mobile devices.Ian McGraw, Rohit Prabhavalkar, Raziel Alvarez, Montse Gonzalez Arenas, Kanishka Rao, David Rybach, Ouais Alsharif, Hasim Sak, Alexander Gruenstein, Franoise Beaufays, Carolina Parada
2016ICASSPFlat start training of CD-CTC-SMBR LSTM RNN acoustic models.Kanishka Rao, Andrew W. Senior, Hasim Sak
2015ASRUAcoustic modelling with CD-CTC-SMBR LSTM RNNS.Andrew W. Senior, Hasim Sak, Felix de Chaumont Quitry, Tara N. Sainath, Kanishka Rao
2015ICASSPGrapheme-to-phoneme conversion using Long Short-Term Memory recurrent neural networks.Kanishka Rao, Fuchun Peng, Hasim Sak, Franoise Beaufays
2015ICASSPConvolutional, Long Short-Term Memory, fully connected Deep Neural Networks.Tara N. Sainath, Oriol Vinyals, Andrew W. Senior, Hasim Sak
2015ICASSPLearning acoustic frame labeling for speech recognition with recurrent neural networks.Hasim Sak, Andrew W. Senior, Kanishka Rao, Ozan Irsoy, Alex Graves, Franoise Beaufays, Johan Schalkwyk
2015ICASSPContext dependent phone models for LSTM RNN acoustic modelling.Andrew W. Senior, Hasim Sak, Izhak Shafran
2015ICASSPUnidirectional long short-term memory recurrent neural network with recurrent output layer for low-latency speech synthesis.Heiga Zen, Hasim Sak
2015InterspeechFast and accurate recurrent neural network acoustic models for speech recognition.Hasim Sak, Andrew W. Senior, Kanishka Rao, Franoise Beaufays
2014InterspeechAutomatic language identification using long short-term memory recurrent neural networks.Javier Gonzalez-Dominguez, Ignacio Lpez-Moreno, Hasim Sak, Joaquin Gonzalez-Rodriguez, Pedro J. Moreno
2014InterspeechLong short-term memory recurrent neural network architectures for large scale acoustic modeling.Hasim Sak, Andrew W. Senior, Franoise Beaufays
2014InterspeechSequence discriminative distributed training of long short-term memory recurrent neural networks.Hasim Sak, Oriol Vinyals, Georg Heigold, Andrew W. Senior, Erik McDermott, Rajat Monga, Mark Z. Mao
2013ASRUMixture of mixture n-gram language models.Hasim Sak, Cyril Allauzen, Kaisuke Nakajima, Franoise Beaufays
2013ICASSPLanguage model verbalization for automatic speech recognition.Hasim Sak, Franoise Beaufays, Kaisuke Nakajima, Cyril Allauzen
2013InterspeechWritten-domain language modeling for automatic speech recognition.Hasim Sak, Yun-Hsuan Sung, Franoise Beaufays, Cyril Allauzen
2012ICASSPSemi-supervised discriminative language modeling for Turkish ASR.Arda elebi, Hasim Sak, Erin Dikici, Murat Saraclar, Maider Lehr, Emily Tucker Prud'hommeaux, Puyang Xu, Nathan Glenn, Damianos Karakos, Sanjeev Khudanpur, Brian Roark, Kenji Sagae, Izhak Shafran, Daniel M. Bikel, Chris Callison-Burch, Yuan Cao, Keith B. Hall, Eva Hasler, Philipp Koehn, Adam Lopez, Matt Post, Darcey Riley
2011ASRUDiscriminative reranking of ASR hypotheses with morpholexical and N-best-list features.Hasim Sak, Murat Saraclar, Tunga Gungor
2010ICASSPMorphology-based and sub-word language modeling for Turkish speech recognition.Hasim Sak, Murat Saraclar, Tunga Gngr
2010InterspeechOn-the-fly lattice rescoring for real-time automatic speech recognition.Hasim Sak, Murat Saraclar, Tunga Gngr
2009ACLA Stochastic Finite-State Morphological Parser for Turkish.Hasim Sak, Tunga Gngr, Murat Saraclar
2009ASRUIntegrating morphology into automatic speech recognition.Hasim Sak, Murat Saraclar, Tunga Gngr
2007CICLINGMorphological Disambiguation of Turkish Text with Perceptron Algorithm.Hasim Sak, Tunga Gngr, Murat Saraclar
2007InterspeechLanguage modeling for automatic turkish broadcast news transcription.Ebru Arisoy, Hasim Sak, Murat Saraclar