Skip to content

Ozlem Kalinli

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

58

Venues

6

Active years

2007–2025

Best venue rank

A*

Where they publish

Papers

58 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPTransducer-Llama: Integrating LLMs into Streamable Transducer-based Speech Recognition.Keqi Deng, Jinxi Guo, Yingyi Ma, Niko Moritz, Philip C. Woodland, Ozlem Kalinli, Mike Seltzer
2025ICASSPEfficient Streaming LLM for Speech Recognition.Junteng Jia, Gil Keren, Wei Zhou, Egor Lakomkin, Xiaohui Zhang, Chunyang Wu, Frank Seide, Jay Mahadeokar, Ozlem Kalinli
2025ICASSPFaster Speech-LLaMA Inference with Multi-token Prediction.Desh Raj, Gil Keren, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli
2025ICASSPSpeech-N-LlaMA: Improving Speech LLMs with Multi-Pass Training.Amit Kumar Singh Yadav, Gil Keren, Desh Raj, Wei Zhou, Junteng Jia, Ke Li, Ying Xu, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli
2025ICASSPM-BEST-RQ: A Multi-Channel Speech Foundation Model for Smart Glasses.Yufeng Yang, Desh Raj, Ju Lin, Niko Moritz, Junteng Jia, Gil Keren, Egor Lakomkin, Yiteng Huang, Jacob Donley, Jay Mahadeokar, Ozlem Kalinli
2025ICASSPCJST: CTC Compressor based Joint Speech and Text Training for Decoder-Only ASR.Wei Zhou, Junteng Jia, Leda Sari, Jay Mahadeokar, Ozlem Kalinli
2025InterspeechFrozen Large Language Models Can Perceive Paralinguistic Aspects of Speech.Wonjune Kang, Junteng Jia, Chunyang Wu, Wei Zhou, Egor Lakomkin, Yashesh Gaur, Leda Sari, Suyoun Kim, Ke Li, Jay Mahadeokar, Ozlem Kalinli
2024ICASSPForgetting Private Textual Sequences in Language Models Via Leave-One-Out Ensemble.Zhe Liu, Ozlem Kalinli
2024ICASSPPrompting Large Language Models with Speech Recognition Abilities.Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia, Yuan Shangguan, Ke Li, Jinxi Guo, Wenhan Xiong, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2024ICASSPEffective Internal Language Model Training and Fusion for Factorized Transducer Model.Jinxi Guo, Niko Moritz, Yingyi Ma, Frank Seide, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2024ICASSPEnd-to-End Speech Recognition Contextualization with Large Language Models.Egor Lakomkin, Chunyang Wu, Yassir Fathullah, Ozlem Kalinli, Michael L. Seltzer, Christian Fuegen
2024ICASSPCorrection Focused Language Model Training For Speech Recognition.Yingyi Ma, Zhe Liu, Ozlem Kalinli
2024ICASSPTODM: Train Once Deploy Many Efficient Supernet-Based RNN-T Compression For On-Device ASR Models.Yuan Shangguan, Haichuan Yang, Danni Li, Chunyang Wu, Yassir Fathullah, Dilin Wang, Ayushi Dalmia, Raghuraman Krishnamoorthi, Ozlem Kalinli, Junteng Jia, Jay Mahadeokar, Xin Lei, Mike Seltzer, Vikas Chandra
2024ICASSPContextual Biasing of Named-Entities with Large Language Models.Chuanneng Sun, Zeeshan Ahmed, Yingyi Ma, Zhe Liu, Lucas Kabela, Yutong Pang, Ozlem Kalinli
2024ICASSPRecovering from Privacy-Preserving Masking with Large Language Models.Arpita Vats, Zhe Liu, Peng Su, Debjyoti Paul, Yingyi Ma, Yutong Pang, Zeeshan Ahmed, Ozlem Kalinli
2024ICASSPDynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of a Multilingual ASR Model.Jiamin Xie, Ke Li, Jinxi Guo, Andros Tjandra, Yuan Shangguan, Leda Sari, Chunyang Wu, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli
2024InterspeechEvaluating Speech Recognition Performance Towards Large Language Model Based Voice Assistants.Zhe Liu, Suyoun Kim, Ozlem Kalinli
2024InterspeechTowards measuring fairness in speech recognition: Fair-Speech dataset.Irina-Elena Veliche, Zhuangqun Huang, Vineeth Ayyat Kochaniyan, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer
2024NAACLAudioChatLlama: Towards General-Purpose Speech Abilities for LLMs.Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Ke Li, Junteng Jia, Yuan Shangguan, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2023ASRUJoint Federated Learning and Personalization for on-Device ASR.Junteng Jia, Ke Li, Mani Malek, Kshitiz Malik, Jay Mahadeokar, Ozlem Kalinli, Frank Seide
2023ICASSPFactorized Blank Thresholding for Improved Runtime Efficiency of Neural Transducers.Duc Le, Frank Seide, Yuhao Wang, Yang Li, Kjell Schubert, Ozlem Kalinli, Michael L. Seltzer
2023ICASSPImproving fast-slow Encoder based Transducer with Streaming Deliberation.Ke Li, Jay Mahadeokar, Jinxi Guo, Yangyang Shi, Gil Keren, Ozlem Kalinli, Michael L. Seltzer, Duc Le
2023ICASSPAnchored Speech Recognition with Neural Transducers.Desh Raj, Junteng Jia, Jay Mahadeokar, Chunyang Wu, Niko Moritz, Xiaohui Zhang, Ozlem Kalinli
2023ICASSPMassively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities.Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer
2023ICASSPLearning ASR Pathways: A Sparse Multilingual ASR Model.Mu Yang, Andros Tjandra, Chunxi Liu, David Zhang, Duc Le, Ozlem Kalinli
2023InterspeechMulti-Head State Space Model for Speech Recognition.Yassir Fathullah, Chunyang Wu, Yuan Shangguan, Junteng Jia, Wenhan Xiong, Jay Mahadeokar, Chunxi Liu, Yangyang Shi, Ozlem Kalinli, Mike Seltzer, Mark J. F. Gales
2023InterspeechModality Confidence Aware Training for Robust End-to-End Spoken Language Understanding.Suyoun Kim, Akshat Shrivastava, Duc Le, Ju Lin, Ozlem Kalinli, Michael L. Seltzer
2022EMNLPJoint Audio/Text Training for Transformer Rescorer of Streaming Speech Recognition.Suyoun Kim, Ke Li, Lucas Kabela, Ron Huang, Jiedan Zhu, Ozlem Kalinli, Duc Le
2022ICASSPNeural-FST Class Language Model for End-to-End Speech Recognition.Antoine Bruguier, Duc Le, Rohit Prabhavalkar, Dangna Li, Zhe Liu, Bo Wang, Eun Chang, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer
2022ICASSPStreaming Transformer Transducer based Speech Recognition Using Non-Causal Convolution.Yangyang Shi, Chunyang Wu, Dilin Wang, Alex Xiao, Jay Mahadeokar, Xiaohui Zhang, Chunxi Liu, Ke Li, Yuan Shangguan, Varun Nagaraja, Ozlem Kalinli, Mike Seltzer
2022ICASSPOmni-Sparsity DNN: Fast Sparsity Optimization for On-Device Streaming E2E ASR Via Supernet.Haichuan Yang, Yuan Shangguan, Dilin Wang, Meng Li, Pierce Chuang, Xiaohui Zhang, Ganesh Venkatesh, Ozlem Kalinli, Vikas Chandra
2022InterspeechFederated Domain Adaptation for ASR with Full Self-Supervision.Junteng Jia, Jay Mahadeokar, Weiyi Zheng, Yuan Shangguan, Ozlem Kalinli, Frank Seide
2022InterspeechEvaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric.Suyoun Kim, Duc Le, Weiyi Zheng, Tarun Singh, Abhinav Arora, Xiaoyu Zhai, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechDeliberation Model for On-Device Spoken Language Understanding.Duc Le, Akshat Shrivastava, Paden D. Tomasello, Suyoun Kim, Aleksandr Livshits, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechStreaming parallel transducer beam search with fast slow cascaded encoders.Jay Mahadeokar, Yangyang Shi, Ke Li, Duc Le, Jiedan Zhu, Vikas Chandra, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechScaling ASR Improves Zero and Few Shot Learning.Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed
2021ICASSPSapAugment: Learning A Sample Adaptive Policy for Data Augmentation.Ting-Yao Hu, Ashish Shrivastava, Jen-Hao Rick Chang, Hema Koppula, Stefan Braun, Kyuyeon Hwang, Ozlem Kalinli, Oncel Tuzel
2021InterspeechSemantic Distance: A New Metric for ASR Performance Analysis Towards Spoken Language Understanding.Suyoun Kim, Abhinav Arora, Duc Le, Ching-Feng Yeh, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2021InterspeechContextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion.Duc Le, Mahaveer Jain, Gil Keren, Suyoun Kim, Yangyang Shi, Jay Mahadeokar, Julian Chan, Yuan Shangguan, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Michael L. Seltzer
2021InterspeechFlexi-Transducer: Optimizing Latency, Accuracy and Compute for Multi-Domain On-Device Scenarios.Jay Mahadeokar, Yangyang Shi, Yuan Shangguan, Chunyang Wu, Alex Xiao, Hang Su, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer
2021InterspeechCollaborative Training of Acoustic Encoders for Speech Recognition.Varun Nagaraja, Yangyang Shi, Ganesh Venkatesh, Ozlem Kalinli, Michael L. Seltzer, Vikas Chandra
2021InterspeechDissecting User-Perceived Latency of On-Device E2E Speech Recognition.Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer
2021InterspeechDynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency.Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2021InterspeechTransformer-Based Acoustic Modeling for Streaming Speech Synthesis.Chunyang Wu, Zhiping Xiu, Yangyang Shi, Ozlem Kalinli, Christian Fuegen, Thilo Khler, Qing He
2019ICASSPParametric Cepstral Mean Normalization for Robust Speech Recognition.Ozlem Kalinli, Gautam Bhattacharya, Chao Weng
2019InterspeechBandwidth Embeddings for Mixed-Bandwidth Speech Recognition.Gautam Mantena, Ozlem Kalinli, Ossama Abdel-Hamid, Don McAllaster
2016InterspeechAnalysis of Multi-Lingual Emotion Recognition Using Auditory Attention Features.Ozlem Kalinli
2015InterspeechEmotion clustering based on probabilistic linear discriminant analysis.Mahnoosh Mehrabani, Ozlem Kalinli, Ruxin Chen
2013InterspeechCombination of auditory attention features with phone posteriors for better automatic phoneme segmentation.Ozlem Kalinli
2012InterspeechAutomatic Phoneme Segmentation Using Auditory Attention Features.Ozlem Kalinli
2011ICASSPTone and pitch accent classification using auditory attention cues.Ozlem Kalinli
2011InterspeechSyllable Segmentation of Continuous Speech Using Auditory Attention Cues.Ozlem Kalinli
2009ICASSPNoise adaptive training using a vector taylor series approach for noise robust automatic speech recognition.Ozlem Kalinli, Michael L. Seltzer, Alex Acero
2009InterspeechContinuous speech recognition using attention shift decoding with soft decision.Ozlem Kalinli, Shrikanth S. Narayanan
2009MMSPSaliency-driven unstructured acoustic scene classification using latent perceptual indexing.Ozlem Kalinli, Shiva Sundaram, Shrikanth S. Narayanan
2008ICASSPA top-down auditory attention model for learning task dependent influences on prominence detection in speech.Ozlem Kalinli, Shrikanth S. Narayanan
2008InterspeechCombining task-dependent information with auditory attention cues for prominence detection in speech.Ozlem Kalinli, Shrikanth S. Narayanan
2007InterspeechA saliency-based auditory attention model with applications to unsupervised prominent syllable detection in speech.Ozlem Kalinli, Shrikanth S. Narayanan