Ozlem Kalinli
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
58
Venues
6
Active years
2007–2025
Best venue rank
A*
Where they publish
Papers
58 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Transducer-Llama: Integrating LLMs into Streamable Transducer-based Speech Recognition. | Keqi Deng, Jinxi Guo, Yingyi Ma, Niko Moritz, Philip C. Woodland, Ozlem Kalinli, Mike Seltzer |
| 2025 | ICASSP | Efficient Streaming LLM for Speech Recognition. | Junteng Jia, Gil Keren, Wei Zhou, Egor Lakomkin, Xiaohui Zhang, Chunyang Wu, Frank Seide, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | ICASSP | Faster Speech-LLaMA Inference with Multi-token Prediction. | Desh Raj, Gil Keren, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | ICASSP | Speech-N-LlaMA: Improving Speech LLMs with Multi-Pass Training. | Amit Kumar Singh Yadav, Gil Keren, Desh Raj, Wei Zhou, Junteng Jia, Ke Li, Ying Xu, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | ICASSP | M-BEST-RQ: A Multi-Channel Speech Foundation Model for Smart Glasses. | Yufeng Yang, Desh Raj, Ju Lin, Niko Moritz, Junteng Jia, Gil Keren, Egor Lakomkin, Yiteng Huang, Jacob Donley, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | ICASSP | CJST: CTC Compressor based Joint Speech and Text Training for Decoder-Only ASR. | Wei Zhou, Junteng Jia, Leda Sari, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | Interspeech | Frozen Large Language Models Can Perceive Paralinguistic Aspects of Speech. | Wonjune Kang, Junteng Jia, Chunyang Wu, Wei Zhou, Egor Lakomkin, Yashesh Gaur, Leda Sari, Suyoun Kim, Ke Li, Jay Mahadeokar, Ozlem Kalinli |
| 2024 | ICASSP | Forgetting Private Textual Sequences in Language Models Via Leave-One-Out Ensemble. | Zhe Liu, Ozlem Kalinli |
| 2024 | ICASSP | Prompting Large Language Models with Speech Recognition Abilities. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia, Yuan Shangguan, Ke Li, Jinxi Guo, Wenhan Xiong, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | Effective Internal Language Model Training and Fusion for Factorized Transducer Model. | Jinxi Guo, Niko Moritz, Yingyi Ma, Frank Seide, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | End-to-End Speech Recognition Contextualization with Large Language Models. | Egor Lakomkin, Chunyang Wu, Yassir Fathullah, Ozlem Kalinli, Michael L. Seltzer, Christian Fuegen |
| 2024 | ICASSP | Correction Focused Language Model Training For Speech Recognition. | Yingyi Ma, Zhe Liu, Ozlem Kalinli |
| 2024 | ICASSP | TODM: Train Once Deploy Many Efficient Supernet-Based RNN-T Compression For On-Device ASR Models. | Yuan Shangguan, Haichuan Yang, Danni Li, Chunyang Wu, Yassir Fathullah, Dilin Wang, Ayushi Dalmia, Raghuraman Krishnamoorthi, Ozlem Kalinli, Junteng Jia, Jay Mahadeokar, Xin Lei, Mike Seltzer, Vikas Chandra |
| 2024 | ICASSP | Contextual Biasing of Named-Entities with Large Language Models. | Chuanneng Sun, Zeeshan Ahmed, Yingyi Ma, Zhe Liu, Lucas Kabela, Yutong Pang, Ozlem Kalinli |
| 2024 | ICASSP | Recovering from Privacy-Preserving Masking with Large Language Models. | Arpita Vats, Zhe Liu, Peng Su, Debjyoti Paul, Yingyi Ma, Yutong Pang, Zeeshan Ahmed, Ozlem Kalinli |
| 2024 | ICASSP | Dynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of a Multilingual ASR Model. | Jiamin Xie, Ke Li, Jinxi Guo, Andros Tjandra, Yuan Shangguan, Leda Sari, Chunyang Wu, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli |
| 2024 | Interspeech | Evaluating Speech Recognition Performance Towards Large Language Model Based Voice Assistants. | Zhe Liu, Suyoun Kim, Ozlem Kalinli |
| 2024 | Interspeech | Towards measuring fairness in speech recognition: Fair-Speech dataset. | Irina-Elena Veliche, Zhuangqun Huang, Vineeth Ayyat Kochaniyan, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer |
| 2024 | NAACL | AudioChatLlama: Towards General-Purpose Speech Abilities for LLMs. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Ke Li, Junteng Jia, Yuan Shangguan, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2023 | ASRU | Joint Federated Learning and Personalization for on-Device ASR. | Junteng Jia, Ke Li, Mani Malek, Kshitiz Malik, Jay Mahadeokar, Ozlem Kalinli, Frank Seide |
| 2023 | ICASSP | Factorized Blank Thresholding for Improved Runtime Efficiency of Neural Transducers. | Duc Le, Frank Seide, Yuhao Wang, Yang Li, Kjell Schubert, Ozlem Kalinli, Michael L. Seltzer |
| 2023 | ICASSP | Improving fast-slow Encoder based Transducer with Streaming Deliberation. | Ke Li, Jay Mahadeokar, Jinxi Guo, Yangyang Shi, Gil Keren, Ozlem Kalinli, Michael L. Seltzer, Duc Le |
| 2023 | ICASSP | Anchored Speech Recognition with Neural Transducers. | Desh Raj, Junteng Jia, Jay Mahadeokar, Chunyang Wu, Niko Moritz, Xiaohui Zhang, Ozlem Kalinli |
| 2023 | ICASSP | Massively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities. | Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer |
| 2023 | ICASSP | Learning ASR Pathways: A Sparse Multilingual ASR Model. | Mu Yang, Andros Tjandra, Chunxi Liu, David Zhang, Duc Le, Ozlem Kalinli |
| 2023 | Interspeech | Multi-Head State Space Model for Speech Recognition. | Yassir Fathullah, Chunyang Wu, Yuan Shangguan, Junteng Jia, Wenhan Xiong, Jay Mahadeokar, Chunxi Liu, Yangyang Shi, Ozlem Kalinli, Mike Seltzer, Mark J. F. Gales |
| 2023 | Interspeech | Modality Confidence Aware Training for Robust End-to-End Spoken Language Understanding. | Suyoun Kim, Akshat Shrivastava, Duc Le, Ju Lin, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | EMNLP | Joint Audio/Text Training for Transformer Rescorer of Streaming Speech Recognition. | Suyoun Kim, Ke Li, Lucas Kabela, Ron Huang, Jiedan Zhu, Ozlem Kalinli, Duc Le |
| 2022 | ICASSP | Neural-FST Class Language Model for End-to-End Speech Recognition. | Antoine Bruguier, Duc Le, Rohit Prabhavalkar, Dangna Li, Zhe Liu, Bo Wang, Eun Chang, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | ICASSP | Streaming Transformer Transducer based Speech Recognition Using Non-Causal Convolution. | Yangyang Shi, Chunyang Wu, Dilin Wang, Alex Xiao, Jay Mahadeokar, Xiaohui Zhang, Chunxi Liu, Ke Li, Yuan Shangguan, Varun Nagaraja, Ozlem Kalinli, Mike Seltzer |
| 2022 | ICASSP | Omni-Sparsity DNN: Fast Sparsity Optimization for On-Device Streaming E2E ASR Via Supernet. | Haichuan Yang, Yuan Shangguan, Dilin Wang, Meng Li, Pierce Chuang, Xiaohui Zhang, Ganesh Venkatesh, Ozlem Kalinli, Vikas Chandra |
| 2022 | Interspeech | Federated Domain Adaptation for ASR with Full Self-Supervision. | Junteng Jia, Jay Mahadeokar, Weiyi Zheng, Yuan Shangguan, Ozlem Kalinli, Frank Seide |
| 2022 | Interspeech | Evaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric. | Suyoun Kim, Duc Le, Weiyi Zheng, Tarun Singh, Abhinav Arora, Xiaoyu Zhai, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Deliberation Model for On-Device Spoken Language Understanding. | Duc Le, Akshat Shrivastava, Paden D. Tomasello, Suyoun Kim, Aleksandr Livshits, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Streaming parallel transducer beam search with fast slow cascaded encoders. | Jay Mahadeokar, Yangyang Shi, Ke Li, Duc Le, Jiedan Zhu, Vikas Chandra, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Scaling ASR Improves Zero and Few Shot Learning. | Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed |
| 2021 | ICASSP | SapAugment: Learning A Sample Adaptive Policy for Data Augmentation. | Ting-Yao Hu, Ashish Shrivastava, Jen-Hao Rick Chang, Hema Koppula, Stefan Braun, Kyuyeon Hwang, Ozlem Kalinli, Oncel Tuzel |
| 2021 | Interspeech | Semantic Distance: A New Metric for ASR Performance Analysis Towards Spoken Language Understanding. | Suyoun Kim, Abhinav Arora, Duc Le, Ching-Feng Yeh, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2021 | Interspeech | Contextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion. | Duc Le, Mahaveer Jain, Gil Keren, Suyoun Kim, Yangyang Shi, Jay Mahadeokar, Julian Chan, Yuan Shangguan, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Michael L. Seltzer |
| 2021 | Interspeech | Flexi-Transducer: Optimizing Latency, Accuracy and Compute for Multi-Domain On-Device Scenarios. | Jay Mahadeokar, Yangyang Shi, Yuan Shangguan, Chunyang Wu, Alex Xiao, Hang Su, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer |
| 2021 | Interspeech | Collaborative Training of Acoustic Encoders for Speech Recognition. | Varun Nagaraja, Yangyang Shi, Ganesh Venkatesh, Ozlem Kalinli, Michael L. Seltzer, Vikas Chandra |
| 2021 | Interspeech | Dissecting User-Perceived Latency of On-Device E2E Speech Recognition. | Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer |
| 2021 | Interspeech | Dynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency. | Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2021 | Interspeech | Transformer-Based Acoustic Modeling for Streaming Speech Synthesis. | Chunyang Wu, Zhiping Xiu, Yangyang Shi, Ozlem Kalinli, Christian Fuegen, Thilo Khler, Qing He |
| 2019 | ICASSP | Parametric Cepstral Mean Normalization for Robust Speech Recognition. | Ozlem Kalinli, Gautam Bhattacharya, Chao Weng |
| 2019 | Interspeech | Bandwidth Embeddings for Mixed-Bandwidth Speech Recognition. | Gautam Mantena, Ozlem Kalinli, Ossama Abdel-Hamid, Don McAllaster |
| 2016 | Interspeech | Analysis of Multi-Lingual Emotion Recognition Using Auditory Attention Features. | Ozlem Kalinli |
| 2015 | Interspeech | Emotion clustering based on probabilistic linear discriminant analysis. | Mahnoosh Mehrabani, Ozlem Kalinli, Ruxin Chen |
| 2013 | Interspeech | Combination of auditory attention features with phone posteriors for better automatic phoneme segmentation. | Ozlem Kalinli |
| 2012 | Interspeech | Automatic Phoneme Segmentation Using Auditory Attention Features. | Ozlem Kalinli |
| 2011 | ICASSP | Tone and pitch accent classification using auditory attention cues. | Ozlem Kalinli |
| 2011 | Interspeech | Syllable Segmentation of Continuous Speech Using Auditory Attention Cues. | Ozlem Kalinli |
| 2009 | ICASSP | Noise adaptive training using a vector taylor series approach for noise robust automatic speech recognition. | Ozlem Kalinli, Michael L. Seltzer, Alex Acero |
| 2009 | Interspeech | Continuous speech recognition using attention shift decoding with soft decision. | Ozlem Kalinli, Shrikanth S. Narayanan |
| 2009 | MMSP | Saliency-driven unstructured acoustic scene classification using latent perceptual indexing. | Ozlem Kalinli, Shiva Sundaram, Shrikanth S. Narayanan |
| 2008 | ICASSP | A top-down auditory attention model for learning task dependent influences on prominence detection in speech. | Ozlem Kalinli, Shrikanth S. Narayanan |
| 2008 | Interspeech | Combining task-dependent information with auditory attention cues for prominence detection in speech. | Ozlem Kalinli, Shrikanth S. Narayanan |
| 2007 | Interspeech | A saliency-based auditory attention model with applications to unsupervised prominent syllable detection in speech. | Ozlem Kalinli, Shrikanth S. Narayanan |