Nithin Rao Koluguri
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
18
Venues
4
Active years
2019–2025
Best venue rank
A*
Where they publish
Papers
18 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASRU | Training and Inference Efficiency of Encoder-Decoder Speech Models. | Piotr Zelasko, Kunal Dhawan, Daniel Galvez, Krishna C. Puvvada, Ankita Pasad, Travis M. Bartley, Nithin Rao Koluguri, Ke Hu, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg |
| 2025 | ICASSP | NEST: Self-supervised Fast Conformer as All-purpose Seasoning to Speech Processing Tasks. | He Huang, Taejin Park, Kunal Dhawan, Ivan Medennikov, Krishna C. Puvvada, Nithin Rao Koluguri, Weiqing Wang, Jagadeesh Balam, Boris Ginsburg |
| 2025 | ICASSP | META-CAT: Speaker-Informed Speech Embeddings via Meta Information Concatenation for Multi-talker ASR. | Jinhan Wang, Weiqing Wang, Kunal Dhawan, Taejin Park, Myungjong Kim, Ivan Medennikov, He Huang, Nithin Rao Koluguri, Jagadeesh Balam, Boris Ginsburg |
| 2025 | ICML | Sortformer: A Novel Approach for Permutation-Resolved Speaker Supervision in Speech-to-Text Systems. | Taejin Park, Ivan Medennikov, Kunal Dhawan, Weiqing Wang, He Huang, Nithin Rao Koluguri, Krishna C. Puvvada, Jagadeesh Balam, Boris Ginsburg |
| 2025 | Interspeech | Granary: Speech Recognition and Translation Dataset in 25 European Languages. | Nithin Rao Koluguri, Monica Sekoyan, George Zelenfroynd, Sasha Meister, Shuoyang Ding, Sofia Kostandian, He Huang, Nikolay Karpov, Jagadeesh Balam, Vitaly Lavrukhin, Yifan Peng, Sara Papi, Marco Gaido, Alessio Brutti, Boris Ginsburg |
| 2025 | Interspeech | Speaker Targeting via Self-Speaker Adaptation for Multi-talker ASR. | Weiqing Wang, Taejin Park, Ivan Medennikov, Jinhan Wang, Kunal Dhawan, He Huang, Nithin Rao Koluguri, Jagadeesh Balam, Boris Ginsburg |
| 2024 | ICASSP | Investigating End-to-End ASR Architectures for Long Form Audio Transcription. | Nithin Rao Koluguri, Samuel Kriman, Georgy Zelenfroind, Somshubra Majumdar, Dima Rekesh, Vahid Noroozi, Jagadeesh Balam, Boris Ginsburg |
| 2024 | ICASSP | Enhancing Speaker Diarization with Large Language Models: A Contextual Beam Search Approach. | Taejin Park, Kunal Dhawan, Nithin Rao Koluguri, Jagadeesh Balam |
| 2024 | ICASSP | Discrete Audio Representation as an Alternative to Mel-Spectrograms for Speaker and Speech Recognition. | Krishna C. Puvvada, Nithin Rao Koluguri, Kunal Dhawan, Jagadeesh Balam, Boris Ginsburg |
| 2024 | Interspeech | Codec-ASR: Training Performant Automatic Speech Recognition Systems with Discrete Speech Representations. | Kunal Dhawan, Nithin Rao Koluguri, Ante Jukic, Ryan Langman, Jagadeesh Balam, Boris Ginsburg |
| 2024 | Interspeech | Less is More: Accurate Speech Recognition & Translation without Web-Scale Data. | Krishna C. Puvvada, Piotr Zelasko, He Huang, Oleksii Hrinchuk, Nithin Rao Koluguri, Kunal Dhawan, Somshubra Majumdar, Elena Rastorgueva, Zhehuai Chen, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg |
| 2023 | ASRU | Fast Conformer With Linearly Scalable Attention For Efficient Speech Recognition. | Dima Rekesh, Nithin Rao Koluguri, Samuel Kriman, Somshubra Majumdar, Vahid Noroozi, He Huang, Oleksii Hrinchuk, Krishna C. Puvvada, Ankur Kumar, Jagadeesh Balam, Boris Ginsburg |
| 2023 | Interspeech | A Compact End-to-End Model with Local and Global Context for Spoken Language Identification. | Fei Jia, Nithin Rao Koluguri, Jagadeesh Balam, Boris Ginsburg |
| 2022 | ICASSP | TitaNet: Neural Model for Speaker Representation with 1D Depth-Wise Separable Convolutions and Global Context. | Nithin Rao Koluguri, Taejin Park, Boris Ginsburg |
| 2022 | Interspeech | Multi-scale Speaker Diarization with Dynamic Scale Weighting. | Taejin Park, Nithin Rao Koluguri, Jagadeesh Balam, Boris Ginsburg |
| 2022 | Interspeech | NeMo Open Source Speaker Diarization System. | Taejin Park, Nithin Rao Koluguri, Fei Jia, Jagadeesh Balam, Boris Ginsburg |
| 2020 | ICASSP | Meta-Learning for Robust Child-Adult Classification from Speech. | Nithin Rao Koluguri, Manoj Kumar, So Hyun Kim, Catherine Lord, Shrikanth Narayanan |
| 2019 | Interspeech | Comparison of Speech Tasks and Recording Devices for Voice Based Automatic Classification of Healthy Subjects and Patients with Amyotrophic Lateral Sclerosis. | Suhas B. N., Deep Patel, Nithin Rao Koluguri, Yamini Belur, Pradeep Reddy, Atchayaram Nalini, Ravi Yadav, Dipanjan Gope, Prasanta Kumar Ghosh |