Skip to content

Vitaly Lavrukhin

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

28

Venues

6

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

28 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLHierarchical Policy Optimization for Simultaneous Translation of Unbounded Speech.Siqi Ouyang, Shuoyang Ding, Oleksii Hrinchuk, Vitaly Lavrukhin, Brian Yan, Boris Ginsburg, Lei Li
2025ASRUTurboBias: Universal ASR Context-Biasing powered by GPU-accelerated Phrase-Boosting Tree.Andrei Andrusenko, Vladimir Bataev, Lilit Grigoryan, Vitaly Lavrukhin, Boris Ginsburg
2025ASRUOpen Full-duplex Voice Agent with Speech-to-Speech Language Model.Edresson Casanova, Chen Chen, Kevin Hu, Ankita Pasad, Elena Rastorgueva, Seelan Lakshmi Narasimhan, Slyne Deng, Ehsan Hosseini-Asl, Piotr Zelasko, Valentin Mendelev, Subhankar Ghosh, Yifan Peng, Zhehuai Chen, Jason Li, Jagadeesh Balam, Vitaly Lavrukhin, Boris Ginsburg
2025ASRUFlexCTC: GPU-powered CTC Beam Decoding With Advanced Contextual Abilities.Lilit Grigoryan, Vladimir Bataev, Nikolay Karpov, Andrei Andrusenko, Vitaly Lavrukhin, Boris Ginsburg
2025ASRUTraining and Inference Efficiency of Encoder-Decoder Speech Models.Piotr Zelasko, Kunal Dhawan, Daniel Galvez, Krishna C. Puvvada, Ankita Pasad, Travis M. Bartley, Nithin Rao Koluguri, Ke Hu, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg
2025EMNLPExtending Automatic Machine Translation Evaluation to Book-Length Documents.Kuang-Da Wang, Shuoyang Ding, Chao-Han Huck Yang, Ping-Chun Hsieh, Wen-Chih Peng, Vitaly Lavrukhin, Boris Ginsburg
2025ICASSPTTS-Transducer: End-to-End Speech Synthesis with Neural Transducer.Vladimir Bataev, Subhankar Ghosh, Vitaly Lavrukhin, Jason Li
2025ICASSPOpen Automatic Speech Recognition Models for Classical and Modern Standard Arabic.Lilit Grigoryan, Nikolay Karpov, Enas Albasiri, Vitaly Lavrukhin, Boris Ginsburg
2025ICASSPChain-of-Thought Prompting for Speech Translation.Ke Hu, Zhehuai Chen, Chao-Han Huck Yang, Piotr Zelasko, Oleksii Hrinchuk, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg
2025ICASSPEMMeTT: Efficient Multimodal Machine Translation Training.Piotr Zelasko, Zhehuai Chen, Mengru Wang, Daniel Galvez, Oleksii Hrinchuk, Shuoyang Ding, Ke Hu, Jagadeesh Balam, Vitaly Lavrukhin, Boris Ginsburg
2025InterspeechNGPU-LM: GPU-Accelerated N-Gram Language Model for Context-Biasing in Greedy ASR Decoding.Vladimir Bataev, Andrei Andrusenko, Lilit Grigoryan, Aleksandr Laptev, Vitaly Lavrukhin, Boris Ginsburg
2025InterspeechPushing the Limits of Beam Search Decoding for Transducer-based ASR models.Lilit Grigoryan, Vladimir Bataev, Andrei Andrusenko, Hainan Xu, Vitaly Lavrukhin, Boris Ginsburg
2025InterspeechFrom Scarcity to Sufficiency: Speech Recognition Pipeline for Zero-resource Language.Nikolay Karpov, Sofia Kostandian, Nune Tadevosyan, Alexan Ayrapetyan, Andrei Andrusenko, Ara Yeroyan, Mher Yerznkanyan, Vitaly Lavrukhin
2025InterspeechGranary: Speech Recognition and Translation Dataset in 25 European Languages.Nithin Rao Koluguri, Monica Sekoyan, George Zelenfroynd, Sasha Meister, Shuoyang Ding, Sofia Kostandian, He Huang, Nikolay Karpov, Jagadeesh Balam, Vitaly Lavrukhin, Yifan Peng, Sara Papi, Marco Gaido, Alessio Brutti, Boris Ginsburg
2025InterspeechUnified Semi-Supervised Pipeline for Automatic Speech Recognition.Nune Tadevosyan, Nikolay Karpov, Andrei Andrusenko, Vitaly Lavrukhin, Ante Jukic
2025NAACLAnticipating Future with Large Language Model for Simultaneous Machine Translation.Siqi Ouyang, Oleksii Hrinchuk, Zhehuai Chen, Vitaly Lavrukhin, Jagadeesh Balam, Lei Li, Boris Ginsburg
2024ICASSPA Chat about Boring Problems: Studying GPT-Based Text Normalization.Yang Zhang, Travis M. Bartley, Mariana Graterol-Fuenmayor, Vitaly Lavrukhin, Evelina Bakhturina, Boris Ginsburg
2024InterspeechFast Context-Biasing for CTC and Transducer ASR models with CTC-based Word Spotter.Andrei Andrusenko, Aleksandr Laptev, Vladimir Bataev, Vitaly Lavrukhin, Boris Ginsburg
2024InterspeechLess is More: Accurate Speech Recognition & Translation without Web-Scale Data.Krishna C. Puvvada, Piotr Zelasko, He Huang, Oleksii Hrinchuk, Nithin Rao Koluguri, Kunal Dhawan, Somshubra Majumdar, Elena Rastorgueva, Zhehuai Chen, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg
2023ASRULibriSpeech-PC: Benchmark for Evaluation of Punctuation and Capitalization Capabilities of End-to-End ASR Models.Aleksandr Meister, Matvei Novikov, Nikolay Karpov, Evelina Bakhturina, Vitaly Lavrukhin, Boris Ginsburg
2023ICASSPConformer-Based Target-Speaker Automatic Speech Recognition For Single-Channel Audio.Yang Zhang, Krishna C. Puvvada, Vitaly Lavrukhin, Boris Ginsburg
2023InterspeechText-only domain adaptation for end-to-end ASR using integrated text-to-mel-spectrogram generator.Vladimir Bataev, Roman Korostik, Evgeny Shabalin, Vitaly Lavrukhin, Boris Ginsburg
2023InterspeechConfidence-based Ensembles of End-to-End Speech Recognition Models.Igor Gitman, Vitaly Lavrukhin, Aleksandr Laptev, Boris Ginsburg
2023InterspeechNeMo Forced Aligner and its application to word alignment for subtitle generation.Elena Rastorgueva, Vitaly Lavrukhin, Boris Ginsburg
2021InterspeechHi-Fi Multi-Speaker English TTS Dataset.Evelina Bakhturina, Vitaly Lavrukhin, Boris Ginsburg, Yang Zhang
2021InterspeechSPGISpeech: 5, 000 Hours of Transcribed Financial Audio for Fully Formatted End-to-End Speech Recognition.Patrick K. O'Neill, Vitaly Lavrukhin, Somshubra Majumdar, Vahid Noroozi, Yuekai Zhang, Oleksii Kuchaiev, Jagadeesh Balam, Yuliya Dovzhenko, Keenan Freyberg, Michael D. Shulman, Boris Ginsburg, Shinji Watanabe, Georg Kucsko
2020ICASSPQuartznet: Deep Automatic Speech Recognition with 1D Time-Channel Separable Convolutions.Samuel Kriman, Stanislav Beliaev, Boris Ginsburg, Jocelyn Huang, Oleksii Kuchaiev, Vitaly Lavrukhin, Ryan Leary, Jason Li, Yang Zhang
2019InterspeechJasper: An End-to-End Convolutional Neural Acoustic Model.Jason Li, Vitaly Lavrukhin, Boris Ginsburg, Ryan Leary, Oleksii Kuchaiev, Jonathan M. Cohen, Huyen Nguyen, Ravi Teja Gadde