Vitaly Lavrukhin
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
28
Venues
6
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
28 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Hierarchical Policy Optimization for Simultaneous Translation of Unbounded Speech. | Siqi Ouyang, Shuoyang Ding, Oleksii Hrinchuk, Vitaly Lavrukhin, Brian Yan, Boris Ginsburg, Lei Li |
| 2025 | ASRU | TurboBias: Universal ASR Context-Biasing powered by GPU-accelerated Phrase-Boosting Tree. | Andrei Andrusenko, Vladimir Bataev, Lilit Grigoryan, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | ASRU | Open Full-duplex Voice Agent with Speech-to-Speech Language Model. | Edresson Casanova, Chen Chen, Kevin Hu, Ankita Pasad, Elena Rastorgueva, Seelan Lakshmi Narasimhan, Slyne Deng, Ehsan Hosseini-Asl, Piotr Zelasko, Valentin Mendelev, Subhankar Ghosh, Yifan Peng, Zhehuai Chen, Jason Li, Jagadeesh Balam, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | ASRU | FlexCTC: GPU-powered CTC Beam Decoding With Advanced Contextual Abilities. | Lilit Grigoryan, Vladimir Bataev, Nikolay Karpov, Andrei Andrusenko, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | ASRU | Training and Inference Efficiency of Encoder-Decoder Speech Models. | Piotr Zelasko, Kunal Dhawan, Daniel Galvez, Krishna C. Puvvada, Ankita Pasad, Travis M. Bartley, Nithin Rao Koluguri, Ke Hu, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg |
| 2025 | EMNLP | Extending Automatic Machine Translation Evaluation to Book-Length Documents. | Kuang-Da Wang, Shuoyang Ding, Chao-Han Huck Yang, Ping-Chun Hsieh, Wen-Chih Peng, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | ICASSP | TTS-Transducer: End-to-End Speech Synthesis with Neural Transducer. | Vladimir Bataev, Subhankar Ghosh, Vitaly Lavrukhin, Jason Li |
| 2025 | ICASSP | Open Automatic Speech Recognition Models for Classical and Modern Standard Arabic. | Lilit Grigoryan, Nikolay Karpov, Enas Albasiri, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | ICASSP | Chain-of-Thought Prompting for Speech Translation. | Ke Hu, Zhehuai Chen, Chao-Han Huck Yang, Piotr Zelasko, Oleksii Hrinchuk, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg |
| 2025 | ICASSP | EMMeTT: Efficient Multimodal Machine Translation Training. | Piotr Zelasko, Zhehuai Chen, Mengru Wang, Daniel Galvez, Oleksii Hrinchuk, Shuoyang Ding, Ke Hu, Jagadeesh Balam, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | Interspeech | NGPU-LM: GPU-Accelerated N-Gram Language Model for Context-Biasing in Greedy ASR Decoding. | Vladimir Bataev, Andrei Andrusenko, Lilit Grigoryan, Aleksandr Laptev, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | Interspeech | Pushing the Limits of Beam Search Decoding for Transducer-based ASR models. | Lilit Grigoryan, Vladimir Bataev, Andrei Andrusenko, Hainan Xu, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | Interspeech | From Scarcity to Sufficiency: Speech Recognition Pipeline for Zero-resource Language. | Nikolay Karpov, Sofia Kostandian, Nune Tadevosyan, Alexan Ayrapetyan, Andrei Andrusenko, Ara Yeroyan, Mher Yerznkanyan, Vitaly Lavrukhin |
| 2025 | Interspeech | Granary: Speech Recognition and Translation Dataset in 25 European Languages. | Nithin Rao Koluguri, Monica Sekoyan, George Zelenfroynd, Sasha Meister, Shuoyang Ding, Sofia Kostandian, He Huang, Nikolay Karpov, Jagadeesh Balam, Vitaly Lavrukhin, Yifan Peng, Sara Papi, Marco Gaido, Alessio Brutti, Boris Ginsburg |
| 2025 | Interspeech | Unified Semi-Supervised Pipeline for Automatic Speech Recognition. | Nune Tadevosyan, Nikolay Karpov, Andrei Andrusenko, Vitaly Lavrukhin, Ante Jukic |
| 2025 | NAACL | Anticipating Future with Large Language Model for Simultaneous Machine Translation. | Siqi Ouyang, Oleksii Hrinchuk, Zhehuai Chen, Vitaly Lavrukhin, Jagadeesh Balam, Lei Li, Boris Ginsburg |
| 2024 | ICASSP | A Chat about Boring Problems: Studying GPT-Based Text Normalization. | Yang Zhang, Travis M. Bartley, Mariana Graterol-Fuenmayor, Vitaly Lavrukhin, Evelina Bakhturina, Boris Ginsburg |
| 2024 | Interspeech | Fast Context-Biasing for CTC and Transducer ASR models with CTC-based Word Spotter. | Andrei Andrusenko, Aleksandr Laptev, Vladimir Bataev, Vitaly Lavrukhin, Boris Ginsburg |
| 2024 | Interspeech | Less is More: Accurate Speech Recognition & Translation without Web-Scale Data. | Krishna C. Puvvada, Piotr Zelasko, He Huang, Oleksii Hrinchuk, Nithin Rao Koluguri, Kunal Dhawan, Somshubra Majumdar, Elena Rastorgueva, Zhehuai Chen, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg |
| 2023 | ASRU | LibriSpeech-PC: Benchmark for Evaluation of Punctuation and Capitalization Capabilities of End-to-End ASR Models. | Aleksandr Meister, Matvei Novikov, Nikolay Karpov, Evelina Bakhturina, Vitaly Lavrukhin, Boris Ginsburg |
| 2023 | ICASSP | Conformer-Based Target-Speaker Automatic Speech Recognition For Single-Channel Audio. | Yang Zhang, Krishna C. Puvvada, Vitaly Lavrukhin, Boris Ginsburg |
| 2023 | Interspeech | Text-only domain adaptation for end-to-end ASR using integrated text-to-mel-spectrogram generator. | Vladimir Bataev, Roman Korostik, Evgeny Shabalin, Vitaly Lavrukhin, Boris Ginsburg |
| 2023 | Interspeech | Confidence-based Ensembles of End-to-End Speech Recognition Models. | Igor Gitman, Vitaly Lavrukhin, Aleksandr Laptev, Boris Ginsburg |
| 2023 | Interspeech | NeMo Forced Aligner and its application to word alignment for subtitle generation. | Elena Rastorgueva, Vitaly Lavrukhin, Boris Ginsburg |
| 2021 | Interspeech | Hi-Fi Multi-Speaker English TTS Dataset. | Evelina Bakhturina, Vitaly Lavrukhin, Boris Ginsburg, Yang Zhang |
| 2021 | Interspeech | SPGISpeech: 5, 000 Hours of Transcribed Financial Audio for Fully Formatted End-to-End Speech Recognition. | Patrick K. O'Neill, Vitaly Lavrukhin, Somshubra Majumdar, Vahid Noroozi, Yuekai Zhang, Oleksii Kuchaiev, Jagadeesh Balam, Yuliya Dovzhenko, Keenan Freyberg, Michael D. Shulman, Boris Ginsburg, Shinji Watanabe, Georg Kucsko |
| 2020 | ICASSP | Quartznet: Deep Automatic Speech Recognition with 1D Time-Channel Separable Convolutions. | Samuel Kriman, Stanislav Beliaev, Boris Ginsburg, Jocelyn Huang, Oleksii Kuchaiev, Vitaly Lavrukhin, Ryan Leary, Jason Li, Yang Zhang |
| 2019 | Interspeech | Jasper: An End-to-End Convolutional Neural Acoustic Model. | Jason Li, Vitaly Lavrukhin, Boris Ginsburg, Ryan Leary, Oleksii Kuchaiev, Jonathan M. Cohen, Huyen Nguyen, Ravi Teja Gadde |