Skip to content

Egor Lakomkin

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

12

Active years

2017–2025

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPEfficient Streaming LLM for Speech Recognition.Junteng Jia, Gil Keren, Wei Zhou, Egor Lakomkin, Xiaohui Zhang, Chunyang Wu, Frank Seide, Jay Mahadeokar, Ozlem Kalinli
2025ICASSPM-BEST-RQ: A Multi-Channel Speech Foundation Model for Smart Glasses.Yufeng Yang, Desh Raj, Ju Lin, Niko Moritz, Junteng Jia, Gil Keren, Egor Lakomkin, Yiteng Huang, Jacob Donley, Jay Mahadeokar, Ozlem Kalinli
2025ICASSPTextless Streaming Speech-to-Speech Translation using Semantic Speech Tokens.Jinzheng Zhao, Niko Moritz, Egor Lakomkin, Ruiming Xie, Zhiping Xiu, Katerina Zmolkov, Zeeshan Ahmed, Yashesh Gaur, Duc Le, Christian Fuegen
2025InterspeechFrozen Large Language Models Can Perceive Paralinguistic Aspects of Speech.Wonjune Kang, Junteng Jia, Chunyang Wu, Wei Zhou, Egor Lakomkin, Yashesh Gaur, Leda Sari, Suyoun Kim, Ke Li, Jay Mahadeokar, Ozlem Kalinli
2024ICASSPPrompting Large Language Models with Speech Recognition Abilities.Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia, Yuan Shangguan, Ke Li, Jinxi Guo, Wenhan Xiong, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2024ICASSPEnd-to-End Speech Recognition Contextualization with Large Language Models.Egor Lakomkin, Chunyang Wu, Yassir Fathullah, Ozlem Kalinli, Michael L. Seltzer, Christian Fuegen
2024NAACLAudioChatLlama: Towards General-Purpose Speech Abilities for LLMs.Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Ke Li, Junteng Jia, Yuan Shangguan, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2023CVPRSynthVSR: Scaling Up Visual Speech RecognitionWith Synthetic Supervision.Xubo Liu, Egor Lakomkin, Konstantinos Vougioukas, Pingchuan Ma, Honglie Chen, Ruiming Xie, Morrie Doulaty, Niko Moritz, Jchym Kolr, Stavros Petridis, Maja Pantic, Christian Fuegen
2023ICASSPEgocentric Audio-Visual Noise Suppression.Roshan Sharma, Weipeng He, Ju Lin, Egor Lakomkin, Yang Liu, Kaustubh Kalgaonkar
2022ICASSPBeing Greedy Does Not Hurt: Sampling Strategies for End-To-End Speech Recognition.Jahn Heymann, Egor Lakomkin, Leif Rdel
2020InterspeechSubword Regularization: An Analysis of Scalability and Generalization for End-to-End Automatic Speech Recognition.Egor Lakomkin, Jahn Heymann, Ilya Sklyar, Simon Wiesler
2019ICRAIncorporating End-to-End Speech Recognition Models for Sentiment Analysis.Egor Lakomkin, Mohammad-Ali Zamani, Cornelius Weber, Sven Magg, Stefan Wermter
2019InterspeechPredictive Auxiliary Variational Autoencoder for Representation Learning of Global Speech Characteristics.Sebastian Springenberg, Egor Lakomkin, Cornelius Weber, Stefan Wermter
2018EMNLPKT-Speech-Crawler: Automatic Dataset Construction for Speech Recognition from YouTube Videos.Egor Lakomkin, Sven Magg, Cornelius Weber, Stefan Wermter
2018ESANNImage-to-Text Transduction with Spatial Self-Attention.Sebastian Springenberg, Egor Lakomkin, Cornelius Weber, Stefan Wermter
2018ICANNCombining Articulatory Features with End-to-End Learning in Speech Recognition.Leyuan Qu, Cornelius Weber, Egor Lakomkin, Johannes Twiefel, Stefan Wermter
2018IJCNNThe OMG-Emotion Behavior Dataset.Pablo V. A. Barros, Nikhil Churamani, Egor Lakomkin, Henrique Siqueira, Alexander Sutherland, Stefan Wermter
2018ICRAEmoRL: Continuous Acoustic Emotion Classification Using Deep Reinforcement Learning.Egor Lakomkin, Mohammad-Ali Zamani, Cornelius Weber, Sven Magg, Stefan Wermter
2018IROSOn the Robustness of Speech Emotion Recognition for Human-Robot Interaction with Deep Neural Networks.Egor Lakomkin, Mohammad-Ali Zamani, Cornelius Weber, Sven Magg, Stefan Wermter
2017EACLAutomatically augmenting an emotion dataset improves classification using audio.Egor Lakomkin, Cornelius Weber, Stefan Wermter
2017IJCNLPReusing Neural Speech Representations for Auditory Emotion Recognition.Egor Lakomkin, Cornelius Weber, Sven Magg, Stefan Wermter