Egor Lakomkin
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
12
Active years
2017–2025
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Efficient Streaming LLM for Speech Recognition. | Junteng Jia, Gil Keren, Wei Zhou, Egor Lakomkin, Xiaohui Zhang, Chunyang Wu, Frank Seide, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | ICASSP | M-BEST-RQ: A Multi-Channel Speech Foundation Model for Smart Glasses. | Yufeng Yang, Desh Raj, Ju Lin, Niko Moritz, Junteng Jia, Gil Keren, Egor Lakomkin, Yiteng Huang, Jacob Donley, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | ICASSP | Textless Streaming Speech-to-Speech Translation using Semantic Speech Tokens. | Jinzheng Zhao, Niko Moritz, Egor Lakomkin, Ruiming Xie, Zhiping Xiu, Katerina Zmolkov, Zeeshan Ahmed, Yashesh Gaur, Duc Le, Christian Fuegen |
| 2025 | Interspeech | Frozen Large Language Models Can Perceive Paralinguistic Aspects of Speech. | Wonjune Kang, Junteng Jia, Chunyang Wu, Wei Zhou, Egor Lakomkin, Yashesh Gaur, Leda Sari, Suyoun Kim, Ke Li, Jay Mahadeokar, Ozlem Kalinli |
| 2024 | ICASSP | Prompting Large Language Models with Speech Recognition Abilities. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia, Yuan Shangguan, Ke Li, Jinxi Guo, Wenhan Xiong, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | End-to-End Speech Recognition Contextualization with Large Language Models. | Egor Lakomkin, Chunyang Wu, Yassir Fathullah, Ozlem Kalinli, Michael L. Seltzer, Christian Fuegen |
| 2024 | NAACL | AudioChatLlama: Towards General-Purpose Speech Abilities for LLMs. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Ke Li, Junteng Jia, Yuan Shangguan, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2023 | CVPR | SynthVSR: Scaling Up Visual Speech RecognitionWith Synthetic Supervision. | Xubo Liu, Egor Lakomkin, Konstantinos Vougioukas, Pingchuan Ma, Honglie Chen, Ruiming Xie, Morrie Doulaty, Niko Moritz, Jchym Kolr, Stavros Petridis, Maja Pantic, Christian Fuegen |
| 2023 | ICASSP | Egocentric Audio-Visual Noise Suppression. | Roshan Sharma, Weipeng He, Ju Lin, Egor Lakomkin, Yang Liu, Kaustubh Kalgaonkar |
| 2022 | ICASSP | Being Greedy Does Not Hurt: Sampling Strategies for End-To-End Speech Recognition. | Jahn Heymann, Egor Lakomkin, Leif Rdel |
| 2020 | Interspeech | Subword Regularization: An Analysis of Scalability and Generalization for End-to-End Automatic Speech Recognition. | Egor Lakomkin, Jahn Heymann, Ilya Sklyar, Simon Wiesler |
| 2019 | ICRA | Incorporating End-to-End Speech Recognition Models for Sentiment Analysis. | Egor Lakomkin, Mohammad-Ali Zamani, Cornelius Weber, Sven Magg, Stefan Wermter |
| 2019 | Interspeech | Predictive Auxiliary Variational Autoencoder for Representation Learning of Global Speech Characteristics. | Sebastian Springenberg, Egor Lakomkin, Cornelius Weber, Stefan Wermter |
| 2018 | EMNLP | KT-Speech-Crawler: Automatic Dataset Construction for Speech Recognition from YouTube Videos. | Egor Lakomkin, Sven Magg, Cornelius Weber, Stefan Wermter |
| 2018 | ESANN | Image-to-Text Transduction with Spatial Self-Attention. | Sebastian Springenberg, Egor Lakomkin, Cornelius Weber, Stefan Wermter |
| 2018 | ICANN | Combining Articulatory Features with End-to-End Learning in Speech Recognition. | Leyuan Qu, Cornelius Weber, Egor Lakomkin, Johannes Twiefel, Stefan Wermter |
| 2018 | IJCNN | The OMG-Emotion Behavior Dataset. | Pablo V. A. Barros, Nikhil Churamani, Egor Lakomkin, Henrique Siqueira, Alexander Sutherland, Stefan Wermter |
| 2018 | ICRA | EmoRL: Continuous Acoustic Emotion Classification Using Deep Reinforcement Learning. | Egor Lakomkin, Mohammad-Ali Zamani, Cornelius Weber, Sven Magg, Stefan Wermter |
| 2018 | IROS | On the Robustness of Speech Emotion Recognition for Human-Robot Interaction with Deep Neural Networks. | Egor Lakomkin, Mohammad-Ali Zamani, Cornelius Weber, Sven Magg, Stefan Wermter |
| 2017 | EACL | Automatically augmenting an emotion dataset improves classification using audio. | Egor Lakomkin, Cornelius Weber, Stefan Wermter |
| 2017 | IJCNLP | Reusing Neural Speech Representations for Auditory Emotion Recognition. | Egor Lakomkin, Cornelius Weber, Sven Magg, Stefan Wermter |