Skip to content

Christian Fuegen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

35

Venues

4

Active years

2018–2025

Best venue rank

A*

Where they publish

Papers

35 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPTranscribing and Translating, Fast and Slow: Joint Speech Translation and Recognition.Niko Moritz, Ruiming Xie, Yashesh Gaur, Ke Li, Simone Merello, Zeeshan Ahmed, Frank Seide, Christian Fuegen
2025ICASSPTextless Streaming Speech-to-Speech Translation using Semantic Speech Tokens.Jinzheng Zhao, Niko Moritz, Egor Lakomkin, Ruiming Xie, Zhiping Xiu, Katerina Zmolkov, Zeeshan Ahmed, Yashesh Gaur, Duc Le, Christian Fuegen
2024ICASSPPrompting Large Language Models with Speech Recognition Abilities.Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia, Yuan Shangguan, Ke Li, Jinxi Guo, Wenhan Xiong, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2024ICASSPEffective Internal Language Model Training and Fusion for Factorized Transducer Model.Jinxi Guo, Niko Moritz, Yingyi Ma, Frank Seide, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2024ICASSPEnd-to-End Speech Recognition Contextualization with Large Language Models.Egor Lakomkin, Chunyang Wu, Yassir Fathullah, Ozlem Kalinli, Michael L. Seltzer, Christian Fuegen
2024ICASSPAGADIR: Towards Array-Geometry Agnostic Directional Speech Recognition.Ju Lin, Niko Moritz, Yiteng Huang, Ruiming Xie, Ming Sun, Christian Fuegen, Frank Seide
2024NAACLAudioChatLlama: Towards General-Purpose Speech Abilities for LLMs.Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Ke Li, Junteng Jia, Yuan Shangguan, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer
2023CVPRSynthVSR: Scaling Up Visual Speech RecognitionWith Synthetic Supervision.Xubo Liu, Egor Lakomkin, Konstantinos Vougioukas, Pingchuan Ma, Honglie Chen, Ruiming Xie, Morrie Doulaty, Niko Moritz, Jchym Kolr, Stavros Petridis, Maja Pantic, Christian Fuegen
2023InterspeechStreaming Audio-Visual Speech Recognition with Alignment Regularization.Pingchuan Ma, Niko Moritz, Stavros Petridis, Christian Fuegen, Maja Pantic
2023InterspeechDirectional Speech Recognition for Speaker Disambiguation and Cross-talk Suppression.Ju Lin, Niko Moritz, Ruiming Xie, Kaustubh Kalgaonkar, Christian Fuegen, Frank Seide
2022CVPREgo4D: Around the World in 3, 000 Hours of Egocentric Video.Kristen Grauman, Andrew Westbury, Eugene Byrne, Zachary Chavis, Antonino Furnari, Rohit Girdhar, Jackson Hamburger, Hao Jiang, Miao Liu, Xingyu Liu, Miguel Martin, Tushar Nagarajan, Ilija Radosavovic, Santhosh Kumar Ramakrishnan, Fiona Ryan, Jayant Sharma, Michael Wray, Mengmeng Xu, Eric Zhongcong Xu, Chen Zhao, Siddhant Bansal, Dhruv Batra, Vincent Cartillier, Sean Crane, Tien Do, Morrie Doulaty, Akshay Erapalli, Christoph Feichtenhofer, Adriano Fragomeni, Qichen Fu, Abrham Gebreselasie, Cristina Gonzlez, James Hillis, Xuhua Huang, Yifei Huang, Wenqi Jia, Weslie Khoo, Jchym Kolr, Satwik Kottur, Anurag Kumar, Federico Landini, Chao Li, Yanghao Li, Zhenqiang Li, Karttikeya Mangalam, Raghava Modhugu, Jonathan Munro, Tullie Murrell, Takumi Nishiyasu, Will Price, Paola Ruiz Puentes, Merey Ramazanova, Leda Sari, Kiran K. Somasundaram, Audrey Southerland, Yusuke Sugano, Ruijie Tao, Minh Vo, Yuchen Wang, Xindi Wu, Takuma Yagi, Ziwei Zhao, Yunyi Zhu, Pablo Arbelez, David Crandall, Dima Damen, Giovanni Maria Farinella, Christian Fuegen, Bernard Ghanem, Vamsi Krishna Ithapu, C. V. Jawahar, Hanbyul Joo, Kris Kitani, Haizhou Li, Richard A. Newcombe, Aude Oliva, Hyun Soo Park, James M. Rehg, Yoichi Sato, Jianbo Shi, Mike Zheng Shou, Antonio Torralba, Lorenzo Torresani, Mingfei Yan, Jitendra Malik
2022InterspeechEvaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric.Suyoun Kim, Duc Le, Weiyi Zheng, Tarun Singh, Abhinav Arora, Xiaoyu Zhai, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechScaling ASR Improves Zero and Few Shot Learning.Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed
2021ICASSPImproved Neural Language Model Fusion for Streaming Recurrent Neural Network Transducer.Suyoun Kim, Yuan Shangguan, Jay Mahadeokar, Antoine Bruguier, Christian Fuegen, Michael L. Seltzer, Duc Le
2021ICASSPA Time-Domain Convolutional Recurrent Network for Packet Loss Concealment.Ju Lin, Yun Wang, Kaustubh Kalgaonkar, Gil Keren, Didi Zhang, Christian Fuegen
2021ICASSPMemory-Efficient Speech Recognition on Smart Devices.Ganesh Venkatesh, Alagappan Valliappan, Jay Mahadeokar, Yuan Shangguan, Christian Fuegen, Michael L. Seltzer, Vikas Chandra
2021ICASSPContrastive Semi-Supervised Learning for ASR.Alex Xiao, Christian Fuegen, Abdelrahman Mohamed
2021InterspeechDo Sound Event Representations Generalize to Other Audio Tasks? A Case Study in Audio Transfer Learning.Anurag Kumar, Yun Wang, Vamsi Krishna Ithapu, Christian Fuegen
2021InterspeechSemantic Distance: A New Metric for ASR Performance Analysis Towards Spoken Language Understanding.Suyoun Kim, Abhinav Arora, Duc Le, Ching-Feng Yeh, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2021InterspeechContextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion.Duc Le, Mahaveer Jain, Gil Keren, Suyoun Kim, Yangyang Shi, Jay Mahadeokar, Julian Chan, Yuan Shangguan, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Michael L. Seltzer
2021InterspeechA Two-Stage Approach to Speech Bandwidth Extension.Ju Lin, Yun Wang, Kaustubh Kalgaonkar, Gil Keren, Didi Zhang, Christian Fuegen
2021InterspeechFlexi-Transducer: Optimizing Latency, Accuracy and Compute for Multi-Domain On-Device Scenarios.Jay Mahadeokar, Yangyang Shi, Yuan Shangguan, Chunyang Wu, Alex Xiao, Hang Su, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer
2021InterspeechDissecting User-Perceived Latency of On-Device E2E Speech Recognition.Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer
2021InterspeechDynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency.Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2021InterspeechTransformer-Based Acoustic Modeling for Streaming Speech Synthesis.Chunyang Wu, Zhiping Xiu, Yangyang Shi, Ozlem Kalinli, Christian Fuegen, Thilo Khler, Qing He
2020ICASSPSpatial Attention for Far-Field Speech Recognition with Deep Beamforming Neural Networks.Weipeng He, Lu Lu, Biqiao Zhang, Jay Mahadeokar, Kaustubh Kalgaonkar, Christian Fuegen
2020ICASSPLibri-Light: A Benchmark for ASR with Limited or No Supervision.Jacob Kahn, Morgane Rivire, Weiyi Zheng, Evgeny Kharitonov, Qiantong Xu, Pierre-Emmanuel Mazar, Julien Karadayi, Vitaliy Liptchinsky, Ronan Collobert, Christian Fuegen, Tatiana Likhomanenko, Gabriel Synnaeve, Armand Joulin, Abdelrahman Mohamed, Emmanuel Dupoux
2020ICASSPG2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR.Duc Le, Thilo Khler, Christian Fuegen, Michael L. Seltzer
2020ICASSPTransformer-Based Acoustic Modeling for Hybrid Speech Recognition.Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer
2020InterspeechInteractive Text-to-Speech System via Joint Style Analysis.Yang Gao, Weiyi Zheng, Zhaojun Yang, Thilo Khler, Christian Fuegen, Qing He
2020InterspeechWeak-Attention Suppression for Transformer Based Speech Recognition.Yangyang Shi, Yongqiang Wang, Chunyang Wu, Christian Fuegen, Frank Zhang, Duc Le, Ching-Feng Yeh, Michael L. Seltzer
2020InterspeechLarge Scale Weakly and Semi-Supervised Learning for Low-Resource Video ASR.Kritika Singh, Vimal Manohar, Alex Xiao, Sergey Edunov, Ross B. Girshick, Vitaliy Liptchinsky, Christian Fuegen, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed
2019ICASSPEnd-to-end Contextual Speech Recognition Using Class Language Models and a Token Passing Decoder.Zhehuai Chen, Mahaveer Jain, Yongqiang Wang, Michael L. Seltzer, Christian Fuegen
2019InterspeechJoint Grapheme and Phoneme Embeddings for Contextual End-to-End ASR.Zhehuai Chen, Mahaveer Jain, Yongqiang Wang, Michael L. Seltzer, Christian Fuegen
2018ICASSPTowards End-to-end Spoken Language Understanding.Dmitriy Serdyuk, Yongqiang Wang, Christian Fuegen, Anuj Kumar, Baiyang Liu, Yoshua Bengio