Christian Fuegen
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
35
Venues
4
Active years
2018–2025
Best venue rank
A*
Where they publish
Papers
35 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Transcribing and Translating, Fast and Slow: Joint Speech Translation and Recognition. | Niko Moritz, Ruiming Xie, Yashesh Gaur, Ke Li, Simone Merello, Zeeshan Ahmed, Frank Seide, Christian Fuegen |
| 2025 | ICASSP | Textless Streaming Speech-to-Speech Translation using Semantic Speech Tokens. | Jinzheng Zhao, Niko Moritz, Egor Lakomkin, Ruiming Xie, Zhiping Xiu, Katerina Zmolkov, Zeeshan Ahmed, Yashesh Gaur, Duc Le, Christian Fuegen |
| 2024 | ICASSP | Prompting Large Language Models with Speech Recognition Abilities. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia, Yuan Shangguan, Ke Li, Jinxi Guo, Wenhan Xiong, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | Effective Internal Language Model Training and Fusion for Factorized Transducer Model. | Jinxi Guo, Niko Moritz, Yingyi Ma, Frank Seide, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | End-to-End Speech Recognition Contextualization with Large Language Models. | Egor Lakomkin, Chunyang Wu, Yassir Fathullah, Ozlem Kalinli, Michael L. Seltzer, Christian Fuegen |
| 2024 | ICASSP | AGADIR: Towards Array-Geometry Agnostic Directional Speech Recognition. | Ju Lin, Niko Moritz, Yiteng Huang, Ruiming Xie, Ming Sun, Christian Fuegen, Frank Seide |
| 2024 | NAACL | AudioChatLlama: Towards General-Purpose Speech Abilities for LLMs. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Ke Li, Junteng Jia, Yuan Shangguan, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2023 | CVPR | SynthVSR: Scaling Up Visual Speech RecognitionWith Synthetic Supervision. | Xubo Liu, Egor Lakomkin, Konstantinos Vougioukas, Pingchuan Ma, Honglie Chen, Ruiming Xie, Morrie Doulaty, Niko Moritz, Jchym Kolr, Stavros Petridis, Maja Pantic, Christian Fuegen |
| 2023 | Interspeech | Streaming Audio-Visual Speech Recognition with Alignment Regularization. | Pingchuan Ma, Niko Moritz, Stavros Petridis, Christian Fuegen, Maja Pantic |
| 2023 | Interspeech | Directional Speech Recognition for Speaker Disambiguation and Cross-talk Suppression. | Ju Lin, Niko Moritz, Ruiming Xie, Kaustubh Kalgaonkar, Christian Fuegen, Frank Seide |
| 2022 | CVPR | Ego4D: Around the World in 3, 000 Hours of Egocentric Video. | Kristen Grauman, Andrew Westbury, Eugene Byrne, Zachary Chavis, Antonino Furnari, Rohit Girdhar, Jackson Hamburger, Hao Jiang, Miao Liu, Xingyu Liu, Miguel Martin, Tushar Nagarajan, Ilija Radosavovic, Santhosh Kumar Ramakrishnan, Fiona Ryan, Jayant Sharma, Michael Wray, Mengmeng Xu, Eric Zhongcong Xu, Chen Zhao, Siddhant Bansal, Dhruv Batra, Vincent Cartillier, Sean Crane, Tien Do, Morrie Doulaty, Akshay Erapalli, Christoph Feichtenhofer, Adriano Fragomeni, Qichen Fu, Abrham Gebreselasie, Cristina Gonzlez, James Hillis, Xuhua Huang, Yifei Huang, Wenqi Jia, Weslie Khoo, Jchym Kolr, Satwik Kottur, Anurag Kumar, Federico Landini, Chao Li, Yanghao Li, Zhenqiang Li, Karttikeya Mangalam, Raghava Modhugu, Jonathan Munro, Tullie Murrell, Takumi Nishiyasu, Will Price, Paola Ruiz Puentes, Merey Ramazanova, Leda Sari, Kiran K. Somasundaram, Audrey Southerland, Yusuke Sugano, Ruijie Tao, Minh Vo, Yuchen Wang, Xindi Wu, Takuma Yagi, Ziwei Zhao, Yunyi Zhu, Pablo Arbelez, David Crandall, Dima Damen, Giovanni Maria Farinella, Christian Fuegen, Bernard Ghanem, Vamsi Krishna Ithapu, C. V. Jawahar, Hanbyul Joo, Kris Kitani, Haizhou Li, Richard A. Newcombe, Aude Oliva, Hyun Soo Park, James M. Rehg, Yoichi Sato, Jianbo Shi, Mike Zheng Shou, Antonio Torralba, Lorenzo Torresani, Mingfei Yan, Jitendra Malik |
| 2022 | Interspeech | Evaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric. | Suyoun Kim, Duc Le, Weiyi Zheng, Tarun Singh, Abhinav Arora, Xiaoyu Zhai, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Scaling ASR Improves Zero and Few Shot Learning. | Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed |
| 2021 | ICASSP | Improved Neural Language Model Fusion for Streaming Recurrent Neural Network Transducer. | Suyoun Kim, Yuan Shangguan, Jay Mahadeokar, Antoine Bruguier, Christian Fuegen, Michael L. Seltzer, Duc Le |
| 2021 | ICASSP | A Time-Domain Convolutional Recurrent Network for Packet Loss Concealment. | Ju Lin, Yun Wang, Kaustubh Kalgaonkar, Gil Keren, Didi Zhang, Christian Fuegen |
| 2021 | ICASSP | Memory-Efficient Speech Recognition on Smart Devices. | Ganesh Venkatesh, Alagappan Valliappan, Jay Mahadeokar, Yuan Shangguan, Christian Fuegen, Michael L. Seltzer, Vikas Chandra |
| 2021 | ICASSP | Contrastive Semi-Supervised Learning for ASR. | Alex Xiao, Christian Fuegen, Abdelrahman Mohamed |
| 2021 | Interspeech | Do Sound Event Representations Generalize to Other Audio Tasks? A Case Study in Audio Transfer Learning. | Anurag Kumar, Yun Wang, Vamsi Krishna Ithapu, Christian Fuegen |
| 2021 | Interspeech | Semantic Distance: A New Metric for ASR Performance Analysis Towards Spoken Language Understanding. | Suyoun Kim, Abhinav Arora, Duc Le, Ching-Feng Yeh, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2021 | Interspeech | Contextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion. | Duc Le, Mahaveer Jain, Gil Keren, Suyoun Kim, Yangyang Shi, Jay Mahadeokar, Julian Chan, Yuan Shangguan, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Michael L. Seltzer |
| 2021 | Interspeech | A Two-Stage Approach to Speech Bandwidth Extension. | Ju Lin, Yun Wang, Kaustubh Kalgaonkar, Gil Keren, Didi Zhang, Christian Fuegen |
| 2021 | Interspeech | Flexi-Transducer: Optimizing Latency, Accuracy and Compute for Multi-Domain On-Device Scenarios. | Jay Mahadeokar, Yangyang Shi, Yuan Shangguan, Chunyang Wu, Alex Xiao, Hang Su, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer |
| 2021 | Interspeech | Dissecting User-Perceived Latency of On-Device E2E Speech Recognition. | Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer |
| 2021 | Interspeech | Dynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency. | Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2021 | Interspeech | Transformer-Based Acoustic Modeling for Streaming Speech Synthesis. | Chunyang Wu, Zhiping Xiu, Yangyang Shi, Ozlem Kalinli, Christian Fuegen, Thilo Khler, Qing He |
| 2020 | ICASSP | Spatial Attention for Far-Field Speech Recognition with Deep Beamforming Neural Networks. | Weipeng He, Lu Lu, Biqiao Zhang, Jay Mahadeokar, Kaustubh Kalgaonkar, Christian Fuegen |
| 2020 | ICASSP | Libri-Light: A Benchmark for ASR with Limited or No Supervision. | Jacob Kahn, Morgane Rivire, Weiyi Zheng, Evgeny Kharitonov, Qiantong Xu, Pierre-Emmanuel Mazar, Julien Karadayi, Vitaliy Liptchinsky, Ronan Collobert, Christian Fuegen, Tatiana Likhomanenko, Gabriel Synnaeve, Armand Joulin, Abdelrahman Mohamed, Emmanuel Dupoux |
| 2020 | ICASSP | G2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR. | Duc Le, Thilo Khler, Christian Fuegen, Michael L. Seltzer |
| 2020 | ICASSP | Transformer-Based Acoustic Modeling for Hybrid Speech Recognition. | Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer |
| 2020 | Interspeech | Interactive Text-to-Speech System via Joint Style Analysis. | Yang Gao, Weiyi Zheng, Zhaojun Yang, Thilo Khler, Christian Fuegen, Qing He |
| 2020 | Interspeech | Weak-Attention Suppression for Transformer Based Speech Recognition. | Yangyang Shi, Yongqiang Wang, Chunyang Wu, Christian Fuegen, Frank Zhang, Duc Le, Ching-Feng Yeh, Michael L. Seltzer |
| 2020 | Interspeech | Large Scale Weakly and Semi-Supervised Learning for Low-Resource Video ASR. | Kritika Singh, Vimal Manohar, Alex Xiao, Sergey Edunov, Ross B. Girshick, Vitaliy Liptchinsky, Christian Fuegen, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed |
| 2019 | ICASSP | End-to-end Contextual Speech Recognition Using Class Language Models and a Token Passing Decoder. | Zhehuai Chen, Mahaveer Jain, Yongqiang Wang, Michael L. Seltzer, Christian Fuegen |
| 2019 | Interspeech | Joint Grapheme and Phoneme Embeddings for Contextual End-to-End ASR. | Zhehuai Chen, Mahaveer Jain, Yongqiang Wang, Michael L. Seltzer, Christian Fuegen |
| 2018 | ICASSP | Towards End-to-end Spoken Language Understanding. | Dmitriy Serdyuk, Yongqiang Wang, Christian Fuegen, Anuj Kumar, Baiyang Liu, Yoshua Bengio |