Mike Seltzer
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
15
Venues
4
Active years
2013–2025
Best venue rank
Multiconference
Where they publish
Papers
15 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Transducer-Llama: Integrating LLMs into Streamable Transducer-based Speech Recognition. | Keqi Deng, Jinxi Guo, Yingyi Ma, Niko Moritz, Philip C. Woodland, Ozlem Kalinli, Mike Seltzer |
| 2025 | ICASSP | Get Large Language Models Ready to Speak: A Late-fusion Approach for Speech Generation. | Maohao Shen, Shun Zhang, Jilong Wu, Zhiping Xiu, Ehab A. AlBadawy, Yiting Lu, Mike Seltzer, Qing He |
| 2024 | ICASSP | Prompting Large Language Models with Speech Recognition Abilities. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia, Yuan Shangguan, Ke Li, Jinxi Guo, Wenhan Xiong, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | Effective Internal Language Model Training and Fusion for Factorized Transducer Model. | Jinxi Guo, Niko Moritz, Yingyi Ma, Frank Seide, Chunyang Wu, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2024 | ICASSP | TODM: Train Once Deploy Many Efficient Supernet-Based RNN-T Compression For On-Device ASR Models. | Yuan Shangguan, Haichuan Yang, Danni Li, Chunyang Wu, Yassir Fathullah, Dilin Wang, Ayushi Dalmia, Raghuraman Krishnamoorthi, Ozlem Kalinli, Junteng Jia, Jay Mahadeokar, Xin Lei, Mike Seltzer, Vikas Chandra |
| 2024 | NAACL | AudioChatLlama: Towards General-Purpose Speech Abilities for LLMs. | Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Ke Li, Junteng Jia, Yuan Shangguan, Jay Mahadeokar, Ozlem Kalinli, Christian Fuegen, Mike Seltzer |
| 2023 | ICASSP | Dynamic Speech Endpoint Detection with Regression Targets. | Dawei Liang, Hang Su, Tarun Singh, Jay Mahadeokar, Shanil Puri, Jiedan Zhu, Edison Thomaz, Mike Seltzer |
| 2023 | Interspeech | Multi-Head State Space Model for Speech Recognition. | Yassir Fathullah, Chunyang Wu, Yuan Shangguan, Junteng Jia, Wenhan Xiong, Jay Mahadeokar, Chunxi Liu, Yangyang Shi, Ozlem Kalinli, Mike Seltzer, Mark J. F. Gales |
| 2022 | ICASSP | Streaming Transformer Transducer based Speech Recognition Using Non-Causal Convolution. | Yangyang Shi, Chunyang Wu, Dilin Wang, Alex Xiao, Jay Mahadeokar, Xiaohui Zhang, Chunxi Liu, Ke Li, Yuan Shangguan, Varun Nagaraja, Ozlem Kalinli, Mike Seltzer |
| 2021 | ASRU | On Lattice-Free Boosted MMI Training of HMM and CTC-Based Full-Context ASR Models. | Xiaohui Zhang, Vimal Manohar, David Zhang, Frank Zhang, Yangyang Shi, Nayan Singhal, Julian Chan, Fuchun Peng, Yatharth Saraf, Mike Seltzer |
| 2021 | ICASSP | Emformer: Efficient Memory Transformer Based Acoustic Model for Low Latency Streaming Speech Recognition. | Yangyang Shi, Yongqiang Wang, Chunyang Wu, Ching-Feng Yeh, Julian Chan, Frank Zhang, Duc Le, Mike Seltzer |
| 2017 | ICASSP | The microsoft 2016 conversational speech recognition system. | Wayne Xiong, Jasha Droppo, Xuedong Huang, Frank Seide, Mike Seltzer, Andreas Stolcke, Dong Yu, Geoffrey Zweig |
| 2014 | ICASSP | Phone sequence modeling with recurrent neural networks. | Nicolas Boulanger-Lewandowski, Jasha Droppo, Mike Seltzer, Dong Yu |
| 2014 | ICASSP | Singular value decomposition based low-footprint speaker adaptation and personalization for deep neural network. | Jian Xue, Jinyu Li, Dong Yu, Mike Seltzer, Yifan Gong |
| 2013 | ICASSP | A summary of the 2012 JHU CLSP workshop on zero resource speech technologies and models of early language acquisition. | Aren Jansen, Emmanuel Dupoux, Sharon Goldwater, Mark Johnson, Sanjeev Khudanpur, Kenneth Church, Naomi Feldman, Hynek Hermansky, Florian Metze, Richard C. Rose, Mike Seltzer, Pascal Clark, Ian McGraw, Balakrishnan Varadarajan, Erin Bennett, Benjamin Brschinger, Justin T. Chiu, Ewan Dunbar, Abdellah Fourtassi, David Harwath, Chia-ying Lee, Keith D. Levin, Atta Norouzian, Vijayaditya Peddinti, Rachael Richardson, Thomas Schatz, Samuel Thomas |