Duc Le
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
41
Venues
10
Active years
2013–2025
Best venue rank
A*
Where they publish
Papers
41 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | HSI | Physics-Informed Ground Reaction Dynamics from Human Motion Capture. | Cuong Le, Huy-Phuong Le, Duc Le, Minh-Thien Duong, Van-Binh Nguyen, My-Ha Le |
| 2025 | ICASSP | Textless Streaming Speech-to-Speech Translation using Semantic Speech Tokens. | Jinzheng Zhao, Niko Moritz, Egor Lakomkin, Ruiming Xie, Zhiping Xiu, Katerina Zmolkov, Zeeshan Ahmed, Yashesh Gaur, Duc Le, Christian Fuegen |
| 2025 | WACV | From Visual Explanations to Counterfactual Explanations with Latent Diffusion. | Tung Luu, Nam Le, Duc Le, Bac Le |
| 2024 | ACIIDS | Multi-scale and Multi-level Attention Based on External Knowledge in EHRs. | Duc Le, Bac Le |
| 2024 | EMNLP | PRoDeliberation: Parallel Robust Deliberation for End-to-End Spoken Language Understanding. | Trang Le, Daniel Lazar, Suyoun Kim, Shan Jiang, Duc Le, Adithya Sagar, Aleksandr Livshits, Ahmed Aly, Akshat Shrivastava |
| 2024 | ICASSP | STEMGEN: A Music Generation Model That Listens. | Julian D. Parker, Janne Spijkervet, Katerina Kosta, Furkan Yesiler, Boris Kuznetsov, Ju-Chiang Wang, Matt Avent, Jitong Chen, Duc Le |
| 2024 | ICASSP | A Foundation Model for Music Informatics. | Minz Won, Yun-Ning Hung, Duc Le |
| 2023 | ICASSP | Factorized Blank Thresholding for Improved Runtime Efficiency of Neural Transducers. | Duc Le, Frank Seide, Yuhao Wang, Yang Li, Kjell Schubert, Ozlem Kalinli, Michael L. Seltzer |
| 2023 | ICASSP | Improving fast-slow Encoder based Transducer with Streaming Deliberation. | Ke Li, Jay Mahadeokar, Jinxi Guo, Yangyang Shi, Gil Keren, Ozlem Kalinli, Michael L. Seltzer, Duc Le |
| 2023 | ICASSP | ICASSP 2023 Spoken Language Understanding Grand Challenge. | Akshat Shrivastava, Suyoun Kim, Paden Tomasello, Ali Elkahky, Daniel Lazar, Trang Le, Shan Jiang, Duc Le, Aleksandr Livshits, Ahmed Aly |
| 2023 | ICASSP | Massively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities. | Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer |
| 2023 | ICASSP | Learning ASR Pathways: A Sparse Multilingual ASR Model. | Mu Yang, Andros Tjandra, Chunxi Liu, David Zhang, Duc Le, Ozlem Kalinli |
| 2023 | Interspeech | Modality Confidence Aware Training for Robust End-to-End Spoken Language Understanding. | Suyoun Kim, Akshat Shrivastava, Duc Le, Ju Lin, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | EMNLP | Joint Audio/Text Training for Transformer Rescorer of Streaming Speech Recognition. | Suyoun Kim, Ke Li, Lucas Kabela, Ron Huang, Jiedan Zhu, Ozlem Kalinli, Duc Le |
| 2022 | ICASSP | Neural-FST Class Language Model for End-to-End Speech Recognition. | Antoine Bruguier, Duc Le, Rohit Prabhavalkar, Dangna Li, Zhe Liu, Bo Wang, Eun Chang, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Evaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric. | Suyoun Kim, Duc Le, Weiyi Zheng, Tarun Singh, Abhinav Arora, Xiaoyu Zhai, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Deliberation Model for On-Device Spoken Language Understanding. | Duc Le, Akshat Shrivastava, Paden D. Tomasello, Suyoun Kim, Aleksandr Livshits, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Streaming parallel transducer beam search with fast slow cascaded encoders. | Jay Mahadeokar, Yangyang Shi, Ke Li, Duc Le, Jiedan Zhu, Vikas Chandra, Ozlem Kalinli, Michael L. Seltzer |
| 2022 | Interspeech | Scaling ASR Improves Zero and Few Shot Learning. | Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed |
| 2021 | ICASSP | Improved Neural Language Model Fusion for Streaming Recurrent Neural Network Transducer. | Suyoun Kim, Yuan Shangguan, Jay Mahadeokar, Antoine Bruguier, Christian Fuegen, Michael L. Seltzer, Duc Le |
| 2021 | ICASSP | Emformer: Efficient Memory Transformer Based Acoustic Model for Low Latency Streaming Speech Recognition. | Yangyang Shi, Yongqiang Wang, Chunyang Wu, Ching-Feng Yeh, Julian Chan, Frank Zhang, Duc Le, Mike Seltzer |
| 2021 | Interspeech | Semantic Distance: A New Metric for ASR Performance Analysis Towards Spoken Language Understanding. | Suyoun Kim, Abhinav Arora, Duc Le, Ching-Feng Yeh, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2021 | Interspeech | Contextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion. | Duc Le, Mahaveer Jain, Gil Keren, Suyoun Kim, Yangyang Shi, Jay Mahadeokar, Julian Chan, Yuan Shangguan, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Michael L. Seltzer |
| 2021 | Interspeech | Flexi-Transducer: Optimizing Latency, Accuracy and Compute for Multi-Domain On-Device Scenarios. | Jay Mahadeokar, Yangyang Shi, Yuan Shangguan, Chunyang Wu, Alex Xiao, Hang Su, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer |
| 2021 | Interspeech | Dissecting User-Perceived Latency of On-Device E2E Speech Recognition. | Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer |
| 2021 | Interspeech | Dynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency. | Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer |
| 2020 | ICASSP | G2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR. | Duc Le, Thilo Khler, Christian Fuegen, Michael L. Seltzer |
| 2020 | ICASSP | Transformer-Based Acoustic Modeling for Hybrid Speech Recognition. | Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer |
| 2020 | Interspeech | Weak-Attention Suppression for Transformer Based Speech Recognition. | Yangyang Shi, Yongqiang Wang, Chunyang Wu, Christian Fuegen, Frank Zhang, Duc Le, Ching-Feng Yeh, Michael L. Seltzer |
| 2019 | ASRU | From Senones to Chenones: Tied Context-Dependent Graphemes for Hybrid Speech Recognition. | Duc Le, Xiaohui Zhang, Weiyi Zheng, Christian Fgen, Geoffrey Zweig, Michael L. Seltzer |
| 2018 | Interspeech | Classification of Huntington Disease Using Acoustic and Lexical Features. | Matthew Perez, Wenyu Jin, Duc Le, Noelle Carlozzi, Praveen Dayalu, Angela Roberts, Emily Mower Provost |
| 2017 | Interspeech | Discretized Continuous Speech Emotion Recognition with Multi-Task Deep Recurrent Neural Network. | Duc Le, Zakaria Aldeneh, Emily Mower Provost |
| 2017 | Interspeech | Automatic Paraphasia Detection from Aphasic Speech: A Preliminary Study. | Duc Le, Keli Licata, Emily Mower Provost |
| 2016 | ICMI | Wild wild emotion: a multimodal ensemble approach. | John Gideon, Biqiao Zhang, Zakaria Aldeneh, Yelin Kim, Soheil Khorram, Duc Le, Emily Mower Provost |
| 2016 | Interspeech | Improving Automatic Recognition of Aphasic Speech with AphasiaBank. | Duc Le, Emily Mower Provost |
| 2015 | ACII | Data selection for acoustic emotion recognition: Analyzing and comparing utterance and sub-utterance selection strategies. | Duc Le, Emily Mower Provost |
| 2014 | ICASSP | Automatic analysis of speech quality for aphasia treatment. | Duc Le, Keli Licata, Elizabeth Mercado, Carol Persad, Emily Mower Provost |
| 2014 | Interspeech | Modeling pronunciation, rhythm, and intonation for automatic assessment of speech quality in aphasia rehabilitation. | Duc Le, Emily Mower Provost |
| 2014 | ISSTA | MuCheck: an extensible tool for mutation testing of haskell programs. | Duc Le, Mohammad Amin Alipour, Rahul Gopinath, Alex Groce |
| 2013 | ASRU | Emotion recognition from spontaneous speech using Hidden Markov models with deep belief networks. | Duc Le, Emily Mower Provost |
| 2013 | Interspeech | A preliminary study of cross-lingual emotion recognition from speech: automatic classification versus human perception. | Je Hun Jeon, Duc Le, Rui Xia, Yang Liu |