Skip to content

Duc Le

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

41

Venues

10

Active years

2013–2025

Best venue rank

A*

Where they publish

Papers

41 indexed papers, newest first.

YearVenueTitleAuthors
2025HSIPhysics-Informed Ground Reaction Dynamics from Human Motion Capture.Cuong Le, Huy-Phuong Le, Duc Le, Minh-Thien Duong, Van-Binh Nguyen, My-Ha Le
2025ICASSPTextless Streaming Speech-to-Speech Translation using Semantic Speech Tokens.Jinzheng Zhao, Niko Moritz, Egor Lakomkin, Ruiming Xie, Zhiping Xiu, Katerina Zmolkov, Zeeshan Ahmed, Yashesh Gaur, Duc Le, Christian Fuegen
2025WACVFrom Visual Explanations to Counterfactual Explanations with Latent Diffusion.Tung Luu, Nam Le, Duc Le, Bac Le
2024ACIIDSMulti-scale and Multi-level Attention Based on External Knowledge in EHRs.Duc Le, Bac Le
2024EMNLPPRoDeliberation: Parallel Robust Deliberation for End-to-End Spoken Language Understanding.Trang Le, Daniel Lazar, Suyoun Kim, Shan Jiang, Duc Le, Adithya Sagar, Aleksandr Livshits, Ahmed Aly, Akshat Shrivastava
2024ICASSPSTEMGEN: A Music Generation Model That Listens.Julian D. Parker, Janne Spijkervet, Katerina Kosta, Furkan Yesiler, Boris Kuznetsov, Ju-Chiang Wang, Matt Avent, Jitong Chen, Duc Le
2024ICASSPA Foundation Model for Music Informatics.Minz Won, Yun-Ning Hung, Duc Le
2023ICASSPFactorized Blank Thresholding for Improved Runtime Efficiency of Neural Transducers.Duc Le, Frank Seide, Yuhao Wang, Yang Li, Kjell Schubert, Ozlem Kalinli, Michael L. Seltzer
2023ICASSPImproving fast-slow Encoder based Transducer with Streaming Deliberation.Ke Li, Jay Mahadeokar, Jinxi Guo, Yangyang Shi, Gil Keren, Ozlem Kalinli, Michael L. Seltzer, Duc Le
2023ICASSPICASSP 2023 Spoken Language Understanding Grand Challenge.Akshat Shrivastava, Suyoun Kim, Paden Tomasello, Ali Elkahky, Daniel Lazar, Trang Le, Shan Jiang, Duc Le, Aleksandr Livshits, Ahmed Aly
2023ICASSPMassively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities.Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer
2023ICASSPLearning ASR Pathways: A Sparse Multilingual ASR Model.Mu Yang, Andros Tjandra, Chunxi Liu, David Zhang, Duc Le, Ozlem Kalinli
2023InterspeechModality Confidence Aware Training for Robust End-to-End Spoken Language Understanding.Suyoun Kim, Akshat Shrivastava, Duc Le, Ju Lin, Ozlem Kalinli, Michael L. Seltzer
2022EMNLPJoint Audio/Text Training for Transformer Rescorer of Streaming Speech Recognition.Suyoun Kim, Ke Li, Lucas Kabela, Ron Huang, Jiedan Zhu, Ozlem Kalinli, Duc Le
2022ICASSPNeural-FST Class Language Model for End-to-End Speech Recognition.Antoine Bruguier, Duc Le, Rohit Prabhavalkar, Dangna Li, Zhe Liu, Bo Wang, Eun Chang, Fuchun Peng, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechEvaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric.Suyoun Kim, Duc Le, Weiyi Zheng, Tarun Singh, Abhinav Arora, Xiaoyu Zhai, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechDeliberation Model for On-Device Spoken Language Understanding.Duc Le, Akshat Shrivastava, Paden D. Tomasello, Suyoun Kim, Aleksandr Livshits, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechStreaming parallel transducer beam search with fast slow cascaded encoders.Jay Mahadeokar, Yangyang Shi, Ke Li, Duc Le, Jiedan Zhu, Vikas Chandra, Ozlem Kalinli, Michael L. Seltzer
2022InterspeechScaling ASR Improves Zero and Few Shot Learning.Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed
2021ICASSPImproved Neural Language Model Fusion for Streaming Recurrent Neural Network Transducer.Suyoun Kim, Yuan Shangguan, Jay Mahadeokar, Antoine Bruguier, Christian Fuegen, Michael L. Seltzer, Duc Le
2021ICASSPEmformer: Efficient Memory Transformer Based Acoustic Model for Low Latency Streaming Speech Recognition.Yangyang Shi, Yongqiang Wang, Chunyang Wu, Ching-Feng Yeh, Julian Chan, Frank Zhang, Duc Le, Mike Seltzer
2021InterspeechSemantic Distance: A New Metric for ASR Performance Analysis Towards Spoken Language Understanding.Suyoun Kim, Abhinav Arora, Duc Le, Ching-Feng Yeh, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2021InterspeechContextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion.Duc Le, Mahaveer Jain, Gil Keren, Suyoun Kim, Yangyang Shi, Jay Mahadeokar, Julian Chan, Yuan Shangguan, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Michael L. Seltzer
2021InterspeechFlexi-Transducer: Optimizing Latency, Accuracy and Compute for Multi-Domain On-Device Scenarios.Jay Mahadeokar, Yangyang Shi, Yuan Shangguan, Chunyang Wu, Alex Xiao, Hang Su, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer
2021InterspeechDissecting User-Perceived Latency of On-Device E2E Speech Recognition.Yuan Shangguan, Rohit Prabhavalkar, Hang Su, Jay Mahadeokar, Yangyang Shi, Jiatong Zhou, Chunyang Wu, Duc Le, Ozlem Kalinli, Christian Fuegen, Michael L. Seltzer
2021InterspeechDynamic Encoder Transducer: A Flexible Solution for Trading Off Accuracy for Latency.Yangyang Shi, Varun Nagaraja, Chunyang Wu, Jay Mahadeokar, Duc Le, Rohit Prabhavalkar, Alex Xiao, Ching-Feng Yeh, Julian Chan, Christian Fuegen, Ozlem Kalinli, Michael L. Seltzer
2020ICASSPG2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR.Duc Le, Thilo Khler, Christian Fuegen, Michael L. Seltzer
2020ICASSPTransformer-Based Acoustic Modeling for Hybrid Speech Recognition.Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer
2020InterspeechWeak-Attention Suppression for Transformer Based Speech Recognition.Yangyang Shi, Yongqiang Wang, Chunyang Wu, Christian Fuegen, Frank Zhang, Duc Le, Ching-Feng Yeh, Michael L. Seltzer
2019ASRUFrom Senones to Chenones: Tied Context-Dependent Graphemes for Hybrid Speech Recognition.Duc Le, Xiaohui Zhang, Weiyi Zheng, Christian Fgen, Geoffrey Zweig, Michael L. Seltzer
2018InterspeechClassification of Huntington Disease Using Acoustic and Lexical Features.Matthew Perez, Wenyu Jin, Duc Le, Noelle Carlozzi, Praveen Dayalu, Angela Roberts, Emily Mower Provost
2017InterspeechDiscretized Continuous Speech Emotion Recognition with Multi-Task Deep Recurrent Neural Network.Duc Le, Zakaria Aldeneh, Emily Mower Provost
2017InterspeechAutomatic Paraphasia Detection from Aphasic Speech: A Preliminary Study.Duc Le, Keli Licata, Emily Mower Provost
2016ICMIWild wild emotion: a multimodal ensemble approach.John Gideon, Biqiao Zhang, Zakaria Aldeneh, Yelin Kim, Soheil Khorram, Duc Le, Emily Mower Provost
2016InterspeechImproving Automatic Recognition of Aphasic Speech with AphasiaBank.Duc Le, Emily Mower Provost
2015ACIIData selection for acoustic emotion recognition: Analyzing and comparing utterance and sub-utterance selection strategies.Duc Le, Emily Mower Provost
2014ICASSPAutomatic analysis of speech quality for aphasia treatment.Duc Le, Keli Licata, Elizabeth Mercado, Carol Persad, Emily Mower Provost
2014InterspeechModeling pronunciation, rhythm, and intonation for automatic assessment of speech quality in aphasia rehabilitation.Duc Le, Emily Mower Provost
2014ISSTAMuCheck: an extensible tool for mutation testing of haskell programs.Duc Le, Mohammad Amin Alipour, Rahul Gopinath, Alex Groce
2013ASRUEmotion recognition from spontaneous speech using Hidden Markov models with deep belief networks.Duc Le, Emily Mower Provost
2013InterspeechA preliminary study of cross-lingual emotion recognition from speech: automatic classification versus human perception.Je Hun Jeon, Duc Le, Rui Xia, Yang Liu