Xuedong Huang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
68
Venues
15
Active years
1989–2024
Best venue rank
A*
Where they publish
Papers
68 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | EMNLP | i-Code Studio: A Configurable and Composable Framework for Integrative AI. | Yuwei Fang, Mahmoud Khademi, Chenguang Zhu, Ziyi Yang, Reid Pryzant, Yichong Xu, Yao Qian, Takuya Yoshioka, Lu Yuan, Michael Zeng, Xuedong Huang |
| 2024 | NAACL | i-Code V2: An Autoregressive Generation Framework over Vision, Language, and Speech Data. | Ziyi Yang, Mahmoud Khademi, Yichong Xu, Reid Pryzant, Yuwei Fang, Chenguang Zhu, Dongdong Chen, Yao Qian, Xuemei Gao, Yi-Ling Chen, Robert Gmyr, Naoyuki Kanda, Noel Codella, Bin Xiao, Yu Shi, Lu Yuan, Takuya Yoshioka, Michael Zeng, Xuedong Huang |
| 2023 | AAAI | i-Code: An Integrative and Composable Multimodal Learning Framework. | Ziyi Yang, Yuwei Fang, Chenguang Zhu, Reid Pryzant, Dongdong Chen, Yu Shi, Yichong Xu, Yao Qian, Mei Gao, Yi-Ling Chen, Liyang Lu, Yujia Xie, Robert Gmyr, Noel Codella, Naoyuki Kanda, Bin Xiao, Lu Yuan, Takuya Yoshioka, Michael Zeng, Xuedong Huang |
| 2023 | ACL | Z-Code++: A Pre-trained Language Model Optimized for Abstractive Summarization. | Pengcheng He, Baolin Peng, Song Wang, Yang Liu, Ruochen Xu, Hany Hassan, Yu Shi, Chenguang Zhu, Wayne Xiong, Michael Zeng, Jianfeng Gao, Xuedong Huang |
| 2022 | ICASSP | Personalized speech enhancement: new models and Comprehensive evaluation. | Sefik Emre Eskimez, Takuya Yoshioka, Huaming Wang, Xiaofei Wang, Zhuo Chen, Xuedong Huang |
| 2022 | ICASSP | One Model to Enhance Them All: Array Geometry Agnostic Multi-Channel Personalized Speech Enhancement. | Hassan Taherian, Sefik Emre Eskimez, Takuya Yoshioka, Huaming Wang, Zhuo Chen, Xuedong Huang |
| 2022 | IJCAI | Human Parity on CommonsenseQA: Augmenting Self-Attention with External Attention. | Yichong Xu, Chenguang Zhu, Shuohang Wang, Siqi Sun, Hao Cheng, Xiaodong Liu, Jianfeng Gao, Pengcheng He, Michael Zeng, Xuedong Huang |
| 2021 | ACL | Fusing Context Into Knowledge Graph for Commonsense Question Answering. | Yichong Xu, Chenguang Zhu, Ruochen Xu, Yang Liu, Michael Zeng, Xuedong Huang |
| 2021 | ICML | UniSpeech: Unified Speech Representation Learning with Labeled and Unlabeled Data. | Chengyi Wang, Yu Wu, Yao Qian, Ken'ichi Kumatani, Shujie Liu, Furu Wei, Michael Zeng, Xuedong Huang |
| 2021 | NAACL | Enhancing Factual Consistency of Abstractive Summarization. | Chenguang Zhu, William Hinthorn, Ruochen Xu, Qingkai Zeng, Michael Zeng, Xuedong Huang, Meng Jiang |
| 2021 | SIGIR | Leveraging Lead Bias for Zero-shot Abstractive News Summarization. | Chenguang Zhu, Ziyi Yang, Robert Gmyr, Michael Zeng, Xuedong Huang |
| 2020 | EMNLP | TED: A Pretrained Unsupervised Summarization Model with Theme Modeling and Denoising. | Ziyi Yang, Chenguang Zhu, Robert Gmyr, Michael Zeng, Xuedong Huang, Eric Darve |
| 2020 | EMNLP | A Hierarchical Network for Abstractive Meeting Summarization with Cross-Domain Pretraining. | Chenguang Zhu, Ruochen Xu, Michael Zeng, Xuedong Huang |
| 2020 | IJCNLP | Mixed-Lingual Pre-training for Cross-lingual Summarization. | Ruochen Xu, Chenguang Zhu, Yu Shi, Michael Zeng, Xuedong Huang |
| 2019 | ASRU | Advances in Online Audio-Visual Meeting Transcription. | Takuya Yoshioka, Yan Huang, Aviv Hurvitz, Li Jiang, Sharon Koubi, Eyal Krupka, Ido Leichter, Changliang Liu, Partha Parthasarathy, Alon Vinnikov, Lingfeng Wu, Igor Abramovski, Xiong Xiao, Wayne Xiong, Huaming Wang, Zhenghao Wang, Jun Zhang, Yong Zhao, Tianyan Zhou, Cem Aksoylar, Zhuo Chen, Moshe David, Dimitrios Dimitriadis, Yifan Gong, Ilya Gurvich, Xuedong Huang |
| 2019 | EMNLP | Multi-task Learning for Natural Language Generation in Task-Oriented Dialogue. | Chenguang Zhu, Michael Zeng, Xuedong Huang |
| 2019 | Interspeech | Meeting Transcription Using Asynchronous Distant Microphones. | Takuya Yoshioka, Dimitrios Dimitriadis, Andreas Stolcke, William Hinthorn, Zhuo Chen, Michael Zeng, Xuedong Huang |
| 2019 | SIGdial | SIM: A Slot-Independent Neural Model for Dialogue State Tracking. | Chenguang Zhu, Michael Zeng, Xuedong Huang |
| 2018 | ICASSP | The Microsoft 2017 Conversational Speech Recognition System. | Wayne Xiong, Lingfeng Wu, Fil Alleva, Jasha Droppo, Xuedong Huang, Andreas Stolcke |
| 2017 | ICASSP | The microsoft 2016 conversational speech recognition system. | Wayne Xiong, Jasha Droppo, Xuedong Huang, Frank Seide, Mike Seltzer, Andreas Stolcke, Dong Yu, Geoffrey Zweig |
| 2015 | CIKM | Large-Scale Question Answering with Joint Embedding and Proof Tree Decoding. | Zhenghao Wang, Shengquan Yan, Huaming Wang, Xuedong Huang |
| 2008 | WWW | International workshop on question answering on the web (QAWeb2008). | Liu Wenyin, Qing Li, Xuedong Huang |
| 2004 | ICASSP | Multi-sensory microphones for robust speech detection, enhancement and recognition. | Zhengyou Zhang, Zicheng Liu, Mike Sinclair, Alex Acero, Li Deng, Jasha Droppo, Xuedong Huang, Yanli Zheng |
| 2004 | MMSP | Direct filtering for air- and bone-conductive microphones. | Zicheng Liu, Zhengyou Zhang, Alejandro Acero, Jasha Droppo, Xuedong Huang |
| 2001 | ICASSP | High-performance robust speech recognition using stereo training data. | Li Deng, Alex Acero, Li Jiang, Jasha Droppo, Xuedong Huang |
| 2001 | ICASSP | MiPad: a multimodal interaction prototype. | Xuedong Huang, Alex Acero, Ciprian Chelba, Li Deng, Jasha Droppo, Doug Duchene, Joshua Goodman, Hsiao-Wuen Hon, Derek Jacoby, Li Jiang, Ricky Loynd, Milind Mahajan, Peter Mau, Scott Meredith, Salman Mughal, Salvado Neto, Mike Plumpe, Kuansan Steury, Gina Venolia, Kuansan Wang, Ye-Yi Wang |
| 2000 | ICASSP | A unified context-free grammar and n-gram model for spoken language processing. | Ye-Yi Wang, Milind Mahajan, Xuedong Huang |
| 2000 | Interspeech | Large-vocabulary speech recognition under adverse acoustic environments. | Li Deng, Alex Acero, Mike Plumpe, Xuedong Huang |
| 2000 | Interspeech | Mipad: a next generation PDA prototype. | Xuedong Huang, Alex Acero, Ciprian Chelba, Li Deng, Doug Duchene, Joshua Goodman, Hsiao-Wuen Hon, Derek Jacoby, Li Jiang, Ricky Loynd, Milind Mahajan, Peter Mau, Scott Meredith, Salman Mughal, Salvado Neto, Mike Plumpe, Kuansan Wang, Ye-Yi Wang |
| 2000 | Interspeech | Subword-dependent speaker clustering for improved speech recognition. | Li Jiang, Xuedong Huang |
| 1999 | ICASSP | Improved topic-dependent language modeling using information retrieval techniques. | Milind Mahajan, Doug Beeferman, Xuedong Huang |
| 1999 | Interspeech | Unified decoding and feature representation for improved speech recognition. | Li Jiang, Xuedong Huang |
| 1999 | Interspeech | Improvements on speech recognition for fast talkers. | Matthew Richardson, Mei-Yuh Hwang, Alex Acero, Xuedong Huang |
| 1998 | ICASSP | Automatic generation of synthesis units for trainable text-to-speech systems. | Hsiao-Wuen Hon, Alex Acero, Xuedong Huang, Jingsong Liu, Mike Plumpe |
| 1998 | ICASSP | Dynamically configurable acoustic models for speech recognition. | Mei-Yuh Hwang, Xuedong Huang |
| 1998 | Interspeech | How effective is unsupervised data collection for children's speech recognition? | Gregory Aist, Peggy Chan, Xuedong Huang, Li Jiang, Rebecca Kennedy, DeWitt Latimer IV, Jack Mostow, Calvin Yeung |
| 1998 | Interspeech | Vocabulary-independent word confidence measure using subword features. | Li Jiang, Xuedong Huang |
| 1998 | Interspeech | HMM-based smoothing for concatenative speech synthesis. | Mike Plumpe, Alex Acero, Hsiao-Wuen Hon, Xuedong Huang |
| 1997 | ICASSP | Recent improvements on Microsoft's trainable text-to-speech system-Whistler. | Xuedong Huang, Alex Acero, Hsiao-Wuen Hon, Yun-Cheng Ju, Jingsong Liu, Scott Meredith, Mike Plumpe |
| 1997 | Interspeech | Can continuous speech recognizers handle isolated speech? | Fil Alleva, Xuedong Huang, Mei-Yuh Hwang, Li Jiang |
| 1997 | Interspeech | Improvements on a trainable letter-to-sound converter. | Li Jiang, Hsiao-Wuen Hon, Xuedong Huang |
| 1996 | ICASSP | Speaker and gender normalization for continuous-density hidden Markov models. | Alex Acero, Xuedong Huang |
| 1996 | ICASSP | Improvements on the pronunciation prefix tree search organization. | Fil Alleva, Xuedong Huang, Mei-Yuh Hwang |
| 1996 | ICASSP | Deleted interpolation and density sharing for continuous hidden Markov models. | Xuedong Huang, Mei-Yuh Hwang, Li Jiang, Milind Mahajan |
| 1996 | Interspeech | Whistler: a trainable text-to-speech system. | Xuedong Huang, Alex Acero, J. Adcock, Hsiao-Wuen Hon, John Goldsmith, Jingsong Liu, Mike Plumpe |
| 1995 | ICASSP | Microsoft Windows highly intelligent speech recognizer: Whisper. | Xuedong Huang, Alex Acero, Fil Alleva, Mei-Yuh Hwang, Li Jiang, Milind Mahajan |
| 1994 | ICASSP | Improving speech recognition performance via phone-dependent VQ codebooks and adaptive language models in SPHINX-II. | Mei-Yuh Hwang, Ronald Rosenfeld, Eric H. Thayer, Mosur Ravishankar, Lin Lawrence Chase, Robert Weide, Xuedong Huang, Fil Alleva |
| 1994 | NAACL | Session 2: Language Modeling. | Xuedong Huang |
| 1993 | ICASSP | An improved search algorithm using incremental knowledge for continuous speech recognition. | Fil Alleva, Xuedong Huang, Mei-Yuh Hwang |
| 1993 | ICASSP | Unified stochastic engine (USE) for speech recognition. | Xuedong Huang, M. Belin, Fil Alleva, Mei-Yuh Hwang |
| 1993 | ICASSP | Predicting unseen triphones with senones. | Mei-Yuh Hwang, Xuedong Huang, Fil Alleva |
| 1993 | Interspeech | Senones, multi-pass search, and unified stochastic modeling in sphinx-II. | Mei-Yuh Hwang, Fil Alleva, Xuedong Huang |
| 1993 | NAACL | An Overview of the SPHINX-II Speech Recognition System. | Xuedong Huang, Fileno A. Alleva, Mei-Yuh Hwang, Ronald Rosenfeld |
| 1993 | NAACL | Efficient Cepstral Normalization For Robust Speech Recognition. | Fu-Hua Liu, Richard M. Stern, Xuedong Huang, Alejandro Acero |
| 1992 | ICASSP | Speaker normalization for speech recognition. | Xuedong Huang |
| 1992 | ICASSP | Subphonetic modeling with Markov states-Senone. | Mei-Yuh Hwang, Xuedong Huang |
| 1992 | ICASSP | Exploiting correlations among competing models with application to large vocabulary speech recognition. | Ronald Rosenfeld, Xuedong Huang, Merrick L. Furst |
| 1992 | NAACL | Applying SPHINX-II to the DARPA Wall Street Journal CSR Task. | Fil Alleva, Hsiao-Wuen Hon, Xuedong Huang, Mei-Yuh Hwang, Ronald Rosenfeld, Robert Weide |
| 1992 | NAACL | Minimizing Speaker Variation Effects for Speaker-Independent Speech Recognition. | Xuedong Huang |
| 1992 | NAACL | Subphonetic Modeling for Speech Recognition. | Mei-Yuh Hwang, Xuedong Huang |
| 1992 | NAACL | Improvements in Stochastic Language Modeling. | Ronald Rosenfeld, Xuedong Huang |
| 1992 | NAACL | Speech Understanding in Open Tasks. | Wayne H. Ward, Sunil lssar, Xuedong Huang, Hsiao-Wuen Hon, Mei-Yuh Hwang, Sheryl Young, Michael Matessa, Fu-Hua Liu, Richard M. Stern |
| 1991 | ICASSP | Improved acoustic modeling with the SPHINX speech recognition system. | Xuedong Huang, Kai-Fu Lee, Hsiao-Wuen Hon, Mei-Yuh Hwang |
| 1991 | Interspeech | Acoustic distribution clustering in phonetic hidden Markov models. | Mei-Yuh Hwang, Xuedong Huang |
| 1991 | NAACL | A Study on Speaker-Adaptive Speech Recognition. | Xuedong Huang |
| 1990 | ICASSP | On semi-continuous hidden Markov modeling. | Xuedong Huang, Kai-Fu Lee, Hsiao-Wuen Hon |
| 1990 | NAACL | Improved Hidden Markov Modeling for Speaker-Independent Continuous Speech Recognition. | Xuedong Huang, Fil Alleva, Satoru Hayamizu, Hsiao-Wuen Hon, Mei-Yuh Hwang, Kai-Fu Lee |
| 1989 | Interspeech | Large-vocabulary speaker-independent continuous speech recognition with semi-continuous hidden Markov models. | Xuedong Huang, Hsiao-Wuen Hon, Kai-Fu Lee |