| 2011 | Factor analysis based session variability compensation for Automatic Speech Recognition. | Mickael Rouvier, Mohamed Bouallegue, Driss Matrouf, Georges Linars |
| 2011 | Multi-site heterogeneous system fusions for the Albayzin 2010 Language Recognition Evaluation. | Luis Javier Rodrguez, Mikel Peagarikano, Amparo Varona, Mireia Dez, Germn Bordel, David Martnez Gonzlez, Jess Antonio Villalba Lpez, Antonio Miguel, Alfonso Ortega, Eduardo Lleida, Alberto Abad, Oscar Koller, Isabel Trancoso, Paula Lopez-Otero, Laura Doco Fernndez, Carmen Garca-Mateo, Rahim Saeidi, Mehdi Soufifar, Tomi Kinnunen, Torbjrn Svendsen, Pasi Frnti |
| 2011 | Matched-condition robust Dynamic Noise Adaptation. | Steven J. Rennie, Pierre L. Dognin, Petr Fousek |
| 2011 | Adapting n-gram maximum entropy language models with conditional entropy regularization. | Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur |
| 2011 | Efficient discriminative training of long-span language models. | Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur |
| 2011 | Applying Multiclass Bandit algorithms to call-type classification. | Liva Ralaivola, Benot Favre, Pierre Gotab, Frdric Bchet, Graldine Damnati |
| 2011 | Derivative kernels for noise robust ASR. | Anton Ragni, Mark J. F. Gales |
| 2011 | Strategies for using MLP based features with limited target-language training data. | Yanmin Qian, Ji Xu, Daniel Povey, Jia Liu |
| 2011 | Alignment of spoken narratives for automated neuropsychological assessment. | Emily Tucker Prud'hommeaux, Brian Roark |
| 2011 | A factored conditional random field model for articulatory feature forced transcription. | Rohit Prabhavalkar, Eric Fosler-Lussier, Karen Livescu |
| 2011 | Speaker adaptation with an Exponential Transform. | Daniel Povey, Geoffrey Zweig, Alex Acero |
| 2011 | Cross-lingual portability of Chinese and english neural network features for French and German LVCSR. | Christian Plahl, Ralf Schlter, Hermann Ney |
| 2011 | Leveraging large amounts of loosely transcribed corporate videos for acoustic model training. | Matthias Paulik, Panchi Panchapagesan |
| 2011 | Sparse Maximum A Posteriori adaptation. | Peder A. Olsen, Jing Huang, Vaibhava Goel, Steven J. Rennie |
| 2011 | Detection of precisely transcribed parts from inexact transcribed corpus. | Kengo Ohta, Masatoshi Tsuchiya, Seiichi Nakagawa |
| 2011 | Bidirectional OM-LSA speech estimator for noise robust speech recognition. | Yasunari Obuchi, Ryu Takeda, Masahito Togami |
| 2011 | Designing text corpus using phone-error distribution for acoustic modeling. | Hiroko Murakami, Koichi Shinoda, Sadaoki Furui |
| 2011 | Robust speech recognition using articulatory gestures in a Dynamic Bayesian Network framework. | Vikramjit Mitra, Hosung Nam, Carol Y. Espy-Wilson |
| 2011 | Strategies for training large scale neural network language models. | Toms Mikolov, Anoop Deoras, Daniel Povey, Luks Burget, Jan Cernock |
| 2011 | Subword-based multi-span pronunciation adaptation for recognizing accented speech. | Timo Mertens, Kit Thambiratnam, Frank Seide |
| 2011 | Subword-based automatic lexicon learning for Speech Recognition. | Timo Mertens, Stephanie Seneff |
| 2011 | Wizard of Oz evaluation of listening-oriented dialogue control using POMDP. | Toyomi Meguro, Yasuhiro Minami, Ryuichiro Higashinaka, Kohji Dohsaka |
| 2011 | The IBM 2011 GALE Arabic speech transcription system. | Lidia Mangu, Hong-Kwang Kuo, Stephen M. Chu, Brian Kingsbury, George Saon, Hagen Soltau, Fadi Biadsy |
| 2011 | Decision of response timing for incremental speech recognition with reinforcement learning. | Di Lu, Takuya Nishimoto, Nobuaki Minematsu |
| 2011 | Regularized subspace Gaussian mixture models for cross-lingual speech recognition. | Liang Lu, Arnab Ghoshal, Steve Renals |