| 2011 | Towards choosing better primes for spoken dialog systems. | Jos Lopes, Maxine Esknazi, Isabel Trancoso |
| 2011 | Latent semantic analysis for question classification with neural networks. | Babak Loni, Seyedeh Halleh Khoshnevis, Pascal Wiggers |
| 2011 | A dialogue system for accessing drug reviews. | Jingjing Liu, Stephanie Seneff |
| 2011 | Minimum Bayes risk discriminative language models for Arabic speech recognition. | Hong-Kwang Jeff Kuo, Ebru Arisoy, Lidia Mangu, George Saon |
| 2011 | Maximum kurtosis beamforming with a subspace filter for distant speech recognition. | Ken'ichi Kumatani, John W. McDonough, Bhiksha Raj |
| 2011 | Estimating document frequencies in a speech corpus. | Damianos Karakos, Mark Dredze, Ken Ward Church, Aren Jansen, Sanjeev Khudanpur |
| 2011 | iVector-based discriminative adaptation for automatic speech recognition. | Martin Karafit, Luks Burget, Pavel Matejka, Ondrej Glembek, Jan Cernock |
| 2011 | Efficient spoken term discovery using randomized algorithms. | Aren Jansen, Benjamin Van Durme |
| 2011 | Robust seed model training for speaker adaptation using pseudo-speaker features generated by inverse CMLLR transformation. | Arata Itoh, Sunao Hara, Norihide Kitaoka, Kazuya Takeda |
| 2011 | Blind noise suppression for Non-Audible Murmur recognition with stereo signal processing. | Shunta Ishii, Tomoki Toda, Hiroshi Saruwatari, Sakriani Sakti, Satoshi Nakamura |
| 2011 | Fast and flexible Kullback-Leibler divergence based acoustic modeling for non-native speech recognition. | David Imseng, Ramya Rasipuram, Mathew Magimai-Doss |
| 2011 | Bootstrapping a spoken language identification system using unsupervised integrated sensing and processing decision trees. | Shuai Huang, Damianos Karakos, Glen A. Coppersmith, Kenneth Ward Church, Sabato Marco Siniscalchi |
| 2011 | A novel neural-based pronunciation modeling method for robust speech recognition. | Guangpu Huang, Meng Joo Er |
| 2011 | Building a conversational model from two-tweets. | Ryuichiro Higashinaka, Noriaki Kawamae, Kugatsu Sadamitsu, Yasuhiro Minami, Toyomi Meguro, Kohji Dohsaka, Hirohito Inagaki |
| 2011 | Topic modeling for spoken documents using only phonetic information. | Timothy J. Hazen, Man-Hung Siu, Herbert Gish, Steve Lowe, Arthur Chan |
| 2011 | Employing web search query click logs for multi-domain spoken language understanding. | Dilek Hakkani-Tr, Gkhan Tr, Larry P. Heck, Asli Celikyilmaz, Ashley Fidler, Dustin Hillard, Rukmini Iyer, Sarangarajan Parthasarathy |
| 2011 | Study of probabilistic and Bottle-Neck features in multilingual environment. | Frantisek Grzl, Martin Karafit, Milos Janda |
| 2011 | Fast speaker diarization using a high-level scripting language. | Ekaterina Gonina, Gerald Friedland, Henry Cook, Kurt Keutzer |
| 2011 | Don't multiply lightly: Quantifying problems with the acoustic model assumptions in speech recognition. | Dan Gillick, Larry Gillick, Steven Wegmann |
| 2011 | An hierarchical exemplar-based sparse model of speech, with an application to ASR. | Jort F. Gemmeke, Hugo Van hamme |
| 2011 | On-line policy optimisation of spoken dialogue systems via live interaction with human subjects. | Milica Gasic, Filip Jurccek, Blaise Thomson, Kai Yu, Steve J. Young |
| 2011 | N-Best rescoring by adaboost phoneme classifiers for isolated word recognition. | Hiroshi Fujimura, Masanobu Nakamura, Yusuke Shinohara, Takashi Masuko |
| 2011 | Gain estimation approaches in catalog-based single-channel speech-music separation. | Cemil Demir, Ali Taylan Cemgil, Murat Saraclar |
| 2011 | A variational perspective on noise-robust speech recognition. | Rogier C. van Dalen, Mark J. F. Gales |
| 2011 | Efficient representation and fast look-up of Maximum Entropy language models. | Jia Cui, Stanley F. Chen, Bowen Zhou |