| 2022 | SIGdial | Building a Knowledge-Based Dialogue System with Text Infilling. | Qiang Xue, Tetsuya Takiguchi, Yasuo Ariki |
| 2020 | ICASSP | Two-Step Acoustic Model Adaptation for Dysarthric Speech Recognition. | Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2020 | Interspeech | Dysarthric Speech Recognition Based on Deep Metric Learning. | Yuki Takashima, Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2019 | CVPR | On Zero-Shot Recognition of Generic Objects. | Tristan Hascoet, Yasuo Ariki, Tetsuya Takiguchi |
| 2019 | ICASSP | End-to-end Dysarthric Speech Recognition Using Multiple Databases. | Yuki Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2018 | ICASSP | Parallel-Data-Free Dictionary Learning for Voice Conversion Using Non-Negative Tucker Decomposition. | Yuki Takashima, Hajime Yano, Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2017 | Interspeech | Phoneme-Discriminative Features for Dysarthric Speech Conversion. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2017 | Interspeech | Emotional Voice Conversion with Adaptive Scales F0 Based on Wavelet Transform Using Limited Amount of Emotional Data. | Zhaojie Luo, Jinhui Chen, Tetsuya Takiguchi, Yasuo Ariki |
| 2017 | MVA | Visual-to-speech conversion based on maximum likelihood estimation. | Rina Ra, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | ACCV | Expression Recognition with Ri-HOG Cascade. | Jinhui Chen, Zhaojie Luo, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | ICASSP | Semi-non-negative matrix factorization using alternating direction method of multipliers for voice conversion. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | ICASSP | Modeling deep bidirectional relationships for image classification and generation. | Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | Interspeech | Parallel Dictionary Learning for Voice Conversion Using Discriminative Graph-Embedded Non-Negative Matrix Factorization. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | Interspeech | Audio-Visual Speech Recognition Using Bimodal-Trained Bottleneck Features for a Person with Severe Hearing Loss. | Yuki Takashima, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki, Nobuyuki Mitani, Kiyohiro Omori, Kaoru Nakazono |
| 2015 | ACII | Facial expression recognition with multithreaded cascade of rotation-invariant HOG. | Jinhui Chen, Tetsuya Takiguchi, Yasuo Ariki |
| 2015 | ICASSP | Activity-mapping non-negative matrix factorization for exemplar-based voice conversion. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2015 | ICIP | Multithreading AdaBoost framework for object recognition. | Jinhui Chen, Tetsuya Takiguchi, Yasuo Ariki |
| 2015 | ICMI | Individuality-Preserving Voice Reconstruction for Articulation Disorders Using Text-to-Speech Synthesis. | Reina Ueda, Tetsuya Takiguchi, Yasuo Ariki |
| 2015 | IJCAI | Word-Error Correction of Continuous Speech Recognition Based on Normalized Relevance Distance. | Yohei Fusayasu, Katsuyuki Tanaka, Tetsuya Takiguchi, Yasuo Ariki |
| 2015 | Interspeech | Many-to-many voice conversion based on multiple non-negative matrix factorization. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ACCV | A Robust Learning Framework Using PSM and Ameliorated SVMs for Emotional Recognition. | Jinhui Chen, Yosuke Kitano, Yiting Li, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ACCV | Task-Driven Saliency Detection on Music Video. | Shunsuke Numano, Naoko Enami, Yasuo Ariki |
| 2014 | ICASSP | Voice conversion based on Non-negative matrix factorization using phoneme-categorized dictionary. | Ryo Aihara, Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ICASSP | Multimodal voice conversion using non-negative matrix factorization in noisy environments. | Kenta Masaka, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ICASSP | Voice conversion in time-invariant speaker-independent space. | Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ICMI | Selection of an Object Requested by Speech Based on Generic Object Recognition. | Hitoshi Nishimura, Yuko Ozasa, Yasuo Ariki, Mikio Nakano |
| 2014 | ICPR | 3D-Object Recognition Based on LLC Using Depth Spatial Pyramid. | Toru Nakashika, Takafumi Hori, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ICPR | Selection of Unknown Objects Specified by Speech Using Models Constructed from Web Images. | Hitoshi Nishimura, Yuko Ozasa, Yasuo Ariki, Mikio Nakano |
| 2014 | Interspeech | Error correction of automatic speech recognition based on normalized web distance. | E. Byambakhishig, Katsuyuki Tanaka, Ryo Aihara, Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | Interspeech | Multimodal exemplar-based voice conversion using lip features in noisy environments. | Kenta Masaka, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | Interspeech | High-order sequence modeling using speaker-dependent recurrent temporal restricted boltzmann machines for voice conversion. | Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | ICASSP | Individuality-preserving voice conversion for articulation disorders based on non-negative matrix factorization. | Ryo Aihara, Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | ICASSP | Sparse representation for outliers suppression in semi-supervised image annotation. | Toru Nakashika, Takeshi Okumura, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | ICASSP | Prediction of unlearned position based on local regression for single-channel talker localization using acoustic transfer function. | Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | Interspeech | Exemplar-based individuality-preserving voice conversion for articulation disorders in noisy environments. | Ryo Aihara, Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | Interspeech | Voice conversion in high-order eigen space using deep belief nets. | Toru Nakashika, Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | Interspeech | Two-step correction of speech recognition errors based on n-gram and long contextual information. | Ryohei Nakatani, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | MVA | Unknown Object Identification Using Category Visual Words with Rejection Function. | Yuto Tanaka, Yasuo Ariki, Tetsuya Takiguchi |
| 2012 | ACCV | Disambiguation in Unknown Object Detection by Integrating Image and Speech Recognition Confidences. | Yuko Ozasa, Yasuo Ariki, Mikio Nakano, Naoto Iwahashi |
| 2012 | ICASSP | Generic object recognition by graph structural expression. | Takahiro Hori, Tetsuya Takiguchi, Yasuo Ariki |
| 2012 | ICASSP | Super-resolution by GMM based conversion using self-reduction image. | Yuki Ogawa, Yasuo Ariki, Tetsuya Takiguchi |
| 2012 | ICASSP | A new multiple-kernel-learning weighting method for localizing human brain magnetic activity. | Tetsuya Takiguchi, Toshiaki Imada, Ryoichi Takashima, Yasuo Ariki, Jo-Fu Lotus Lin, Patricia K. Kuhl, Masaki Kawakatsu, Makoto Kotani |
| 2012 | ICASSP | Acoustic model transformations based on random projections. | Tetsuya Takiguchi, Mariko Yoshii, Yasuo Ariki, Jeff A. Bilmes |
| 2012 | ICPR | 3D tracking of soccer players using time-situation graph in monocular image sequence. | Hiroki Itoh, Tetsuya Takiguchi, Yasuo Ariki |
| 2012 | Interspeech | Estimation of Talker's Head Orientation Based on Discrimination of the Shape of Cross-power Spectrum Phase Coefficients. | Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2012 | ISM | Super-resolution Using GMM and PLS Regression. | Yuki Ogawa, Takahiro Hori, Tetsuya Takiguchi, Yasuo Ariki |
| 2011 | ICASSP | Generic object recognition using automatic region extraction and dimensional feature integration utilizing multiple kernel learning. | Toru Nakashika, Akira Suga, Tetsuya Takiguchi, Yasuo Ariki |
| 2011 | ICASSP | Feature selection based on Multiple Kernel Learning for single-channel sound source localization using the acoustic transfer function. | Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2011 | Interspeech | Probabilistic Spectrum Envelope: Categorized Audio-Features Representation for NMF-Based Sound Decomposition. | Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2011 | Interspeech | Single-Channel Head Orientation Estimation Based on Discrimination of Acoustic Transfer Function. | Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2011 | MMM | Image Annotation with Concept Level Feature Using PLSA+CCA. | Yu Zheng, Tetsuya Takiguchi, Yasuo Ariki |
| 2011 | PSIVT | Audio-Visual Speech Recognition Based on AAM Parameter and Phoneme Analysis of Visual Feature. | Yuto Komai, Yasuo Ariki, Tetsuya Takiguchi |
| 2010 | ACCV | Gaze Estimation Using Regression Analysis and AAMs Parameters Selected Based on Information Criterion. | Manabu Takatani, Yasuo Ariki, Tetsuya Takiguchi |
| 2010 | DIS | Why Text Segment Classification Based on Part of Speech Feature Selection. | Iulia Nagy, Katsuyuki Tanaka, Yasuo Ariki |
| 2010 | ICASSP | HMM-based separation of acoustic transfer function for single-channel sound source localization. | Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2010 | ICASSP | Evaluation of random-projection-based feature combination on speech recognition. | Tetsuya Takiguchi, Jeff A. Bilmes, Mariko Yoshii, Yasuo Ariki |
| 2010 | ICASSP | Structuring a gene network using a multiresolution independence test. | Takayuki Yamamoto, Tetsuya Takiguchi, Yasuo Ariki |
| 2010 | ICPR | Generic Object Recognition by Tree Conditional Random Field Based on Hierarchical Segmentation. | Takeshi Okumura, Tetsuya Takiguchi, Yasuo Ariki |
| 2010 | ICPR | Learning an Efficient and Robust Graph Matching Procedure for Specific Object Recognition. | Jrme Revaud, Guillaume Lavou, Yasuo Ariki, Atilla Baskurt |
| 2010 | Interspeech | Speech synthesis by modeling harmonics structure with multiple function. | Toru Nakashika, Ryuki Tachibana, Masafumi Nishimura, Tetsuya Takiguchi, Yasuo Ariki |
| 2010 | MMSP | Multimodal speech recognition of a person with articulation disorders using AAM and MAF. | Chikoto Miyamoto, Yuto Komai, Tetsuya Takiguchi, Yasuo Ariki, Ichao Li |
| 2009 | ACCV | Human Action Recognition Using HDP by Integrating Motion and Location Information. | Yasuo Ariki, Takuya Tonaru, Tetsuya Takiguchi |
| 2009 | FUSION | Monaural sound-source-direction estimation using the acoustic transfer function of an active microphone. | Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2009 | Interspeech | System request detection in human conversation based on multi-resolution Gabor wavelet features. | Tomoyuki Yamagata, Tetsuya Takiguchi, Yasuo Ariki |
| 2008 | ICPR | 3D human posture estimation using the HOG features from monocular image. | Katsunori Onishi, Tetsuya Takiguchi, Yasuo Ariki |
| 2008 | ICPR | Object recognition and segmentation using SIFT and Graph Cuts. | Akira Suga, Keita Fukuda, Tetsuya Takiguchi, Yasuo Ariki |
| 2008 | Interspeech | Integration of metamodel and acoustic model for speech recognition. | Hironori Matsumasa, Tetsuya Takiguchi, Yasuo Ariki, Ichao Li, Toshitaka Nakabayashi |
| 2008 | Interspeech | Sudden noise reduction based on GMM with noise power estimation. | Nobuyuki Miyake, Tetsuya Takiguchi, Yasuo Ariki |
| 2008 | MMM | Tagging Video Contents with Positive/Negative Interest Based on User's Facial Expression. | Masanori Miyahara, Masaki Aoki, Tetsuya Takiguchi, Yasuo Ariki |
| 2007 | Interspeech | PCA-based feature extraction for fluctuation in speaking style of articulation disorders. | Hironori Matsumasa, Tetsuya Takiguchi, Yasuo Ariki, Ichao Li, Toshitaka Nakabayashi |
| 2007 | Interspeech | Language modeling using PLSA-based topic HMM. | Atsushi Sako, Tetsuya Takiguchi, Yasuo Ariki |
| 2007 | Interspeech | System request detection in conversation based on acoustic and speaker alternation features. | Tomoyuki Yamagata, Atsushi Sako, Tetsuya Takiguchi, Yasuo Ariki |
| 2006 | ICASSP | Robust Feature Extraction using Kernel PCA. | Tetsuya Takiguchi, Yasuo Ariki |
| 2006 | Interspeech | Phoneme recognition based on fisher weight map to higher-order local auto-correlation. | Yasuo Ariki, Shunsuke Kato, Tetsuya Takiguchi |
| 2006 | ISM | Automatic Production System of Soccer Sports Video by Digital Camera Work Based on Situation Recognition. | Yasuo Ariki, Shintaro Kubota, Masahito Kumano |
| 2005 | ICASSP | Structuring Baseball Live Games Based on Speech Recognition Using Task Dependent Knowledge and Emotion State Recognition. | Atsushi Sako, Yasuo Ariki |
| 2005 | Interspeech | Situation based speech recognition for structuring baseball live games. | Atsushi Sako, Tetsuya Takiguchi, Yasuo Ariki |
| 2004 | ICASSP | Robust speech recognition in additive and channel noise environments using GMM and EM algorithm. | Masakiyo Fujimoto, Yasuo Ariki |
| 2004 | Interspeech | Structuring of baseball live games based on speech recognition using task dependant knowledge. | Atsushi Sako, Yasuo Ariki |
| 2003 | Interspeech | Live speech recognition in sports games by adaptation of acoustic model and language model. | Yasuo Ariki, Takeru Shigemori, Tsuyoshi Kaneko, Jun Ogata, Masakiyo Fujimoto |
| 2003 | Interspeech | Combination of temporal domain SVD based speech enhancement and GMM based speech estimation for ASR in noise - evaluation on the AURORA2 task -. | Masakiyo Fujimoto, Yasuo Ariki |
| 2003 | Interspeech | Syllable-based acoustic modeling for Japanese spontaneous speech recognition. | Jun Ogata, Yasuo Ariki |
| 2003 | Interspeech | Topic segmentation and retrieval system for lecture videos based on spontaneous speech recognition. | Natsuo Yamamoto, Jun Ogata, Yasuo Ariki |
| 2002 | ICPR | Video Editing Support System Based on Video Grammar and Content Analysis. | Masahito Kumano, Yasuo Ariki, Miki Amano, Kuniaki Uehara, Kenji Shunto, Kiyoshi Tsukada |
| 2002 | Interspeech | English call system with functions of speech segmentation and pronunciation evaluation using speech recognition technology. | Yasuo Ariki, Jun Ogata |
| 2002 | Interspeech | Evaluation of noisy speech recognition based on noise reduction and acoustic model adaptation on the Aurora2 tasks. | Masakiyo Fujimoto, Yasuo Ariki |
| 2002 | Interspeech | Unsupervised acoustic model adaptation based on phoneme error minimization. | Jun Ogata, Yasuo Ariki |
| 2002 | MVA | Automatic Useful Shot Extraction for a Video Editing Support System. | Masahito Kumano, Yasuo Ariki |
| 2001 | ICASSP | Continuous speech recognition under non-stationary musical environments based on speech state transition model. | Masakiyo Fujimoto, Yasuo Ariki |
| 2001 | Interspeech | Speech recognition under musical environments using kalman filter and iterative MLLR adaptation. | Masakiyo Fujimoto, Yasuo Ariki |
| 2001 | Interspeech | Speaker recognition by separating phonetic space and speaker space. | Masafumi Nishida, Yasuo Ariki |
| 2001 | Interspeech | Improved speech recognition using iterative decoding based on confidence measures. | Jun Ogata, Yasuo Ariki |
| 2000 | ADBIS | An Advanced Processing Environment for Managing the Continuous and Semistructured Features of Multimedia Content. | Shojiro Nishio, Katsumi Tanaka, Yasuo Ariki, Shinji Shimojo, Masahiko Tsukamoto, Masatoshi Arikawa, Keishi Tajima, Kaname Harumoto |
| 2000 | ICASSP | Noisy speech recognition using noise reduction method based on Kalman filter. | Masakiyo Fujimoto, Yasuo Ariki |
| 2000 | Interspeech | Large vocabulary continuous speech recognition under real environments using adaptive sub-band spectral subtraction. | Masahiro Fujimoto, Jun Ogata, Yasuo Ariki |
| 2000 | Interspeech | Speaker verification by integrating dynamic and static features using subspace method. | Masafumi Nishida, Yasuo Ariki |
| 2000 | Interspeech | An efficient lexical tree search for large vocabulary continuous speech recognition. | Jun Ogata, Yasuo Ariki |
| 2000 | Interspeech | Expanded vector space model based on word space in cross media retrieval of news speech data. | Seiichi Takao, Jun Ogata, Yasuo Ariki |
| 1999 | ICDAR | Telop and Flip Frame Detection and Character Extraction from TV News Articles. | Yasuo Ariki, Katsumi Matsuura, Seiichi Takao |
| 1999 | Interspeech | Effectiveness of KL-transformation in spectral delta expansion. | M. Tokuhira, Yasuo Ariki |
| 1998 | ACCV | Human Information Retrieval by Face Extraction and Recognition on TV News Images Using Subspace Method. | Yasuo Ariki, Noriyuki Ishikawa, Yoshiaki Sugiyama |
| 1998 | ICASSP | Unsupervised speaker normalization using canonical correlation analysis. | Yasuo Ariki, Miharu Sakuragi |
| 1998 | ICPR | Classification of TV sports news by DCT features using multiple subspace method. | Yasuo Ariki, Yoshiaki Sugiyama |
| 1998 | Interspeech | Real time speaker indexing based on subspace method - application to TV news articles and debate. | Masafumi Nishida, Yasuo Ariki |
| 1998 | Interspeech | Indexing and classification of TV news articles based on speech dictation using word bigram. | Jun Ogata, Yasuo Ariki |
| 1997 | CoopIS | A TV News Retrieval System with Interactive Query Function. | Yasuo Ariki, Yoshiaki Sugiyama |
| 1997 | ICASSP | Effectiveness of speaker normalized HMM by projection to speaker subspace. | Yasuo Ariki |
| 1997 | ICDAR | Indexing and Classification of TV News Articles Based on Telop Recognition. | Yasuo Ariki, T. Teranishi |
| 1996 | ICASSP | Speaker recognition and speaker normalization by projection to speaker subspace. | Yasuo Ariki, Shigeaki Tagashira, Masayuki Nishijima |
| 1996 | ICIP | Extraction of TV news articles based on scene cut detection using DCT clustering. | Yasuo Ariki, Y. Saito |
| 1996 | ICPR | Integration of face and speaker recognition by subspace method. | Yasuo Ariki, Noriyuki Ishikawa |
| 1996 | Interspeech | An enquiring system of unknown words in TV news by spontaneous repetition (application of speaker normalization by speaker subspace projection). | Yasuo Ariki, Shigeaki Tagashira |
| 1995 | ICDAR | Segmentation and recognition of handwritten characters using subspace method. | Yasuo Ariki, Y. Motegi |
| 1994 | ICASSP | Phoneme recognition improvement by restricting training section in concatenated HMM training. | Yasuo Ariki, Keisuke Doi |
| 1994 | Interspeech | Speaker recognition based on subspace methods. | Yasuo Ariki, Keisuke Doi |
| 1994 | Interspeech | Simultaneous spotting of phonemes and words in continuous speech. | Yasuo Ariki, T. Kawamura |
| 1990 | ICASSP | OSPREY: a transputer based continuous speech recognition system. | Andrew M. Sutherland, M. Campbell, Yasuo Ariki, Mervyn A. Jack |
| 1990 | Interspeech | Phoneme probability presentation of continuous speech. | Yasuo Ariki, Mervyn A. Jack |
| 1990 | Interspeech | Optimisation of English phoneme recognition based on HMM. | Yasuo Ariki, Andrew M. Sutherland, Mervyn A. Jack |
| 1989 | ICASSP | Hierarchical phoneme discrimination by hidden Markov modelling using cepstrum and formant information. | Yasuo Ariki, Fergus R. McInnes, Mervyn A. Jack |
| 1989 | Interspeech | Enhancement and optimisation of a speech recognition front end based on hidden Markov models. | Fergus R. McInnes, Yasuo Ariki, Alan Wrench |
| 1987 | IJCAI | Uncertainty Reduction Paradigm Using Structural Knowledge in Line-Drawing Understanding. | Yasuo Ariki, Masashi Morimoto, Toshiyuki Sakai |
| 1987 | Interspeech | Spoken word recognition using statistic and dynamic information obtained by two-dimensional cepstrum analysis. | Yasuo Ariki, S. Mizuta, Masaaki Nagata, Toshiyuki Sakai |
| 1987 | Interspeech | Continuous speech understanding by keyword extraction in a voice mail system. | Yasuo Ariki, H. Ohkawa, Toshiyuki Sakai |
| 1986 | ICASSP | Acoustic noise reduction by two dimensional spectral smoothing and spectral amplitude transformation. | Yasuo Ariki, K. Kajimoto, Toshiyuki Sakai |