Takuya Yoshioka
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
104
Venues
11
Active years
2007–2024
Best venue rank
A*
Where they publish
Papers
104 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | CHI | Look Once to Hear: Target Speech Hearing with Noisy Examples. | Bandhav Veluri, Malek Itani, Tuochao Chen, Takuya Yoshioka, Shyamnath Gollakota |
| 2024 | EMNLP | i-Code Studio: A Configurable and Composable Framework for Integrative AI. | Yuwei Fang, Mahmoud Khademi, Chenguang Zhu, Ziyi Yang, Reid Pryzant, Yichong Xu, Yao Qian, Takuya Yoshioka, Lu Yuan, Michael Zeng, Xuedong Huang |
| 2024 | ICASSP | Profile-Error-Tolerant Target-Speaker Voice Activity Detection. | Dongmei Wang, Xiong Xiao, Naoyuki Kanda, Midia Yousefi, Takuya Yoshioka, Jian Wu |
| 2024 | ICASSP | T-SOT FNT: Streaming Multi-Talker ASR with Text-Only Domain Adaptation Capability. | Jian Wu, Naoyuki Kanda, Takuya Yoshioka, Rui Zhao, Zhuo Chen, Jinyu Li |
| 2024 | ICASSP | Diarist: Streaming Speech Translation with Speaker Diarization. | Mu Yang, Naoyuki Kanda, Xiaofei Wang, Jun-Kun Chen, Peidong Wang, Jian Xue, Jinyu Li, Takuya Yoshioka |
| 2024 | Interspeech | Target conversation extraction: Source separation using turn-taking dynamics. | Tuochao Chen, Qirui Wang, Bohan Wu, Malek Itani, Sefik Emre Eskimez, Takuya Yoshioka, Shyamnath Gollakota |
| 2024 | Interspeech | Knowledge boosting during low-latency inference. | Vidya Srinivas, Malek Itani, Tuochao Chen, Sefik Emre Eskimez, Takuya Yoshioka, Shyamnath Gollakota |
| 2024 | NAACL | i-Code V2: An Autoregressive Generation Framework over Vision, Language, and Speech Data. | Ziyi Yang, Mahmoud Khademi, Yichong Xu, Reid Pryzant, Yuwei Fang, Chenguang Zhu, Dongdong Chen, Yao Qian, Xuemei Gao, Yi-Ling Chen, Robert Gmyr, Naoyuki Kanda, Noel Codella, Bin Xiao, Yu Shi, Lu Yuan, Takuya Yoshioka, Michael Zeng, Xuedong Huang |
| 2024 | QCE | Electric Power Demand Portfolio Optimization by Fermionic QAOA with Self-Consistent Local Field Modulation. | Takuya Yoshioka, Keita Sasada, Yuichiro Nakano, Keisuke Fujii |
| 2023 | AAAI | i-Code: An Integrative and Composable Multimodal Learning Framework. | Ziyi Yang, Yuwei Fang, Chenguang Zhu, Reid Pryzant, Dongdong Chen, Yu Shi, Yichong Xu, Yao Qian, Mei Gao, Yi-Ling Chen, Liyang Lu, Yujia Xie, Robert Gmyr, Noel Codella, Naoyuki Kanda, Bin Xiao, Lu Yuan, Takuya Yoshioka, Michael Zeng, Xuedong Huang |
| 2023 | ICASSP | Speech Separation with Large-Scale Self-Supervised Learning. | Zhuo Chen, Naoyuki Kanda, Jian Wu, Yu Wu, Xiaofei Wang, Takuya Yoshioka, Jinyu Li, Sunit Sivasankaran, Sefik Emre Eskimez |
| 2023 | ICASSP | Self-Supervised Learning with Bi-Label Masked Speech Prediction for Streaming Multi-Talker Speech Recognition. | Zili Huang, Zhuo Chen, Naoyuki Kanda, Jian Wu, Yiming Wang, Jinyu Li, Takuya Yoshioka, Xiaofei Wang, Peidong Wang |
| 2023 | ICASSP | Vararray Meets T-Sot: Advancing the State of the Art of Streaming Distant Conversational Speech Recognition. | Naoyuki Kanda, Jian Wu, Xiaofei Wang, Zhuo Chen, Jinyu Li, Takuya Yoshioka |
| 2023 | ICASSP | Target Sound Extraction with Variable Cross-Modality Clues. | Chenda Li, Yao Qian, Zhuo Chen, Dongmei Wang, Takuya Yoshioka, Shujie Liu, Yanmin Qian, Michael Zeng |
| 2023 | ICASSP | Breaking the Trade-Off in Personalized Speech Enhancement With Cross-Task Knowledge Distillation. | Hassan Taherian, Sefik Emre Eskimez, Takuya Yoshioka |
| 2023 | ICASSP | Real-Time Target Sound Extraction. | Bandhav Veluri, Justin Chan, Malek Itani, Tuochao Chen, Takuya Yoshioka, Shyamnath Gollakota |
| 2023 | ICASSP | DATA2VEC-SG: Improving Self-Supervised Learning Representations for Speech Generation Tasks. | Heming Wang, Yao Qian, Hemin Yang, Naoyuki Kanda, Peidong Wang, Takuya Yoshioka, Xiaofei Wang, Yiming Wang, Shujie Liu, Zhuo Chen, DeLiang Wang, Michael Zeng |
| 2023 | ICASSP | Target Speaker Voice Activity Detection with Transformers and Its Integration with End-To-End Neural Diarization. | Dongmei Wang, Xiong Xiao, Naoyuki Kanda, Takuya Yoshioka, Jian Wu |
| 2023 | ICASSP | Simulating Realistic Speech Overlaps Improves Multi-Talker ASR. | Muqiao Yang, Naoyuki Kanda, Xiaofei Wang, Jian Wu, Sunit Sivasankaran, Zhuo Chen, Jinyu Li, Takuya Yoshioka |
| 2023 | Interspeech | Real-Time Joint Personalized Speech Enhancement and Acoustic Echo Cancellation. | Sefik Emre Eskimez, Takuya Yoshioka, Alex Ju, Min Tang, Tanel Prnamaa, Huaming Wang |
| 2023 | Interspeech | Factual Consistency Oriented Speech Recognition. | Naoyuki Kanda, Takuya Yoshioka, Yang Liu |
| 2023 | Interspeech | Adapting Multi-Lingual ASR Models for Handling Multiple Talkers. | Chenda Li, Yao Qian, Zhuo Chen, Naoyuki Kanda, Dongmei Wang, Takuya Yoshioka, Yanmin Qian, Michael Zeng |
| 2023 | Interspeech | Speaker Diarization for ASR Output with T-vectors: A Sequence Classification Approach. | Midia Yousefi, Naoyuki Kanda, Dongmei Wang, Zhuo Chen, Xiaofei Wang, Takuya Yoshioka |
| 2023 | QCE | Experimental Demonstration of Fermionic QAOA with One-Dimensional Cyclic Driver Hamiltonian. | Takuya Yoshioka, Keita Sasada, Yuichiro Nakano, Keisuke Fujii |
| 2023 | UIST | Semantic Hearing: Programming Acoustic Scenes with Binaural Hearables. | Bandhav Veluri, Malek Itani, Justin Chan, Takuya Yoshioka, Shyamnath Gollakota |
| 2022 | ICASSP | Icassp 2022 Deep Noise Suppression Challenge. | Harishchandra Dubey, Vishak Gopal, Ross Cutler, Ashkan Aazami, Sergiy Matusevych, Sebastian Braun, Sefik Emre Eskimez, Manthan Thakker, Takuya Yoshioka, Hannes Gamper, Robert Aichner |
| 2022 | ICASSP | Personalized speech enhancement: new models and Comprehensive evaluation. | Sefik Emre Eskimez, Takuya Yoshioka, Huaming Wang, Xiaofei Wang, Zhuo Chen, Xuedong Huang |
| 2022 | ICASSP | Transcribe-to-Diarize: Neural Speaker Diarization for Unlimited Number of Speakers Using End-to-End Speaker-Attributed ASR. | Naoyuki Kanda, Xiong Xiao, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2022 | ICASSP | One Model to Enhance Them All: Array Geometry Agnostic Multi-Channel Personalized Speech Enhancement. | Hassan Taherian, Sefik Emre Eskimez, Takuya Yoshioka, Huaming Wang, Zhuo Chen, Xuedong Huang |
| 2022 | ICASSP | Improving Noise Robustness of Contrastive Speech Representation Learning with Speech Reconstruction. | Heming Wang, Yao Qian, Xiaofei Wang, Yiming Wang, Chengyi Wang, Shujie Liu, Takuya Yoshioka, Jinyu Li, DeLiang Wang |
| 2022 | ICASSP | Picknet: Real-Time Channel Selection for Ad Hoc Microphone Arrays. | Takuya Yoshioka, Xiaofei Wang, Dongmei Wang |
| 2022 | ICASSP | VarArray: Array-Geometry-Agnostic Continuous Speech Separation. | Takuya Yoshioka, Xiaofei Wang, Dongmei Wang, Min Tang, Zirun Zhu, Zhuo Chen, Naoyuki Kanda |
| 2022 | ICASSP | Continuous Speech Separation with Recurrent Selective Attention Network. | Yixuan Zhang, Zhuo Chen, Jian Wu, Takuya Yoshioka, Peidong Wang, Zhong Meng, Jinyu Li |
| 2022 | ICASSP | All-Neural Beamformer for Continuous Speech Separation. | Zhuohuang Zhang, Takuya Yoshioka, Naoyuki Kanda, Zhuo Chen, Xiaofei Wang, Dongmei Wang, Sefik Emre Eskimez |
| 2022 | Interspeech | Streaming Speaker-Attributed ASR with Token-Level Speaker Embeddings. | Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka |
| 2022 | Interspeech | Streaming Multi-Talker ASR with Token-Level Serialized Output Training. | Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka |
| 2022 | Interspeech | Fast Real-time Personalized Speech Enhancement: End-to-End Enhancement Network (E3Net) and Knowledge Distillation. | Manthan Thakker, Sefik Emre Eskimez, Takuya Yoshioka, Huaming Wang |
| 2022 | Interspeech | Leveraging Real Conversational Data for Multi-Channel Continuous Speech Separation. | Xiaofei Wang, Dongmei Wang, Naoyuki Kanda, Sefik Emre Eskimez, Takuya Yoshioka |
| 2022 | Interspeech | Separating Long-Form Speech with Group-wise Permutation Invariant Training. | Wangyou Zhang, Zhuo Chen, Naoyuki Kanda, Shujie Liu, Jinyu Li, Sefik Emre Eskimez, Takuya Yoshioka, Xiong Xiao, Zhong Meng, Yanmin Qian, Furu Wei |
| 2021 | ASRU | A Comparative Study of Modular and Joint Approaches for Speaker-Attributed ASR on Monaural Long-Form Audio. | Naoyuki Kanda, Xiong Xiao, Jian Wu, Tianyan Zhou, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | ICASSP | Hypothesis Stitcher for End-to-End Speaker-Attributed ASR on Long-Form Multi-Talker Recordings. | Xuankai Chang, Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Takuya Yoshioka |
| 2021 | ICASSP | Don't Shoot Butterfly with Rifles: Multi-Channel Continuous Speech Separation with Early Exit Transformer. | Sanyuan Chen, Yu Wu, Zhuo Chen, Takuya Yoshioka, Shujie Liu, Jin-Yu Li, Xiangzhan Yu |
| 2021 | ICASSP | Continuous Speech Separation with Conformer. | Sanyuan Chen, Yu Wu, Zhuo Chen, Jian Wu, Jinyu Li, Takuya Yoshioka, Chengyi Wang, Shujie Liu, Ming Zhou |
| 2021 | ICASSP | Minimum Bayes Risk Training for End-to-End Speaker-Attributed ASR. | Naoyuki Kanda, Zhong Meng, Liang Lu, Yashesh Gaur, Xiaofei Wang, Zhuo Chen, Takuya Yoshioka |
| 2021 | ICASSP | Microsoft Speaker Diarization System for the Voxceleb Speaker Recognition Challenge 2020. | Xiong Xiao, Naoyuki Kanda, Zhuo Chen, Tianyan Zhou, Takuya Yoshioka, Sanyuan Chen, Yong Zhao, Gang Liu, Yu Wu, Jian Wu, Shujie Liu, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Ultra Fast Speech Separation Model with Teacher Student Learning. | Sanyuan Chen, Yu Wu, Zhuo Chen, Jian Wu, Takuya Yoshioka, Shujie Liu, Jinyu Li, Xiangzhan Yu |
| 2021 | Interspeech | Human Listening and Live Captioning: Multi-Task Training for Speech Enhancement. | Sefik Emre Eskimez, Xiaofei Wang, Min Tang, Hemin Yang, Zirun Zhu, Zhuo Chen, Huaming Wang, Takuya Yoshioka |
| 2021 | Interspeech | End-to-End Speaker-Attributed ASR with Transformer. | Naoyuki Kanda, Guoli Ye, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | Interspeech | Large-Scale Pre-Training of End-to-End Multi-Talker ASR for Meeting Transcription with Single Distant Microphone. | Naoyuki Kanda, Guoli Ye, Yu Wu, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | Interspeech | Investigation of Practical Aspects of Single Channel Speech Separation for ASR. | Jian Wu, Zhuo Chen, Sanyuan Chen, Yu Wu, Takuya Yoshioka, Naoyuki Kanda, Shujie Liu, Jinyu Li |
| 2020 | ICASSP | Continuous Speech Separation: Dataset and Analysis. | Zhuo Chen, Takuya Yoshioka, Liang Lu, Tianyan Zhou, Zhong Meng, Yi Luo, Jian Wu, Xiong Xiao, Jinyu Li |
| 2020 | ICASSP | End-to-end Microphone Permutation and Number Invariant Multi-channel Speech Separation. | Yi Luo, Zhuo Chen, Nima Mesgarani, Takuya Yoshioka |
| 2020 | ICASSP | Dual-Path RNN: Efficient Long Sequence Modeling for Time-Domain Single-Channel Speech Separation. | Yi Luo, Zhuo Chen, Takuya Yoshioka |
| 2020 | Interspeech | Joint Speaker Counting, Speech Recognition, and Speaker Identification for Overlapped Speech of any Number of Speakers. | Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Tianyan Zhou, Takuya Yoshioka |
| 2020 | Interspeech | Serialized Output Training for End-to-End Overlapped Speech Recognition. | Naoyuki Kanda, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Takuya Yoshioka |
| 2020 | Interspeech | Neural Speech Separation Using Spatially Distributed Microphones. | Dongmei Wang, Zhuo Chen, Takuya Yoshioka |
| 2020 | Interspeech | An End-to-End Architecture of Online Multi-Channel Speech Separation. | Jian Wu, Zhuo Chen, Jinyu Li, Takuya Yoshioka, Zhili Tan, Ed Lin, Yi Luo, Lei Xie |
| 2019 | ASRU | Dover: A Method for Combining Diarization Outputs. | Andreas Stolcke, Takuya Yoshioka |
| 2019 | ASRU | Speech Separation Using Speaker Inventory. | Peidong Wang, Zhuo Chen, Xiong Xiao, Zhong Meng, Takuya Yoshioka, Tianyan Zhou, Liang Lu, Jinyu Li |
| 2019 | ASRU | Advances in Online Audio-Visual Meeting Transcription. | Takuya Yoshioka, Yan Huang, Aviv Hurvitz, Li Jiang, Sharon Koubi, Eyal Krupka, Ido Leichter, Changliang Liu, Partha Parthasarathy, Alon Vinnikov, Lingfeng Wu, Igor Abramovski, Xiong Xiao, Wayne Xiong, Huaming Wang, Zhenghao Wang, Jun Zhang, Yong Zhao, Tianyan Zhou, Cem Aksoylar, Zhuo Chen, Moshe David, Dimitrios Dimitriadis, Yifan Gong, Ilya Gurvich, Xuedong Huang |
| 2019 | ICASSP | Single-channel Speech Extraction Using Speaker Inventory and Attention Network. | Xiong Xiao, Zhuo Chen, Takuya Yoshioka, Hakan Erdogan, Changliang Liu, Dimitrios Dimitriadis, Jasha Droppo, Yifan Gong |
| 2019 | ICASSP | Low-latency Speaker-independent Continuous Speech Separation. | Takuya Yoshioka, Zhuo Chen, Changliang Liu, Xiong Xiao, Hakan Erdogan, Dimitrios Dimitriadis |
| 2019 | Interspeech | Meeting Transcription Using Asynchronous Distant Microphones. | Takuya Yoshioka, Dimitrios Dimitriadis, Andreas Stolcke, William Hinthorn, Zhuo Chen, Michael Zeng, Xuedong Huang |
| 2018 | ICASSP | Exploring Practical Aspects of Neural Mask-Based Beamforming for Far-Field Speech Recognition. | Christoph Bddeker, Hakan Erdogan, Takuya Yoshioka, Reinhold Haeb-Umbach |
| 2018 | ICASSP | Efficient Integration of Fixed Beamformers and Speech Separation Networks for Multi-Channel Far-Field Speech Separation. | Zhuo Chen, Takuya Yoshioka, Xiong Xiao, Linyu Li, Michael L. Seltzer, Yifan Gong |
| 2018 | ICASSP | Multi-Microphone Neural Speech Separation for Far-Field Multi-Talker Speech Recognition. | Takuya Yoshioka, Hakan Erdogan, Zhuo Chen, Fil Alleva |
| 2018 | Interspeech | Investigations on Data Augmentation and Loss Functions for Deep Learning Based Speech-Background Separation. | Hakan Erdogan, Takuya Yoshioka |
| 2018 | Interspeech | Recognizing Overlapped Speech in Meetings: A Multichannel Separation Approach Using Neural Networks. | Takuya Yoshioka, Hakan Erdogan, Zhuo Chen, Xiong Xiao, Fil Alleva |
| 2017 | ASRU | Cracking the cocktail party problem by multi-beam deep attractor network. | Zhuo Chen, Jinyu Li, Xiong Xiao, Takuya Yoshioka, Huaming Wang, Zhenghao Wang, Yifan Gong |
| 2017 | ICASSP | Unsupervised utterance-wise beamformer estimation with speech recognition-level criterion. | Takuya Higuchi, Takuya Yoshioka, Keisuke Kinoshita, Tomohiro Nakatani |
| 2016 | ICASSP | Context adaptive deep neural networks for fast acoustic model adaptation in noisy conditions. | Marc Delcroix, Keisuke Kinoshita, Chengzhu Yu, Atsunori Ogawa, Takuya Yoshioka, Tomohiro Nakatani |
| 2016 | ICASSP | Robust MVDR beamforming using time-frequency masks for online/offline ASR in noise. | Takuya Higuchi, Nobutaka Ito, Takuya Yoshioka, Tomohiro Nakatani |
| 2016 | ICASSP | Noise robust speech recognition using recent developments in neural networks for computer vision. | Takuya Yoshioka, Katsunori Ohnishi, Fuming Fang, Tomohiro Nakatani |
| 2016 | Interspeech | Context Adaptive Neural Network for Rapid Adaptation of Deep CNN Based Acoustic Models. | Marc Delcroix, Keisuke Kinoshita, Atsunori Ogawa, Takuya Yoshioka, Dung T. Tran, Tomohiro Nakatani |
| 2016 | Interspeech | Optimization of Speech Enhancement Front-End with Speech Recognition-Level Criterion. | Takuya Higuchi, Takuya Yoshioka, Tomohiro Nakatani |
| 2016 | Interspeech | Robust Example Search Using Bottleneck Features for Example-Based Speech Enhancement. | Atsunori Ogawa, Shogo Seki, Keisuke Kinoshita, Marc Delcroix, Takuya Yoshioka, Tomohiro Nakatani, Kazuya Takeda |
| 2015 | ASRU | The NTT CHiME-3 system: Advances in speech enhancement and recognition for mobile multi-microphone devices. | Takuya Yoshioka, Nobutaka Ito, Marc Delcroix, Atsunori Ogawa, Keisuke Kinoshita, Masakiyo Fujimoto, Chengzhu Yu, Wojciech J. Fabian, Miquel Espi, Takuya Higuchi, Shoko Araki, Tomohiro Nakatani |
| 2015 | ICASSP | Far-field speech recognition using CNN-DNN-HMM with convolution in time. | Takuya Yoshioka, Shigeki Karita, Tomohiro Nakatani |
| 2015 | Interspeech | Robust i-vector extraction for neural network adaptation in noisy environment. | Chengzhu Yu, Atsunori Ogawa, Marc Delcroix, Takuya Yoshioka, Tomohiro Nakatani, John H. L. Hansen |
| 2014 | ICASSP | Impact of single-microphone dereverberation on DNN-based meeting transcription systems. | Takuya Yoshioka, Xie Chen, Mark J. F. Gales |
| 2014 | ICASSP | Investigation of unsupervised adaptation of DNN acoustic models with filter bank input. | Takuya Yoshioka, Anton Ragni, Mark J. F. Gales |
| 2013 | ICASSP | Coupling beamforming with spatial and spectral feature based spectral enhancement and its application to meeting recognition. | Tomohiro Nakatani, Mehrez Souden, Shoko Araki, Takuya Yoshioka, Takaaki Hori, Atsunori Ogawa |
| 2013 | ICASSP | Noise model transfer using affine transformation with application to large vocabulary reverberant speech recognition. | Takuya Yoshioka, Tomohiro Nakatani |
| 2013 | Interspeech | Conditional emission densities for combining speech enhancement and recognition systems. | Armin Sehr, Takuya Yoshioka, Marc Delcroix, Keisuke Kinoshita, Tomohiro Nakatani, Roland Maas, Walter Kellermann |
| 2012 | ICASSP | LogMax observation model with MFCC-based spectral prior for reduction of highly nonstationary ambient noise. | Tomohiro Nakatani, Takuya Yoshioka, Shoko Araki, Marc Delcroix, Masakiyo Fujimoto |
| 2012 | ICASSP | MFCC enhancement using joint corrupted and noise feature space for highly non-stationary noise environments. | Masayuki Suzuki, Takuya Yoshioka, Shinji Watanabe, Nobuaki Minematsu, Keikichi Hirose |
| 2012 | ICASSP | Time-varying residual noise feature model estimation for multi-microphone speech recognition. | Takuya Yoshioka, Emmanuel Ternon, Tomohiro Nakatani |
| 2012 | Interspeech | Log-normal matrix factorization with application to speech-music separation. | Takuya Yoshioka, Daichi Sakaue |
| 2011 | ICASSP | Joint unsupervised learning of hidden Markov source models and source location models for multichannel source separation. | Tomohiro Nakatani, Shoko Araki, Takuya Yoshioka, Masakiyo Fujimoto |
| 2011 | ICASSP | I-Divergence-based dereverberation method with auxiliary function approach. | Naoki Yasuraoka, Hirokazu Kameoka, Takuya Yoshioka, Hiroshi G. Okuno |
| 2011 | ICASSP | Speech enhancement based on log spectral envelope model and harmonicity-derived spectral mask, and its coupling with feature compensation. | Takuya Yoshioka, Tomohiro Nakatani |
| 2011 | Interspeech | Reduction of Highly Nonstationary Ambient Noise by Integrating Spectral and Locational Characteristics of Speech and Noise for Robust ASR. | Tomohiro Nakatani, Shoko Araki, Marc Delcroix, Takuya Yoshioka, Masakiyo Fujimoto |
| 2010 | ICASSP | Music dereverberation using harmonic structure source model and Wiener filter. | Naoki Yasuraoka, Takuya Yoshioka, Tomohiro Nakatani, Atsushi Nakamura, Hiroshi G. Okuno |
| 2010 | ICASSP | Noisy speech enhancement based on prior knowledge about spectral envelope and harmonic structure. | Takuya Yoshioka, Tomohiro Nakatani, Hiroshi G. Okuno |
| 2010 | Interspeech | Multichannel source separation based on source location cue with log-spectral shaping by hidden Markov source model. | Tomohiro Nakatani, Shoko Araki, Takuya Yoshioka, Masakiyo Fujimoto |
| 2009 | ICASSP | Robust speech dereverberation based on non-negativity and sparse nature of speech spectrograms. | Hirokazu Kameoka, Tomohiro Nakatani, Takuya Yoshioka |
| 2009 | ICASSP | Real-time speech enhancement in noisy reverberant multi-talker environments based on a location-independent room acoustics model. | Tomohiro Nakatani, Takuya Yoshioka, Keisuke Kinoshita, Masato Miyoshi, Biing-Hwang Juang |
| 2009 | ICASSP | Adaptive dereverberation of speech signals with speaker-position change detection. | Takuya Yoshioka, Hideyuki Tachibana, Tomohiro Nakatani, Masato Miyoshi |
| 2008 | ACSSC | Principles and applications of dereverberation for noisy and reverberant audio signals. | Masato Miyoshi, Keisuke Kinoshita, Takuya Yoshioka, Tomohiro Nakatani |
| 2008 | ICASSP | Blind speech dereverberation with multi-channel linear prediction based on short time fourier transform representation. | Tomohiro Nakatani, Takuya Yoshioka, Keisuke Kinoshita, Masato Miyoshi, Biing-Hwang Juang |
| 2008 | ICASSP | Adaptive suppression of non-stationary noise by using the variational Bayesian method. | Takuya Yoshioka, Masato Miyoshi |
| 2008 | ICASSP | Maximum likelihood approach to speech enhancement for noisy reverberant signals. | Takuya Yoshioka, Tomohiro Nakatani, Takafumi Hikichi, Masato Miyoshi |
| 2007 | ICASSP | Study on Speech Dereverberation with Autocorrelation Codebook. | Tomohiro Nakatani, Biing-Hwang Juang, Takafumi Hikichi, Takuya Yoshioka, Keisuke Kinoshita, Marc Delcroix, Masato Miyoshi |
| 2007 | ISCAS | Robust blind dereverberation of speech signals based on characteristics of short-time speech segments. | Tomohiro Nakatani, Takafumi Hikichi, Keisuke Kinoshita, Takuya Yoshioka, Marc Delcroix, Masato Miyoshi, Biing-Hwang Juang |