Takuya Higuchi
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
30
Venues
5
Active years
2001–2025
Best venue rank
A*
Where they publish
Papers
30 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Speaker-IPL: Unsupervised Learning of Speaker Characteristics with i-Vector based Pseudo-Labels. | Zakaria Aldeneh, Takuya Higuchi, Jee-Weon Jung, Li-Wei Chen, Stephen Shum, Ahmed Hussen Abdelaziz, Shinji Watanabe, Tatiana Likhomanenko, Barry-John Theobald |
| 2025 | ICASSP | Towards Automatic Assessment of Self-Supervised Speech Models using Rank. | Zakaria Aldeneh, Vimal Thilak, Takuya Higuchi, Barry-John Theobald, Tatiana Likhomanenko |
| 2025 | ICASSP | Exploring Prediction Targets in Masked Pre-Training for Speech Foundation Models. | Li-Wei Chen, Takuya Higuchi, He Bai, Ahmed Hussen Abdelaziz, Shinji Watanabe, Alexander Rudnicky, Tatiana Likhomanenko, Barry-John Theobald, Zakaria Aldeneh |
| 2025 | ICML | A Variational Framework for Improving Naturalness in Generative Spoken Language Models. | Li-Wei Chen, Takuya Higuchi, Zakaria Aldeneh, Ahmed Hussen Abdelaziz, Alexander Rudnicky |
| 2025 | Interspeech | DiceHuBERT: Distilling HuBERT with a Self-Supervised Learning Objective. | Hyung-Gun Chi, Zakaria Aldeneh, Tatiana Likhomanenko, Oggi Rudovic, Takuya Higuchi, Li-Wei Chen, Shinji Watanabe, Ahmed Hussen Abdelaziz |
| 2024 | ICASSP | Multichannel Voice Trigger Detection Based on Transform-Average-Concatenate. | Takuya Higuchi, Avamarie Brueggeman, Masood Delfarah, Stephen Shum |
| 2024 | Interspeech | Can you Remove the Downstream Model for Speaker Recognition with Self-Supervised Speech Features? | Zakaria Aldeneh, Takuya Higuchi, Jee-weon Jung, Skyler Seto, Tatiana Likhomanenko, Stephen Shum, Ahmed Hussen Abdelaziz, Shinji Watanabe, Barry-John Theobald |
| 2024 | Interspeech | ESPnet-SPK: full pipeline speaker embedding toolkit with reproducible recipes, self-supervised front-ends, and off-the-shelf models. | Jee-weon Jung, Wangyou Zhang, Jiatong Shi, Zakaria Aldeneh, Takuya Higuchi, Alex Gichamba, Barry-John Theobald, Ahmed Hussen Abdelaziz, Shinji Watanabe |
| 2022 | Interspeech | Improving Voice Trigger Detection with Metric Learning. | Prateeth Nayak, Takuya Higuchi, Anmol Gupta, Shivesh Ranjan, Stephen Shum, Siddharth Sigtia, Erik Marchi, Varun Lakshminarasimhan, Minsik Cho, Saurabh Adya, Chandra Dhir, Ahmed H. Tewfik |
| 2021 | ASRU | Multi-Task Learning with Cross Attention for Keyword Spotting. | Takuya Higuchi, Anmol Gupta, Chandra Dhir |
| 2021 | ICASSP | Dynamic Curriculum Learning via Data Parameters for Noise Robust Keyword Spotting. | Takuya Higuchi, Shreyas Saxena, Mehrez Souden, Tien Dung Tran, Masood Delfarah, Chandra Dhir |
| 2020 | Interspeech | Stacked 1D Convolutional Networks for End-to-End Small Footprint Voice Trigger Detection. | Takuya Higuchi, Mohammad Ghasemzadeh, Kisun You, Chandra Dhir |
| 2018 | ICASSP | Dual Frequency- and Block-Permutation Alignment for Deep Learning Based Block-Online Blind Source Separation. | Lukas Drude, Takuya Higuchi, Keisuke Kinoshita, Tomohiro Nakatani, Reinhold Haeb-Umbach |
| 2018 | ICASSP | Frame-by-Frame Closed-Form Update for Mask-Based Adaptive MVDR Beamforming. | Takuya Higuchi, Keisuke Kinoshita, Nobutaka Ito, Shigeki Karita, Tomohiro Nakatani |
| 2018 | ICASSP | Optimization of Speaker-Aware Multichannel Speech Extraction with ASR Criterion. | Katerina Zmolkov, Marc Delcroix, Keisuke Kinoshita, Takuya Higuchi, Tomohiro Nakatani, Jan Cernock |
| 2017 | ASRU | Adversarial training for data-driven speech enhancement without parallel corpus. | Takuya Higuchi, Keisuke Kinoshita, Marc Delcroix, Tomohiro Nakatani |
| 2017 | ASRU | Learning speaker representation for neural network based multichannel speaker extraction. | Katerina Zmolkov, Marc Delcroix, Keisuke Kinoshita, Takuya Higuchi, Atsunori Ogawa, Tomohiro Nakatani |
| 2017 | ICASSP | Unsupervised utterance-wise beamformer estimation with speech recognition-level criterion. | Takuya Higuchi, Takuya Yoshioka, Keisuke Kinoshita, Tomohiro Nakatani |
| 2017 | ICASSP | Deep mixture density network for statistical model-based feature enhancement. | Keisuke Kinoshita, Marc Delcroix, Atsunori Ogawa, Takuya Higuchi, Tomohiro Nakatani |
| 2017 | ICASSP | Integrating DNN-based and spatial clustering-based mask estimation for robust MVDR beamforming. | Tomohiro Nakatani, Nobutaka Ito, Takuya Higuchi, Shoko Araki, Keisuke Kinoshita |
| 2017 | Interspeech | Deep Clustering-Based Beamforming for Separation with Unknown Number of Sources. | Takuya Higuchi, Keisuke Kinoshita, Marc Delcroix, Katerina Zmolkov, Tomohiro Nakatani |
| 2017 | Interspeech | Speaker-Aware Neural Network Based Beamformer for Speaker Extraction in Speech Mixtures. | Katerina Zmolkov, Marc Delcroix, Keisuke Kinoshita, Takuya Higuchi, Atsunori Ogawa, Tomohiro Nakatani |
| 2016 | ICASSP | Spatial correlation model based observation vector clustering and MVDR beamforming for meeting recognition. | Shoko Araki, Masahiro Okada, Takuya Higuchi, Atsunori Ogawa, Tomohiro Nakatani |
| 2016 | ICASSP | Robust MVDR beamforming using time-frequency masks for online/offline ASR in noise. | Takuya Higuchi, Nobutaka Ito, Takuya Yoshioka, Tomohiro Nakatani |
| 2016 | Interspeech | Optimization of Speech Enhancement Front-End with Speech Recognition-Level Criterion. | Takuya Higuchi, Takuya Yoshioka, Tomohiro Nakatani |
| 2016 | Interspeech | Semi-Supervised Joint Enhancement of Spectral and Cepstral Sequences of Noisy Speech. | Li Li, Hirokazu Kameoka, Takuya Higuchi, Hiroshi Saruwatari |
| 2015 | ASRU | The NTT CHiME-3 system: Advances in speech enhancement and recognition for mobile multi-microphone devices. | Takuya Yoshioka, Nobutaka Ito, Marc Delcroix, Atsunori Ogawa, Keisuke Kinoshita, Masakiyo Fujimoto, Chengzhu Yu, Wojciech J. Fabian, Miquel Espi, Takuya Higuchi, Shoko Araki, Tomohiro Nakatani |
| 2014 | ICASSP | Underdetermined blind separation and tracking of moving sources based ONDOA-HMM. | Takuya Higuchi, Norihiro Takamune, Tomohiko Nakamura, Hirokazu Kameoka |
| 2014 | Interspeech | A unified approach for underdetermined blind signal separation and source activity detection by multichannel factorial hidden Markov models. | Takuya Higuchi, Hirofumi Takeda, Tomohiko Nakamura, Hirokazu Kameoka |
| 2001 | ICRA | Remote Ultrasound Diagnostic System. | Mamoru Mitsuishi, Shin'ichi Warisawa, Taishi Tsuda, Takuya Higuchi, Norihiro Koizumi, Hiroyuki Hashizume, Kazuo Fujiwara |