| 2025 | ICASSP | Rethinking Mean Opinion Scores in Speech Quality Assessment: Score Aggregation through Quantized Distribution Fitting. | Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko |
| 2025 | Interspeech | FasterVoiceGrad: Faster One-step Diffusion-Based Voice Conversion with Adversarial Diffusion Conversion Distillation. | Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo |
| 2025 | Interspeech | Vocoder-Projected Feature Discriminator. | Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo |
| 2025 | Interspeech | JIS: A Speech Corpus of Japanese Idol Speakers with Various Speaking Styles. | Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko |
| 2024 | ICASSP | Selecting N-Lowest Scores for Training MOS Prediction Models. | Yuto Kondo, Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko |
| 2024 | Interspeech | FastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation. | Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo |
| 2024 | Interspeech | PRVAE-VC2: Non-Parallel Voice Conversion by Distillation of Speech Representations. | Kou Tanaka, Hirokazu Kameoka, Takuhiro Kaneko, Yuto Kondo |
| 2021 | ICASSP | Deficient Basis Estimation of Noise Spatial Covariance Matrix for Rank-Constrained Spatial Covariance Matrix Estimation Method in Blind Speech Extraction. | Yuto Kondo, Yuki Kubo, Norihiro Takamune, Daichi Kitamura, Hiroshi Saruwatari |
| 2015 | HCI | Information Select and Transfer Between Touch Panel and Wearable Devices Using Human Body Communication. | Yuto Kondo, Shin Takahashi, Jiro Tanaka |