Hayato Futami
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
24
Venues
6
Active years
2020–2026
Best venue rank
A*
Where they publish
Papers
24 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Optimizing Conversational Quality in Spoken Dialogue Systems with Reinforcement Learning from AI Feedback. | Siddhant Arora, Jinchuan Tian, Jiatong Shi, Hayato Futami, Yosuke Kashiwagi, Emiru Tsunoo, Shinji Watanabe |
| 2025 | ASRU | Spiralformer: Low Latency Encoder for Streaming Speech Recognition with Circular Layer Skipping and Early Exiting. | Emiru Tsunoo, Hayato Futami, Yosuke Kashiwagi, Siddhant Arora, Shinji Watanabe |
| 2025 | EMNLP | Exploring Context Strategies in LLMs for Discourse-Aware Machine Translation. | Ritvik Choudhary, Rem Hida, Masaki Hamada, Hayato Futami, Toshiyuki Sekiya |
| 2025 | ICASSP | Hypothesis Clustering and Merging: Novel MultiTalker Speech Recognition with Speaker Tokens. | Yosuke Kashiwagi, Hayato Futami, Emiru Tsunoo, Siddhant Arora, Shinji Watanabe |
| 2025 | Interspeech | Chain-of-Thought Training for Open E2E Spoken Dialogue Systems. | Siddhant Arora, Jinchuan Tian, Hayato Futami, Jee-weon Jung, Jiatong Shi, Yosuke Kashiwagi, Emiru Tsunoo, Shinji Watanabe |
| 2025 | Interspeech | Scheduled Interleaved Speech-Text Training for Speech-to-Speech Translation with LLMs. | Hayato Futami, Emiru Tsunoo, Yosuke Kashiwagi, Yuki Ito, Hassan Shahmohammadi, Siddhant Arora, Shinji Watanabe |
| 2025 | Interspeech | Differentiable K-means for Fully-optimized Discrete Token-based ASR. | Kentaro Onda, Yosuke Kashiwagi, Emiru Tsunoo, Hayato Futami, Shinji Watanabe |
| 2025 | NAACL | ESPnet-SDS: Unified Toolkit and Demo for Spoken Dialogue Systems. | Siddhant Arora, Yifan Peng, Jiatong Shi, Jinchuan Tian, William Chen, Shikhar Bharadwaj, Hayato Futami, Yosuke Kashiwagi, Emiru Tsunoo, Shuichiro Shimizu, Vaibhav Srivastav, Shinji Watanabe |
| 2024 | ICASSP | Phoneme-Aware Encoding for Prefix-Tree-Based Contextual ASR. | Hayato Futami, Emiru Tsunoo, Yosuke Kashiwagi, Hiroaki Ogawa, Siddhant Arora, Shinji Watanabe |
| 2024 | Interspeech | Finding Task-specific Subnetworks in Multi-task Spoken Language Understanding Model. | Hayato Futami, Siddhant Arora, Yosuke Kashiwagi, Emiru Tsunoo, Shinji Watanabe |
| 2024 | Interspeech | Rapid Language Adaptation for Multilingual E2E Speech Recognition Using Encoder Prompting. | Yosuke Kashiwagi, Hayato Futami, Emiru Tsunoo, Siddhant Arora, Shinji Watanabe |
| 2024 | Interspeech | Decoder-only Architecture for Streaming End-to-end Speech Recognition. | Emiru Tsunoo, Hayato Futami, Yosuke Kashiwagi, Siddhant Arora, Shinji Watanabe |
| 2024 | NAACL | UniverSLU: Universal Spoken Language Understanding for Diverse Tasks with Natural Language Instructions. | Siddhant Arora, Hayato Futami, Jee-weon Jung, Yifan Peng, Roshan S. Sharma, Yosuke Kashiwagi, Emiru Tsunoo, Karen Livescu, Shinji Watanabe |
| 2023 | ICASSP | Joint Modelling of Spoken Language Understanding Tasks with Integrated Dialog History. | Siddhant Arora, Hayato Futami, Emiru Tsunoo, Brian Yan, Shinji Watanabe |
| 2023 | ICASSP | A Study on the Integration of Pipeline and E2E SLU Systems for Spoken Semantic Parsing Toward Stop Quality Challenge. | Siddhant Arora, Hayato Futami, Shih-Lun Wu, Jessica Huynh, Yifan Peng, Yosuke Kashiwagi, Emiru Tsunoo, Brian Yan, Shinji Watanabe |
| 2023 | ICASSP | The Pipeline System of ASR and NLU with MLM-based data Augmentation Toward Stop Low-Resource Challenge. | Hayato Futami, Jessica Huynh, Siddhant Arora, Shih-Lun Wu, Yosuke Kashiwagi, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe |
| 2023 | ICASSP | Streaming Joint Speech Recognition and Disfluency Detection. | Hayato Futami, Emiru Tsunoo, Kentaro Shibata, Yosuke Kashiwagi, Takao Okuda, Siddhant Arora, Shinji Watanabe |
| 2023 | ICASSP | E-Branchformer-Based E2E SLU Toward Stop on-Device Challenge. | Yosuke Kashiwagi, Siddhant Arora, Hayato Futami, Jessica Huynh, Shih-Lun Wu, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe |
| 2023 | Interspeech | Integrating Pretrained ASR and LM to Perform Sequence Generation for Spoken Language Understanding. | Siddhant Arora, Hayato Futami, Yosuke Kashiwagi, Emiru Tsunoo, Brian Yan, Shinji Watanabe |
| 2023 | Interspeech | Tensor decomposition for minimization of E2E SLU model toward on-device processing. | Yosuke Kashiwagi, Siddhant Arora, Hayato Futami, Jessica Huynh, Shih-Lun Wu, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe |
| 2023 | Interspeech | Integration of Frame- and Label-synchronous Beam Search for Streaming Encoder-decoder Speech Recognition. | Emiru Tsunoo, Hayato Futami, Yosuke Kashiwagi, Siddhant Arora, Shinji Watanabe |
| 2022 | Interspeech | Non-autoregressive Error Correction for CTC-based ASR with Phone-conditioned Masked LM. | Hayato Futami, Hirofumi Inaguma, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2021 | ASRU | ASR Rescoring and Confidence Estimation with Electra. | Hayato Futami, Hirofumi Inaguma, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2020 | Interspeech | Distilling the Knowledge of BERT for Sequence-to-Sequence ASR. | Hayato Futami, Hirofumi Inaguma, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |