Skip to content

Atsushi Ando

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

38

Venues

6

Active years

2015–2025

Best venue rank

A*

Where they publish

Papers

38 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUPredictive ASR and Turn-taking Prediction at Once: Towards More Responsive Spoken Dialog System.Ryo Fukuda, Takatomo Kano, Naohiro Tawara, Marc Delcroix, Atsunori Ogawa, Yuya Chiba, Atsushi Ando
2025ASRUCan We Really Repurpose Multi-Speaker ASR Corpus for Speaker Diarization?Shota Horiguchi, Naohiro Tawara, Takanori Ashihara, Atsushi Ando, Marc Delcroix
2025ICASSPSpeech Emotion Recognition Based on Large-Scale Automatic Speech Recognizer.Ryo Fukuda, Takatomo Kano, Atsushi Ando, Atsunori Ogawa
2025ICASSPGuided Speaker Embedding.Shota Horiguchi, Takafumi Moriya, Atsushi Ando, Takanori Ashihara, Hiroshi Sato, Naohiro Tawara, Marc Delcroix
2025ICASSPMamba-based Segmentation Model for Speaker Diarization.Alexis Plaquet, Naohiro Tawara, Marc Delcroix, Shota Horiguchi, Atsushi Ando, Shoko Araki
2025ICASSPMulti-channel Speaker Counting for EEND-VC-based Speaker Diarization on Multi-domain Conversation.Naohiro Tawara, Atsushi Ando, Shota Horiguchi, Marc Delcroix
2025InterspeechMitigating Non-Target Speaker Bias in Guided Speaker Embedding.Shota Horiguchi, Takanori Ashihara, Marc Delcroix, Atsushi Ando, Naohiro Tawara
2025InterspeechPretraining Multi-Speaker Identification for Neural Speaker Diarization.Shota Horiguchi, Atsushi Ando, Naohiro Tawara, Marc Delcroix
2024ICASSPNTT Speaker Diarization System for Chime-7: Multi-Domain, Multi-Microphone end-to-end and Vector Clustering Diarization.Naohiro Tawara, Marc Delcroix, Atsushi Ando, Atsunori Ogawa
2024InterspeechFactor-Conditioned Speaking-Style Captioning.Atsushi Ando, Takafumi Moriya, Shota Horiguchi, Ryo Masumura
2024InterspeechSOMSRED: Sequential Output Modeling for Joint Multi-talker Overlapped Speech Recognition and Speaker Diarization.Naoki Makishima, Naotaka Kawata, Mana Ihori, Tomohiro Tanaka, Shota Orihashi, Atsushi Ando, Ryo Masumura
2024InterspeechUnified Multi-Talker ASR with and without Target-speaker Enrollment.Ryo Masumura, Naoki Makishima, Tomohiro Tanaka, Mana Ihori, Naotaka Kawata, Shota Orihashi, Kazutoshi Shinoda, Taiga Yamane, Saki Mizuno, Keita Suzuki, Satoshi Suzuki, Nobukatsu Hojo, Takafumi Moriya, Atsushi Ando
2024InterspeechSpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling.Hiroshi Sato, Takafumi Moriya, Masato Mimura, Shota Horiguchi, Tsubasa Ochiai, Takanori Ashihara, Atsushi Ando, Kentaro Shinayama, Marc Delcroix
2023ICCVAdversarial Finetuning with Latent Representation Constraint to Mitigate Accuracy-Robustness Tradeoff.Satoshi Suzuki, Shin'ya Yamaguchi, Shoichiro Takeda, Sekitoshi Kanai, Naoki Makishima, Atsushi Ando, Ryo Masumura
2023ICIPOnDA-DETR: Online Domain Adaptation for Detection Transformers with Self-Training Framework.Satoshi Suzuki, Taiga Yamane, Naoki Makishima, Keita Suzuki, Atsushi Ando, Ryo Masumura
2023InterspeechJoint Autoregressive Modeling of End-to-End Multi-Talker Overlapped Speech Recognition and Utterance-level Timestamp Prediction.Naoki Makishima, Keita Suzuki, Satoshi Suzuki, Atsushi Ando, Ryo Masumura
2023InterspeechEnd-to-End Joint Target and Non-Target Speakers ASR.Ryo Masumura, Naoki Makishima, Taiga Yamane, Yoshihiko Yamazaki, Saki Mizuno, Mana Ihori, Mihiro Uchida, Keita Suzuki, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando
2022ICASSPCustomer Satisfaction Estimation Using Unsupervised Representation Learning with Multi-Format Prediction Loss.Atsushi Ando, Yumiko Murata, Ryo Masumura, Satoshi Suzuki, Naoki Makishima, Takafumi Moriya, Takanori Ashihara, Hiroshi Sato
2022ICASSPHybrid RNN-T/Attention-Based Streaming ASR with Triggered Chunkwise Attention and Dual Internal Language Model Integration.Takafumi Moriya, Takanori Ashihara, Atsushi Ando, Hiroshi Sato, Tomohiro Tanaka, Kohei Matsuura, Ryo Masumura, Marc Delcroix, Takahiro Shinozaki
2022InterspeechSpeaker consistency loss and step-wise optimization for semi-supervised joint training of TTS and ASR using unpaired text data.Naoki Makishima, Satoshi Suzuki, Atsushi Ando, Ryo Masumura
2022InterspeechEnd-to-End Joint Modeling of Conversation History-Dependent and Independent ASR Systems with Multi-History Training.Ryo Masumura, Yoshihiro Yamazaki, Saki Mizuno, Naoki Makishima, Mana Ihori, Mihiro Uchida, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Shota Orihashi, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando
2022InterspeechInteractive Co-Learning with Cross-Modal Transformer for Audio-Visual Emotion Recognition.Akihiko Takashima, Ryo Masumura, Atsushi Ando, Yoshihiro Yamazaki, Mihiro Uchida, Shota Orihashi
2021ICASSPSpeech Emotion Recognition Based on Listener Adaptive Models.Atsushi Ando, Ryo Masumura, Hiroshi Sato, Takafumi Moriya, Takanori Ashihara, Yusuke Ijima, Tomoki Toda
2021ICASSPSimpleflat: A Simple Whole-Network Pre-Training Approach for RNN Transducer-Based End-to-End Speech Recognition.Takafumi Moriya, Takanori Ashihara, Tomohiro Tanaka, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Yusuke Ijima, Ryo Masumura, Yusuke Shinohara
2021InterspeechPhoneme Duration Modeling Using Speech Rhythm-Based Speaker Embeddings for Multi-Speaker Speech Synthesis.Kenichi Fujita, Atsushi Ando, Yusuke Ijima
2021InterspeechStreaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture.Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami
2020ICASSPSequence-Level Consistency Training for Semi-Supervised End-to-End Automatic Speech Recognition.Ryo Masumura, Mana Ihori, Akihiko Takashima, Takafumi Moriya, Atsushi Ando, Yusuke Shinohara
2019ASRUImproving Speech-Based End-of-Turn Detection Via Cross-Modal Representation Learning with Punctuated Text Data.Ryo Masumura, Mana Ihori, Tomohiro Tanaka, Atsushi Ando, Ryo Ishii, Takanobu Oba, Ryuichiro Higashinaka
2019InterspeechDoes the Lombard Effect Improve Emotional Communication in Noise? - Analysis of Emotional Speech Acted in Noise.Yi Zhao, Atsushi Ando, Shinji Takaki, Junichi Yamagishi, Satoshi Kobashikawa
2019InterspeechSpeech Emotion Recognition Based on Multi-Label Emotion Existence Model.Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono
2019InterspeechImproving Conversation-Context Language Models with Multiple Spoken Language Understanding Models.Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Hosana Kamiyama, Takanobu Oba, Satoshi Kobashikawa, Yushi Aono
2018ICASSPSoft-Target Training with Ambiguous Emotional Utterances for DNN-Based Speech Emotion Classification.Atsushi Ando, Satoshi Kobashikawa, Hosana Kamiyama, Ryo Masumura, Yusuke Ijima, Yushi Aono
2018InterspeechAutomatic Question Detection from Acoustic and Phonetic Features Using Feature-wise Pre-training.Atsushi Ando, Reine Asakawa, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono
2018InterspeechRole Play Dialogue Aware Language Models Based on Conditional Hierarchical Recurrent Encoder-Decoder.Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Hirokazu Masataki, Yushi Aono
2018SIGdialNeural Dialogue Context Online End-of-Turn Detection.Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Ryo Ishii, Ryuichiro Higashinaka, Yushi Aono
2017InterspeechHierarchical LSTMs with Joint Learning for Estimating Customer Satisfaction from Contact Center Calls.Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono
2017InterspeechInteraction and Transition Model for Speech Emotion Recognition in Dialogue.Ruo Zhang, Atsushi Ando, Satoshi Kobashikawa, Yushi Aono
2015InterspeechAgreement and disagreement utterance detection in conversational speech by extracting and integrating local features.Atsushi Ando, Taichi Asami, Manabu Okamoto, Hirokazu Masataki, Sumitaka Sakauchi