Atsushi Ando
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
38
Venues
6
Active years
2015–2025
Best venue rank
A*
Where they publish
Papers
38 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASRU | Predictive ASR and Turn-taking Prediction at Once: Towards More Responsive Spoken Dialog System. | Ryo Fukuda, Takatomo Kano, Naohiro Tawara, Marc Delcroix, Atsunori Ogawa, Yuya Chiba, Atsushi Ando |
| 2025 | ASRU | Can We Really Repurpose Multi-Speaker ASR Corpus for Speaker Diarization? | Shota Horiguchi, Naohiro Tawara, Takanori Ashihara, Atsushi Ando, Marc Delcroix |
| 2025 | ICASSP | Speech Emotion Recognition Based on Large-Scale Automatic Speech Recognizer. | Ryo Fukuda, Takatomo Kano, Atsushi Ando, Atsunori Ogawa |
| 2025 | ICASSP | Guided Speaker Embedding. | Shota Horiguchi, Takafumi Moriya, Atsushi Ando, Takanori Ashihara, Hiroshi Sato, Naohiro Tawara, Marc Delcroix |
| 2025 | ICASSP | Mamba-based Segmentation Model for Speaker Diarization. | Alexis Plaquet, Naohiro Tawara, Marc Delcroix, Shota Horiguchi, Atsushi Ando, Shoko Araki |
| 2025 | ICASSP | Multi-channel Speaker Counting for EEND-VC-based Speaker Diarization on Multi-domain Conversation. | Naohiro Tawara, Atsushi Ando, Shota Horiguchi, Marc Delcroix |
| 2025 | Interspeech | Mitigating Non-Target Speaker Bias in Guided Speaker Embedding. | Shota Horiguchi, Takanori Ashihara, Marc Delcroix, Atsushi Ando, Naohiro Tawara |
| 2025 | Interspeech | Pretraining Multi-Speaker Identification for Neural Speaker Diarization. | Shota Horiguchi, Atsushi Ando, Naohiro Tawara, Marc Delcroix |
| 2024 | ICASSP | NTT Speaker Diarization System for Chime-7: Multi-Domain, Multi-Microphone end-to-end and Vector Clustering Diarization. | Naohiro Tawara, Marc Delcroix, Atsushi Ando, Atsunori Ogawa |
| 2024 | Interspeech | Factor-Conditioned Speaking-Style Captioning. | Atsushi Ando, Takafumi Moriya, Shota Horiguchi, Ryo Masumura |
| 2024 | Interspeech | SOMSRED: Sequential Output Modeling for Joint Multi-talker Overlapped Speech Recognition and Speaker Diarization. | Naoki Makishima, Naotaka Kawata, Mana Ihori, Tomohiro Tanaka, Shota Orihashi, Atsushi Ando, Ryo Masumura |
| 2024 | Interspeech | Unified Multi-Talker ASR with and without Target-speaker Enrollment. | Ryo Masumura, Naoki Makishima, Tomohiro Tanaka, Mana Ihori, Naotaka Kawata, Shota Orihashi, Kazutoshi Shinoda, Taiga Yamane, Saki Mizuno, Keita Suzuki, Satoshi Suzuki, Nobukatsu Hojo, Takafumi Moriya, Atsushi Ando |
| 2024 | Interspeech | SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling. | Hiroshi Sato, Takafumi Moriya, Masato Mimura, Shota Horiguchi, Tsubasa Ochiai, Takanori Ashihara, Atsushi Ando, Kentaro Shinayama, Marc Delcroix |
| 2023 | ICCV | Adversarial Finetuning with Latent Representation Constraint to Mitigate Accuracy-Robustness Tradeoff. | Satoshi Suzuki, Shin'ya Yamaguchi, Shoichiro Takeda, Sekitoshi Kanai, Naoki Makishima, Atsushi Ando, Ryo Masumura |
| 2023 | ICIP | OnDA-DETR: Online Domain Adaptation for Detection Transformers with Self-Training Framework. | Satoshi Suzuki, Taiga Yamane, Naoki Makishima, Keita Suzuki, Atsushi Ando, Ryo Masumura |
| 2023 | Interspeech | Joint Autoregressive Modeling of End-to-End Multi-Talker Overlapped Speech Recognition and Utterance-level Timestamp Prediction. | Naoki Makishima, Keita Suzuki, Satoshi Suzuki, Atsushi Ando, Ryo Masumura |
| 2023 | Interspeech | End-to-End Joint Target and Non-Target Speakers ASR. | Ryo Masumura, Naoki Makishima, Taiga Yamane, Yoshihiko Yamazaki, Saki Mizuno, Mana Ihori, Mihiro Uchida, Keita Suzuki, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando |
| 2022 | ICASSP | Customer Satisfaction Estimation Using Unsupervised Representation Learning with Multi-Format Prediction Loss. | Atsushi Ando, Yumiko Murata, Ryo Masumura, Satoshi Suzuki, Naoki Makishima, Takafumi Moriya, Takanori Ashihara, Hiroshi Sato |
| 2022 | ICASSP | Hybrid RNN-T/Attention-Based Streaming ASR with Triggered Chunkwise Attention and Dual Internal Language Model Integration. | Takafumi Moriya, Takanori Ashihara, Atsushi Ando, Hiroshi Sato, Tomohiro Tanaka, Kohei Matsuura, Ryo Masumura, Marc Delcroix, Takahiro Shinozaki |
| 2022 | Interspeech | Speaker consistency loss and step-wise optimization for semi-supervised joint training of TTS and ASR using unpaired text data. | Naoki Makishima, Satoshi Suzuki, Atsushi Ando, Ryo Masumura |
| 2022 | Interspeech | End-to-End Joint Modeling of Conversation History-Dependent and Independent ASR Systems with Multi-History Training. | Ryo Masumura, Yoshihiro Yamazaki, Saki Mizuno, Naoki Makishima, Mana Ihori, Mihiro Uchida, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Shota Orihashi, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando |
| 2022 | Interspeech | Interactive Co-Learning with Cross-Modal Transformer for Audio-Visual Emotion Recognition. | Akihiko Takashima, Ryo Masumura, Atsushi Ando, Yoshihiro Yamazaki, Mihiro Uchida, Shota Orihashi |
| 2021 | ICASSP | Speech Emotion Recognition Based on Listener Adaptive Models. | Atsushi Ando, Ryo Masumura, Hiroshi Sato, Takafumi Moriya, Takanori Ashihara, Yusuke Ijima, Tomoki Toda |
| 2021 | ICASSP | Simpleflat: A Simple Whole-Network Pre-Training Approach for RNN Transducer-Based End-to-End Speech Recognition. | Takafumi Moriya, Takanori Ashihara, Tomohiro Tanaka, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Yusuke Ijima, Ryo Masumura, Yusuke Shinohara |
| 2021 | Interspeech | Phoneme Duration Modeling Using Speech Rhythm-Based Speaker Embeddings for Multi-Speaker Speech Synthesis. | Kenichi Fujita, Atsushi Ando, Yusuke Ijima |
| 2021 | Interspeech | Streaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture. | Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami |
| 2020 | ICASSP | Sequence-Level Consistency Training for Semi-Supervised End-to-End Automatic Speech Recognition. | Ryo Masumura, Mana Ihori, Akihiko Takashima, Takafumi Moriya, Atsushi Ando, Yusuke Shinohara |
| 2019 | ASRU | Improving Speech-Based End-of-Turn Detection Via Cross-Modal Representation Learning with Punctuated Text Data. | Ryo Masumura, Mana Ihori, Tomohiro Tanaka, Atsushi Ando, Ryo Ishii, Takanobu Oba, Ryuichiro Higashinaka |
| 2019 | Interspeech | Does the Lombard Effect Improve Emotional Communication in Noise? - Analysis of Emotional Speech Acted in Noise. | Yi Zhao, Atsushi Ando, Shinji Takaki, Junichi Yamagishi, Satoshi Kobashikawa |
| 2019 | Interspeech | Speech Emotion Recognition Based on Multi-Label Emotion Existence Model. | Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2019 | Interspeech | Improving Conversation-Context Language Models with Multiple Spoken Language Understanding Models. | Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Hosana Kamiyama, Takanobu Oba, Satoshi Kobashikawa, Yushi Aono |
| 2018 | ICASSP | Soft-Target Training with Ambiguous Emotional Utterances for DNN-Based Speech Emotion Classification. | Atsushi Ando, Satoshi Kobashikawa, Hosana Kamiyama, Ryo Masumura, Yusuke Ijima, Yushi Aono |
| 2018 | Interspeech | Automatic Question Detection from Acoustic and Phonetic Features Using Feature-wise Pre-training. | Atsushi Ando, Reine Asakawa, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2018 | Interspeech | Role Play Dialogue Aware Language Models Based on Conditional Hierarchical Recurrent Encoder-Decoder. | Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Hirokazu Masataki, Yushi Aono |
| 2018 | SIGdial | Neural Dialogue Context Online End-of-Turn Detection. | Ryo Masumura, Tomohiro Tanaka, Atsushi Ando, Ryo Ishii, Ryuichiro Higashinaka, Yushi Aono |
| 2017 | Interspeech | Hierarchical LSTMs with Joint Learning for Estimating Customer Satisfaction from Contact Center Calls. | Atsushi Ando, Ryo Masumura, Hosana Kamiyama, Satoshi Kobashikawa, Yushi Aono |
| 2017 | Interspeech | Interaction and Transition Model for Speech Emotion Recognition in Dialogue. | Ruo Zhang, Atsushi Ando, Satoshi Kobashikawa, Yushi Aono |
| 2015 | Interspeech | Agreement and disagreement utterance detection in conversational speech by extracting and integrating local features. | Atsushi Ando, Taichi Asami, Manabu Okamoto, Hirokazu Masataki, Sumitaka Sakauchi |