Hiroshi Sato
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
67
Venues
24
Active years
1998–2026
Best venue rank
A*
Where they publish
- AInterspeech21 papers
- MulticonferenceICASSP13 papers
- BKES4 papers
- BCEC4 papers
- A*ICRA3 papers
- NationalHCI2 papers
- NationalIAS2 papers
- CIDEAL2 papers
- CASRU1 paper
- BINLG1 paper
- BCOLING1 paper
- BICAART1 paper
- BSMC1 paper
- CIFSA1 paper
- CICPRAM1 paper
- A*PERCOM1 paper
- A*IJCAI1 paper
- CDEXA1 paper
- BAINA1 paper
- A*CHI1 paper
- BCOMPSAC1 paper
- BDASFAA1 paper
- CPDCAT1 paper
- CICCHP1 paper
Papers
67 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | HCI | Classification of Services Based on Ergonomics: Toward a Framework for Human-Robot-AI Integration. | Manabu Chikai, Nana Itoh, Kentaro Watanabe, Hiroshi Sato, Shin'ichi Fukuzumi |
| 2025 | ASRU | All-in-One ASR: Unifying Encoder-Decoder Models of CTC, Attention, and Transducer in Dual-Mode ASR. | Takafumi Moriya, Masato Mimura, Tomohiro Tanaka, Hiroshi Sato, Ryo Masumura, Atsunori Ogawa |
| 2025 | ICASSP | Guided Speaker Embedding. | Shota Horiguchi, Takafumi Moriya, Atsushi Ando, Takanori Ashihara, Hiroshi Sato, Naohiro Tawara, Marc Delcroix |
| 2025 | ICASSP | Alignment-Free Training for Transducer-based Multi-Talker ASR. | Takafumi Moriya, Shota Horiguchi, Marc Delcroix, Ryo Masumura, Takanori Ashihara, Hiroshi Sato, Kohei Matsuura, Masato Mimura |
| 2025 | Interspeech | Attention-Free Dual-Mode ASR with Latency-Controlled Selective State Spaces. | Takafumi Moriya, Masato Mimura, Kiyoaki Matsui, Hiroshi Sato, Kohei Matsuura |
| 2025 | Interspeech | Real-time TSE demonstration via SoundBeam with KD. | Keigo Wakayama, Tomoko Kawase, Takafumi Moriya, Marc Delcroix, Hiroshi Sato, Tsubasa Ochiai, Masahiro Yasuda, Shoko Araki |
| 2025 | KES | Evaluating RAG Accuracy Enhancement via Page Merging for Non-Ideal Documents. | Toshiya Shinoda, Hiroshi Sato, Masao Kubo |
| 2024 | ICASSP | Noise-Robust Zero-Shot Text-to-Speech Synthesis Conditioned on Self-Supervised Speech-Representation Model with Adapters. | Kenichi Fujita, Hiroshi Sato, Takanori Ashihara, Hiroki Kanagawa, Marc Delcroix, Takafumi Moriya, Yusuke Ijima |
| 2024 | ICASSP | How Does End-To-End Speech Recognition Training Impact Speech Enhancement Artifacts? | Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri |
| 2024 | ICASSP | Talking Face Generation for Impression Conversion Considering Speech Semantics. | Saki Mizuno, Nobukatsu Hojo, Kazutoshi Shinoda, Keita Suzuki, Mana Ihori, Hiroshi Sato, Tomohiro Tanaka, Naotaka Kawata, Satoshi Kobashikawa, Ryo Masumura |
| 2024 | Interspeech | Boosting Hybrid Autoregressive Transducer-based ASR with Internal Acoustic Model Training and Dual Blank Thresholding. | Takafumi Moriya, Takanori Ashihara, Masato Mimura, Hiroshi Sato, Kohei Matsuura, Ryo Masumura, Taichi Asami |
| 2024 | Interspeech | SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling. | Hiroshi Sato, Takafumi Moriya, Masato Mimura, Shota Horiguchi, Tsubasa Ochiai, Takanori Ashihara, Atsushi Ando, Kentaro Shinayama, Marc Delcroix |
| 2023 | ICASSP | Improving Scheduled Sampling for Neural Transducer-Based ASR. | Takafumi Moriya, Takanori Ashihara, Hiroshi Sato, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura |
| 2023 | ICASSP | Leveraging Language Embeddings for Cross-Lingual Self-Supervised Speech Representation Learning. | Tomohiro Tanaka, Ryo Masumura, Mana Ihori, Hiroshi Sato, Taiga Yamane, Takanori Ashihara, Kohei Matsuura, Takafumi Moriya |
| 2023 | INLG | Retrieval, Masking, and Generation: Feedback Comment Generation using Masked Comment Examples. | Mana Ihori, Hiroshi Sato, Tomohiro Tanaka, Ryo Masumura |
| 2023 | Interspeech | Audio-Visual Praise Estimation for Conversational Video based on Synchronization-Guided Multimodal Transformer. | Nobukatsu Hojo, Saki Mizuno, Satoshi Kobashikawa, Ryo Masumura, Mana Ihori, Hiroshi Sato, Tomohiro Tanaka |
| 2023 | Interspeech | Transcribing Speech as Spoken and Written Dual Text Using an Autoregressive Model. | Mana Ihori, Hiroshi Sato, Tomohiro Tanaka, Ryo Masumura, Saki Mizuno, Nobukatsu Hojo |
| 2023 | Interspeech | End-to-End Joint Target and Non-Target Speakers ASR. | Ryo Masumura, Naoki Makishima, Taiga Yamane, Yoshihiko Yamazaki, Saki Mizuno, Mana Ihori, Mihiro Uchida, Keita Suzuki, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando |
| 2023 | Interspeech | Knowledge Distillation for Neural Transducer-based Target-Speaker ASR: Exploiting Parallel Mixture/Single-Talker Speech Data. | Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takanori Ashihara, Kohei Matsuura, Tomohiro Tanaka, Ryo Masumura, Atsunori Ogawa, Taichi Asami |
| 2023 | Interspeech | Downstream Task Agnostic Speech Enhancement with Self-Supervised Representation Loss. | Hiroshi Sato, Ryo Masumura, Tsubasa Ochiai, Marc Delcroix, Takafumi Moriya, Takanori Ashihara, Kentaro Shinayama, Saki Mizuno, Mana Ihori, Tomohiro Tanaka, Nobukatsu Hojo |
| 2022 | COLING | Multi-Perspective Document Revision. | Mana Ihori, Hiroshi Sato, Tomohiro Tanaka, Ryo Masumura |
| 2022 | ICASSP | Customer Satisfaction Estimation Using Unsupervised Representation Learning with Multi-Format Prediction Loss. | Atsushi Ando, Yumiko Murata, Ryo Masumura, Satoshi Suzuki, Naoki Makishima, Takafumi Moriya, Takanori Ashihara, Hiroshi Sato |
| 2022 | ICASSP | Hybrid RNN-T/Attention-Based Streaming ASR with Triggered Chunkwise Attention and Dual Internal Language Model Integration. | Takafumi Moriya, Takanori Ashihara, Atsushi Ando, Hiroshi Sato, Tomohiro Tanaka, Kohei Matsuura, Ryo Masumura, Marc Delcroix, Takahiro Shinozaki |
| 2022 | ICASSP | Learning to Enhance or Not: Neural Network-Based Switching of Enhanced and Observed Signals for Overlapping Speech Recognition. | Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Naoyuki Kamo, Takafumi Moriya |
| 2022 | Interspeech | Listen only to me! How well can target speech extraction handle false alarms? | Marc Delcroix, Keisuke Kinoshita, Tsubasa Ochiai, Katerina Zmolkov, Hiroshi Sato, Tomohiro Nakatani |
| 2022 | Interspeech | How bad are artifacts?: Analyzing the impact of speech enhancement errors on ASR. | Kazuma Iwamoto, Tsubasa Ochiai, Marc Delcroix, Rintaro Ikeshita, Hiroshi Sato, Shoko Araki, Shigeru Katagiri |
| 2022 | Interspeech | End-to-End Joint Modeling of Conversation History-Dependent and Independent ASR Systems with Multi-History Training. | Ryo Masumura, Yoshihiro Yamazaki, Saki Mizuno, Naoki Makishima, Mana Ihori, Mihiro Uchida, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Shota Orihashi, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando |
| 2022 | Interspeech | Streaming Target-Speaker ASR with Neural Transducer. | Takafumi Moriya, Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Takahiro Shinozaki |
| 2022 | Interspeech | Strategies to Improve Robustness of Target Speech Extraction to Enrollment Variations. | Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoki Makishima, Mana Ihori, Tomohiro Tanaka, Ryo Masumura |
| 2022 | Interspeech | Domain Adversarial Self-Supervised Speech Representation Learning for Improving Unknown Domain Downstream Tasks. | Tomohiro Tanaka, Ryo Masumura, Hiroshi Sato, Mana Ihori, Kohei Matsuura, Takanori Ashihara, Takafumi Moriya |
| 2021 | ICASSP | Speech Emotion Recognition Based on Listener Adaptive Models. | Atsushi Ando, Ryo Masumura, Hiroshi Sato, Takafumi Moriya, Takanori Ashihara, Yusuke Ijima, Tomoki Toda |
| 2021 | ICASSP | Simpleflat: A Simple Whole-Network Pre-Training Approach for RNN Transducer-Based End-to-End Speech Recognition. | Takafumi Moriya, Takanori Ashihara, Tomohiro Tanaka, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Yusuke Ijima, Ryo Masumura, Yusuke Shinohara |
| 2021 | Interspeech | Streaming End-to-End Speech Recognition for Hybrid RNN-T/Attention Architecture. | Takafumi Moriya, Tomohiro Tanaka, Takanori Ashihara, Tsubasa Ochiai, Hiroshi Sato, Atsushi Ando, Ryo Masumura, Marc Delcroix, Taichi Asami |
| 2021 | Interspeech | Should We Always Separate?: Switching Between Enhanced and Observed Signals for Overlapping Speech Recognition. | Hiroshi Sato, Tsubasa Ochiai, Marc Delcroix, Keisuke Kinoshita, Takafumi Moriya, Naoyuki Kamo |
| 2020 | ICASSP | Distilling Attention Weights for CTC-Based ASR Systems. | Takafumi Moriya, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara |
| 2020 | Interspeech | Self-Distillation for Improving CTC-Transformer-Based ASR Systems. | Takafumi Moriya, Tsubasa Ochiai, Shigeki Karita, Hiroshi Sato, Tomohiro Tanaka, Takanori Ashihara, Ryo Masumura, Yusuke Shinohara, Marc Delcroix |
| 2019 | Interspeech | Neural Whispered Speech Detection with Imbalanced Learning. | Takanori Ashihara, Yusuke Shinohara, Hiroshi Sato, Takafumi Moriya, Kiyoaki Matsui, Takaaki Fukutomi, Yoshikazu Yamaguchi, Yushi Aono |
| 2019 | Interspeech | End-to-End Automatic Speech Recognition with a Reconstruction Criterion Using Speech-to-Text and Text-to-Speech Encoder-Decoders. | Ryo Masumura, Hiroshi Sato, Tomohiro Tanaka, Takafumi Moriya, Yusuke Ijima, Takanobu Oba |
| 2018 | ICAART | Improvement of Bias and Rising Threshold Algorithm based on Local Information Sharing. | Nhuhai Phung, Masao Kubo, Hiroshi Sato |
| 2018 | SMC | Analysis of a Parade with the Kuramoto Model - For Better Performance without Trainings. | Yohei Okugawa, Masao Kubo, Takato Shimohagi, Tento Ishikawa, Hiroshi Sato |
| 2017 | IFSA | Estimating the effect of an external factor behind an input-output table. | Kien Tran, Masao Kubo, Hiroshi Sato |
| 2016 | ICPRAM | GPS Trajectory Data Enrichment based on a Latent Statistical Model. | Akira Kinoshita, Atsuhiro Takasu, Kenro Aihara, Jun Ishii, Hisashi Kurasawa, Hiroshi Sato, Motonori Nakamura, Jun Adachi |
| 2015 | CEC | Dynamic leader selection based on approximate manipulability. | Hiroshi Sato, Masao Kubo, Tomohiro Shirakawa, Akira Namatame |
| 2014 | PERCOM | Missing sensor value estimation method for participatory sensing environment. | Hisashi Kurasawa, Hiroshi Sato, Atsushi Yamamoto, Hitoshi Kawasaki, Motonori Nakamura, Yohei Fujii, Hajime Matsumura |
| 2013 | IJCAI | Prior-Free Exploration Bonus for and beyond Near Bayes-Optimal Behavior. | Kenji Kawaguchi, Hiroshi Sato |
| 2013 | Interspeech | A digital signal processor implementation of silent/electrolaryngeal speech enhancement based on real-time statistical voice conversion. | Takuto Moriguchi, Tomoki Toda, Motoaki Sano, Hiroshi Sato, Graham Neubig, Sakriani Sakti, Satoshi Nakamura |
| 2013 | KES | Individual Reinforcement and Social Reinforcement: Analytical Model of Individual Behavior in Social Context. | Eugene S. Kitamura, Hiroshi Sato, Akira Namatame |
| 2012 | DEXA | Online Top-k Similar Time-Lagged Pattern Pair Search in Multiple Time Series. | Hisashi Kurasawa, Hiroshi Sato, Motonori Nakamura, Hajime Matsumura |
| 2012 | IAS | Target Enclosure for Multiple Targets. | Masao Kubo, Hiroshi Sato, Akihiro Yamaguchi, Tatsuro Yoshimura |
| 2011 | HCI | Development of an Eye-Tracking Pen Display for Analyzing Embodied Interaction. | Michiya Yamamoto, Hiroshi Sato, Keisuke Yoshida, Takashi Nagamatsu, Tomio Watanabe |
| 2011 | KES | Word Familiarity Distributions to Understand Heaps' Law of Vocabulary Growth of the Internet Forums. | Masao Kubo, Hiroshi Sato, Takashi Matsubara |
| 2010 | AINA | iAuth: HTTP Authentication Framework Integrated into HTML Forms. | Takeru Inoue, Yohei Katayama, Hiroshi Sato, Noriyuki Takahashi |
| 2010 | CHI | MobiGaze: development of a gaze interface for handheld mobile devices. | Takashi Nagamatsu, Michiya Yamamoto, Hiroshi Sato |
| 2010 | COMPSAC | Key Roles of Session State: Not against REST Architectural Style. | Takeru Inoue, Hiroshi Asakura, Hiroshi Sato, Noriyuki Takahashi |
| 2010 | DASFAA | Rapid Development of Web Applications by Introducing Database Systems with Web APIs. | Takeru Inoue, Hiroshi Asakura, Yukio Uematsu, Hiroshi Sato, Noriyuki Takahashi |
| 2010 | KES | Population Estimation of Internet Forum Community by Posted Article Distribution. | Masao Kubo, Keitaro Naruse, Hiroshi Sato, Takashi Matsubara |
| 2009 | CEC | Symmetric networks foster to evolve desirable turn-taking rules in dispersion games. | Akira Namatame, Hiroshi Sato |
| 2009 | PDCAT | Virtual Scent: Finding Locations of Interest in Ambient Intelligence Environments. | Hiroshi Sato, Takeru Inoue, Hideaki Iwamoto, Noriyuki Takahashi |
| 2007 | IDEAL | The Possibility of an Epidemic Meme Analogy for Web Community Population Analysis. | Masao Kubo, Keitaro Naruse, Hiroshi Sato, Takashi Matsubara |
| 2007 | IDEAL | Video-Based Conjoint Analysis and Agent Based Simulation for Estimating Customer's Behavior. | Hiroshi Sato, Masao Kubo, Akira Namatame |
| 2006 | IAS | An Adaptive Behavior of Mobile Ad Hoc Network Agents. | Masao Kubo, Chau Dan, Hiroshi Sato, Takashi Matsubara |
| 2002 | CEC | Realizing unstable social efficiency with mutual learning of meta-rules. | Yukikazu Murakami, Hiroshi Sato, Akira Namatame |
| 2002 | ICCHP | Braille Printing System. | Shunsuke Hara, Ryoko Kawamitsu, Kanako Kusunoki, Hiroshi Sato, Mamoru Fujiyoshi |
| 2001 | CEC | Co-evolution in social interactions. | Hiroshi Sato, Akira Namatame |
| 2000 | ICRA | Suppression of Mechanical Coupling for Parallel Beam Gyroscope. | Hiroshi Sato, Toshio Fukuda, Fumihito Arai, Kouichi Itoigawa, Yasuhisa Tsukahara |
| 1999 | ICRA | Analysis of Parallel Beam Gyroscope. | Hiroshi Sato, Toshio Fukuda, Fumihito Arai, Hitoshi Iwata, Kouichi Itoigawa |
| 1998 | ICRA | Parallel Beam Micro Sensor/Actuator Unit Using PZT Thin Films and its Application Examples. | Toshio Fukuda, Hiroshi Sato, Fumihito Arai, Hitoshi Iwata, Kouichi Itoigawa |