Skip to content

Saki Mizuno

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

14

Venues

4

Active years

2022–2025

Best venue rank

A*

Where they publish

Papers

14 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIMultimodal Fine-Grained Apparent Personality Trait Recognition: Joint Modeling of Big Five and Questionnaire Item-level Scores.Ryo Masumura, Shota Orihashi, Mana Ihori, Tomohiro Tanaka, Naoki Makishima, Satoshi Suzuki, Saki Mizuno, Nobukatsu Hojo
2025AAAIToMATO: Verbalizing the Mental States of Role-Playing LLMs for Benchmarking Theory of Mind.Kazutoshi Shinoda, Nobukatsu Hojo, Kyosuke Nishida, Saki Mizuno, Keita Suzuki, Ryo Masumura, Hiroaki Sugiyama, Kuniko Saito
2024ICASSPTalking Face Generation for Impression Conversion Considering Speech Semantics.Saki Mizuno, Nobukatsu Hojo, Kazutoshi Shinoda, Keita Suzuki, Mana Ihori, Hiroshi Sato, Tomohiro Tanaka, Naotaka Kawata, Satoshi Kobashikawa, Ryo Masumura
2024InterspeechUnified Multi-Talker ASR with and without Target-speaker Enrollment.Ryo Masumura, Naoki Makishima, Tomohiro Tanaka, Mana Ihori, Naotaka Kawata, Shota Orihashi, Kazutoshi Shinoda, Taiga Yamane, Saki Mizuno, Keita Suzuki, Satoshi Suzuki, Nobukatsu Hojo, Takafumi Moriya, Atsushi Ando
2024InterspeechLearning from Multiple Annotator Biased Labels in Multimodal Conversation.Kazutoshi Shinoda, Nobukatsu Hojo, Saki Mizuno, Keita Suzuki, Satoshi Kobashikawa, Ryo Masumura
2024InterspeechParticipant-Pair-Wise Bottleneck Transformer for Engagement Estimation from Video Conversation.Keita Suzuki, Nobukatsu Hojo, Kazutoshi Shinoda, Saki Mizuno, Ryo Masumura
2023ICASSPModeling Lead-Lag Structure in Facial Expression Synchrony for Social-Psychological Outcome Prediction from Negotiation Interaction.Nobukatsu Hojo, Saki Mizuno, Satoshi Kobashikawa, Ryo Masumura
2023ICASSPNext-Speaker Prediction Based on Non-Verbal Information in Multi-Party Video Conversation.Saki Mizuno, Nobukatsu Hojo, Satoshi Kobashikawa, Ryo Masumura
2023InterspeechAudio-Visual Praise Estimation for Conversational Video based on Synchronization-Guided Multimodal Transformer.Nobukatsu Hojo, Saki Mizuno, Satoshi Kobashikawa, Ryo Masumura, Mana Ihori, Hiroshi Sato, Tomohiro Tanaka
2023InterspeechTranscribing Speech as Spoken and Written Dual Text Using an Autoregressive Model.Mana Ihori, Hiroshi Sato, Tomohiro Tanaka, Ryo Masumura, Saki Mizuno, Nobukatsu Hojo
2023InterspeechEnd-to-End Joint Target and Non-Target Speakers ASR.Ryo Masumura, Naoki Makishima, Taiga Yamane, Yoshihiko Yamazaki, Saki Mizuno, Mana Ihori, Mihiro Uchida, Keita Suzuki, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando
2023InterspeechDownstream Task Agnostic Speech Enhancement with Self-Supervised Representation Loss.Hiroshi Sato, Ryo Masumura, Tsubasa Ochiai, Marc Delcroix, Takafumi Moriya, Takanori Ashihara, Kentaro Shinayama, Saki Mizuno, Mana Ihori, Tomohiro Tanaka, Nobukatsu Hojo
2022InterspeechEnd-to-End Joint Modeling of Conversation History-Dependent and Independent ASR Systems with Multi-History Training.Ryo Masumura, Yoshihiro Yamazaki, Saki Mizuno, Naoki Makishima, Mana Ihori, Mihiro Uchida, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Shota Orihashi, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando
2022LRECMultimodal Negotiation Corpus with Various Subjective Assessments for Social-Psychological Outcome Prediction from Non-Verbal Cues.Nobukatsu Hojo, Satoshi Kobashikawa, Saki Mizuno, Ryo Masumura