Skip to content

Shota Orihashi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

30

Venues

11

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

30 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIDifference Vector Equalization for Robust Fine-tuning of Vision-Language Models.Satoshi Suzuki, Shin'ya Yamaguchi, Shoichiro Takeda, Taiga Yamane, Naoki Makishima, Naotaka Kawata, Mana Ihori, Tomohiro Tanaka, Shota Orihashi, Ryo Masumura
2026WACVDistribution Highlighted Reference-based Label Distribution Learning for Facial Age Estimation.Satoshi Suzuki, Shin'ya Yamaguchi, Shoichiro Takeda, Takuhiro Kaneko, Shota Orihashi, Ryo Masumura
2025AAAIMultimodal Fine-Grained Apparent Personality Trait Recognition: Joint Modeling of Big Five and Questionnaire Item-level Scores.Ryo Masumura, Shota Orihashi, Mana Ihori, Tomohiro Tanaka, Naoki Makishima, Satoshi Suzuki, Saki Mizuno, Nobukatsu Hojo
2025ASRUFew-shot Personalization via In-Context Learning for Speech Emotion Recognition based on Speech-Language Model.Mana Ihori, Taiga Yamane, Naotaka Kawata, Naoki Makishima, Tomohiro Tanaka, Satoshi Suzuki, Shota Orihashi, Ryo Masumura
2025ASRUPhoneme Overlapping-Aware Pre-Training with External Text Resources for Multi-Talker ASR.Ryo Masumura, Tomohiro Tanaka, Naoki Makishima, Mana Ihori, Shota Orihashi, Naotaka Kawata, Taiga Yamane, Satoshi Suzuki, Takafumi Moriya
2025ICCVMVTrajecter: Multi-View Pedestrian Tracking With Trajectory Motion Cost and Trajectory Appearance Cost.Taiga Yamane, Ryo Masumura, Satoshi Suzuki, Shota Orihashi
2025InterspeechUnified Audio-Visual Modeling for Recognizing Which Face Spoke When and What in Multi-Talker Overlapped Speech and Video.Naoki Makishima, Naotaka Kawata, Taiga Yamane, Mana Ihori, Tomohiro Tanaka, Satoshi Suzuki, Shota Orihashi, Ryo Masumura
2025InterspeechSOMSRED-SVC: Sequential Output Modeling with Speaker Vector Constraints for Joint Multi-Talker Overlapped ASR and Speaker Diarization.Naoki Makishima, Naotaka Kawata, Taiga Yamane, Mana Ihori, Tomohiro Tanaka, Satoshi Suzuki, Shota Orihashi, Ryo Masumura
2024ICPRBorn-Again Multi-task Self-training for Multi-task Facial Emotion Recognition.Ryo Masumura, Akihiko Takashima, Satoshi Suzuki, Shota Orihashi
2024InterspeechSOMSRED: Sequential Output Modeling for Joint Multi-talker Overlapped Speech Recognition and Speaker Diarization.Naoki Makishima, Naotaka Kawata, Mana Ihori, Tomohiro Tanaka, Shota Orihashi, Atsushi Ando, Ryo Masumura
2024InterspeechUnified Multi-Talker ASR with and without Target-speaker Enrollment.Ryo Masumura, Naoki Makishima, Tomohiro Tanaka, Mana Ihori, Naotaka Kawata, Shota Orihashi, Kazutoshi Shinoda, Taiga Yamane, Saki Mizuno, Keita Suzuki, Satoshi Suzuki, Nobukatsu Hojo, Takafumi Moriya, Atsushi Ando
2023ICIPDistilling Knowledge of Bidirectional Language Model for Scene Text Recognition.Shota Orihashi, Yoshihiro Yamazaki, Mihiro Uchida, Akihiko Takashima, Ryo Masumura
2023ICIPOpen-Set Recognition for Facial-Expression Recognition.Mihiro Uchida, Shota Orihashi, Akihiko Takashima, Yoshihiro Yamazaki, Ryo Masumura
2022ICIPFully Shareable Scene Text Recognition Modeling for Horizontal and Vertical Writing.Shota Orihashi, Yoshihiro Yamazaki, Mihiro Uchida, Akihiko Takashima, Ryo Masumura
2022InterspeechEnd-to-End Joint Modeling of Conversation History-Dependent and Independent ASR Systems with Multi-History Training.Ryo Masumura, Yoshihiro Yamazaki, Saki Mizuno, Naoki Makishima, Mana Ihori, Mihiro Uchida, Hiroshi Sato, Tomohiro Tanaka, Akihiko Takashima, Satoshi Suzuki, Shota Orihashi, Takafumi Moriya, Nobukatsu Hojo, Atsushi Ando
2022InterspeechInteractive Co-Learning with Cross-Modal Transformer for Audio-Visual Emotion Recognition.Akihiko Takashima, Ryo Masumura, Atsushi Ando, Yoshihiro Yamazaki, Mihiro Uchida, Shota Orihashi
2021ASRUHierarchical Knowledge Distillation for Dialogue Sequence Labeling.Shota Orihashi, Yoshihiro Yamazaki, Naoki Makishima, Mana Ihori, Akihiko Takashima, Tomohiro Tanaka, Ryo Masumura
2021ICASSPMAPGN: Masked Pointer-Generator Network for Sequence-to-Sequence Pre-Training.Mana Ihori, Naoki Makishima, Tomohiro Tanaka, Akihiko Takashima, Shota Orihashi, Ryo Masumura
2021ICASSPAudio-Visual Speech Separation Using Cross-Modal Correspondence Loss.Naoki Makishima, Mana Ihori, Akihiko Takashima, Tomohiro Tanaka, Shota Orihashi, Ryo Masumura
2021ICASSPHierarchical Transformer-Based Large-Context End-To-End ASR with Large-Context Knowledge Distillation.Ryo Masumura, Naoki Makishima, Mana Ihori, Akihiko Takashima, Tomohiro Tanaka, Shota Orihashi
2021InterspeechZero-Shot Joint Modeling of Multiple Spoken-Text-Style Conversion Tasks Using Switching Tokens.Mana Ihori, Naoki Makishima, Tomohiro Tanaka, Akihiko Takashima, Shota Orihashi, Ryo Masumura
2021InterspeechEnrollment-Less Training for Personalized Voice Activity Detection.Naoki Makishima, Mana Ihori, Tomohiro Tanaka, Akihiko Takashima, Shota Orihashi, Ryo Masumura
2021InterspeechUnified Autoregressive Modeling for Joint End-to-End Multi-Talker Overlapped Speech Recognition and Speaker Attribute Estimation.Ryo Masumura, Daiki Okamura, Naoki Makishima, Mana Ihori, Akihiko Takashima, Tomohiro Tanaka, Shota Orihashi
2021InterspeechCross-Modal Transformer-Based Neural Correction Models for Automatic Speech Recognition.Tomohiro Tanaka, Ryo Masumura, Mana Ihori, Akihiko Takashima, Takafumi Moriya, Takanori Ashihara, Shota Orihashi, Naoki Makishima
2021InterspeechEnd-to-End Rich Transcription-Style Automatic Speech Recognition with Semi-Supervised Learning.Tomohiro Tanaka, Ryo Masumura, Mana Ihori, Akihiko Takashima, Shota Orihashi, Naoki Makishima
2020INLGMemory Attentive Fusion: External Language Model Integration for Transformer-based Sequence-to-Sequence Model.Mana Ihori, Ryo Masumura, Naoki Makishima, Tomohiro Tanaka, Akihiko Takashima, Shota Orihashi
2020InterspeechPhoneme-to-Grapheme Conversion Based Large-Scale Pre-Training for End-to-End Automatic Speech Recognition.Ryo Masumura, Naoki Makishima, Mana Ihori, Akihiko Takashima, Tomohiro Tanaka, Shota Orihashi
2020InterspeechUnsupervised Domain Adaptation for Dialogue Sequence Labeling Based on Hierarchical Adversarial Training.Shota Orihashi, Mana Ihori, Tomohiro Tanaka, Ryo Masumura
2019PCSGAN-based Image Compression Using Mutual Information Maximizing Regularization.Shinobu Kudo, Shota Orihashi, Ryuichi Tanida, Atsushi Shimizu
2015ISMAn Adaptive H.265/HEVC Encoding Control for 8K UHDTV Movies Based on Motion Complexity Estimation.Shota Orihashi, Rintaro Harada, Yasutaka Matsuo, Jiro Katto