| 2026 | AAAI | LLM-Free Image Captioning Evaluation in Reference-Flexible Settings. | Shinnosuke Hirano, Yuiga Wada, Kazuki Matsuda, Seitaro Otsuki, Komei Sugiura |
| 2026 | ICPR | ABMAMBA: Multimodal Large Language Model with Aligned Hierarchical Bidirectional Scan for Efficient Video Captioning. | Daichi Yashima, Shuhei Kurita, Yusuke Oda, Shuntaro Suzuki, Seitaro Otsuki, Komei Sugiura |
| 2025 | EMNLP | VELA: An LLM-Hybrid-as-a-Judge Approach for Evaluating Long Image Captions. | Kazuki Matsuda, Yuiga Wada, Shinnosuke Hirano, Seitaro Otsuki, Komei Sugiura |
| 2025 | ICASSP | Interactive Robot Action Replanning using Multimodal LLM Trained from Human Demonstration Videos. | Chiori Hori, Motonari Kambara, Komei Sugiura, Kei Ota, Sameer Khurana, Siddarth Jain, Radu Corcodel, Devesh K. Jha, Diego Romeres, Jonathan Le Roux |
| 2025 | ICCV | Deep Space Weather Model: Long-Range Solar Flare Prediction from Multi-Wavelength Images. | Shunya Nagashima, Komei Sugiura |
| 2025 | MVA | Pre-Manipulation Alignment Prediction for Open-Vocabulary Object Manipulation Based on End-Effector Trajectories. | Motonari Kambara, Komei Sugiura |
| 2024 | ACCV | Deneb: A Hallucination-Robust Automatic Evaluation Metric for Image Captioning. | Kazuki Matsuda, Yuiga Wada, Komei Sugiura |
| 2024 | CoRL | Task Success Prediction for Open-Vocabulary Manipulation Based on Multi-Level Aligned Representations. | Miyu Goko, Motonari Kambara, Daichi Saito, Seitaro Otsuki, Komei Sugiura |
| 2024 | CVPR | Polos: Multimodal Metric Learning from Human Feedback for Image Captioning. | Yuiga Wada, Kanta Kaneda, Daichi Saito, Komei Sugiura |
| 2024 | ECCV | Layer-Wise Relevance Propagation with Conservation Property for ResNet. | Seitaro Otsuki, Tsumugi Iida, Flix Doublet, Tsubasa Hirakawa, Takayoshi Yamashita, Hironobu Fujiyoshi, Komei Sugiura |
| 2024 | IROS | Object Segmentation from Open-Vocabulary Manipulation Instructions Based on Optimal Transport Polygon Matching with Multimodal Foundation Models. | Takayuki Nishimura, Katsuyuki Kuyo, Motonari Kambara, Komei Sugiura |
| 2023 | CoNLL | JaSPICE: Automatic Evaluation Metric Using Predicate-Argument Structures for Image Captioning Models. | Yuiga Wada, Kanta Kaneda, Komei Sugiura |
| 2023 | IROS | Multimodal Diffusion Segmentation Model for Object Segmentation from Manipulation Instructions. | Yui Iioka, Yu Yoshida, Yuiga Wada, Shumpei Hatanaka, Komei Sugiura |
| 2023 | IROS | Switching Head-Tail Funnel UNITER for Dual Referring Expression Comprehension with Fetch-and-Carry Tasks. | Ryosuke Korekata, Motonari Kambara, Yu Yoshida, Shintaro Ishikawa, Yosuke Kawasaki, Masaki Takahashi, Komei Sugiura |
| 2023 | IROS | Prototypical Contrastive Transfer Learning for Multimodal Language Understanding. | Seitaro Otsuki, Shintaro Ishikawa, Komei Sugiura |
| 2022 | ACCV | Visual Explanation Generation Based on Lambda Attention Branch Networks. | Tsumugi Iida, Takumi Komatsu, Kanta Kaneda, Tsubasa Hirakawa, Takayoshi Yamashita, Hironobu Fujiyoshi, Komei Sugiura |
| 2022 | ACCV | Flare Transformer: Solar Flare Prediction Using Magnetograms and Sunspot Physical Features. | Kanta Kaneda, Yuiga Wada, Tsumugi Iida, Naoto Nishizuka, Yki Kubo, Komei Sugiura |
| 2022 | ICASSP | Shared Transformer Encoder with Mask-Based 3d Model Estimation for Container Mass Estimation. | Tomoya Matsubara, Seitaro Otsuki, Yuiga Wada, Haruka Matsuo, Takumi Komatsu, Yui Iioka, Komei Sugiura, Hideo Saito |
| 2022 | ICIP | Relational Future Captioning Model for Explaining Likely Collisions in Daily Tasks. | Motonari Kambara, Komei Sugiura |
| 2022 | ICPR | Moment-based Adversarial Training for Embodied Language Comprehension. | Shintaro Ishikawa, Komei Sugiura |
| 2021 | ICCV | Unified Questioner Transformer for Descriptive Question Generation in Goal-Oriented Visual Dialogue. | Shoya Matsumori, Kosuke Shingyouchi, Yuki Abe, Yosuke Fukuchi, Komei Sugiura, Michita Imai |
| 2021 | IJCNN | Visual Explanation using Attention Mechanism in Actor-Critic-based Deep Reinforcement Learning. | Hidenori Itaya, Tsubasa Hirakawa, Takayoshi Yamashita, Hironobu Fujiyoshi, Komei Sugiura |
| 2019 | CoRL | Multimodal Attention Branch Network for Perspective-Free Sentence Generation. | Aly Magassouba, Komei Sugiura, Hisashi Kawai |
| 2017 | ASRU | Grounded language understanding for manipulation instructions using GAN-based classification. | Komei Sugiura, Hisashi Kawai |
| 2016 | HRI | Analysis of Long-Term and Large-Scale Experiments on Robot Dialogues Using a Cloud Robotics Platform. | Komei Sugiura, Koji Zettsu |
| 2015 | Interspeech | Entropy-based sentence selection for speech synthesis using phonetic and prosodic contexts. | Takashi Nose, Yusuke Arao, Takao Kobayashi, Komei Sugiura, Yoshinori Shiga, Akinori Ito |
| 2015 | IROS | Rospeex: A cloud robotics platform for human-robot spoken dialogues. | Komei Sugiura, Koji Zettsu |
| 2014 | BigData | Spatio-temporal Pseudo Relevance Feedback for Large-Scale and Heterogeneous Scientific Repositories. | Shin'ichi Takeuchi, Yuhei Akahoshi, Bun Theang Ong, Komei Sugiura, Koji Zettsu |
| 2014 | HRI | A new dimension for RoboCup @home: human-robot interaction between virtual and real worlds. | Jeffrey Too Chuan Tan, Tetsunari Inamura, Yoshinobu Hagiwara, Komei Sugiura, Takayuki Nagai, Hiroyuki Okada |
| 2014 | ICRA | Non-monologue HMM-based speech synthesis for service robots: A cloud robotics approach. | Komei Sugiura, Yoshinori Shiga, Hisashi Kawai, Teruhisa Misu, Chiori Hori |
| 2014 | RoboCup | On RoboCup@Home - Past, Present and Future of a Scientific Competition for Service Robots. | Dirk Holz, Javier Ruiz-del-Solar, Komei Sugiura, Sven Wachsmuth |
| 2013 | MDM | Complementary Integration of Heterogeneous Crowd-Sourced Datasets for Enhanced Social Analytics. | Ryong Lee, Kyoung-Sook Kim, Komei Sugiura, Koji Zettsu, Yutaka Kidawara |
| 2013 | MDM | Utterance Classification Using Linguistic and Non-linguistic Information for Network-Based Speech-to-Speech Translation Systems. | Komei Sugiura, Ryong Lee, Hideki Kashioka, Koji Zettsu, Yutaka Kidawara |
| 2013 | RoboCup | Development of RoboCup@Home Simulation towards Long-term Large Scale HRI. | Tetsunari Inamura, Jeffrey Too Chuan Tan, Komei Sugiura, Takayuki Nagai, Hiroyuki Okada |
| 2011 | IROS | Motion generation by reference-point-dependent trajectory HMMs. | Komei Sugiura, Naoto Iwahashi, Hideki Kashioka |
| 2010 | ICASSP | Robot-directed speech detection using Multimodal Semantic Confidence based on speech, image, and motion. | Xiang Zuo, Naoto Iwahashi, Ryo Taguchi, Shigeki Matsuda, Komei Sugiura, Kotaro Funakoshi, Mikio Nakano, Natsuki Oka |
| 2010 | ICRA | Learning novel objects using out-of-vocabulary word segmentation and object extraction for home assistant robots. | Muhammad Attamimi, Attamini Mizutani, Tomoaki Nakamura, Komei Sugiura, Takayuki Nagai, Naoto Iwahashi, Hiroyuki Okada, Takashi Omori |
| 2010 | IROS | Active learning of confidence measure function in robot language acquisition framework. | Komei Sugiura, Naoto Iwahashi, Hideki Kashioka, Satoshi Nakamura |
| 2010 | RO-MAN | Detecting robot-directed speech by situated understanding in object manipulation tasks. | Xiang Zuo, Naoto Iwahashi, Ryo Taguchi, Kotaro Funakoshi, Mikio Nakano, Shigeki Matsuda, Komei Sugiura, Natsuki Oka |
| 2010 | SIGdial | Modeling Spoken Decision Making Dialogue and Optimization of its Dialogue Strategy. | Teruhisa Misu, Komei Sugiura, Kiyonori Ohtake, Chiori Hori, Hideki Kashioka, Hisashi Kawai, Satoshi Nakamura |
| 2009 | Interspeech | Bayesian learning of confidence measure function for generation of utterances and motions in object manipulation dialogue task. | Komei Sugiura, Naoto Iwahashi, Hideki Kashioka, Satoshi Nakamura |
| 2008 | IROS | Motion recognition and generation by combining reference-point-dependent probabilistic models. | Komei Sugiura, Naoto Iwahashi |
| 2005 | SMC | Exploiting interaction between sensory morphology and learning. | Komei Sugiura, Makoto Akahane, Takayuki Shiose, Katsunori Shimohara, Osamu Katai |