| 2026 | ICTIR | Analysis of Reasoning-Intensive Retrieval in Japanese. | Hiroki Kurokawa, Hirotaka Kameko, Shinsuke Mori |
| 2026 | LREC | LegalRikai: Open Benchmark - a Benchmark for Complex Japanese Corporate Legal Tasks. | Shogo Fujita, Yuji Naraki, Yiqing Zhu, Shinsuke Mori |
| 2026 | LREC | JFC-Recipe: A Dataset for Nutrient Estimation from Japanese User-Generated Cooking Recipes. | Keisuke Shirai, Yoko Yamakata, Hirotaka Kameko, Akiko Sunto, Jun Harashima, Shinsuke Mori |
| 2025 | CVPR | Generating 6DoF Object Manipulation Trajectories from Action Description in Egocentric Vision. | Tomoya Yoshida, Shuhei Kurita, Taichi Nishimura, Shinsuke Mori |
| 2025 | ICCV | EgoOops: A Dataset for Mistake Action Detection from Egocentric Videos referring to Procedural Texts. | Yuto Haneji, Taichi Nishimura, Hirotaka Kameko, Keisuke Shirai, Tomoya Yoshida, Keiya Kajimura, Koki Yamamoto, Taiyu Cui, Tomohiro Nishimoto, Shinsuke Mori |
| 2025 | ICIP | BioVL-QR: Egocentric Biochemical Vision-And-Language Dataset Using Micro QR Codes. | Tomohiro Nishimoto, Taichi Nishimura, Koki Yamamoto, Keisuke Shirai, Hirotaka Kameko, Yuto Haneji, Tomoya Yoshida, Keiya Kajimura, Taiyu Cui, Chihiro Nishiwaki, Eriko Daikoku, Natsuko Okuda, Fumihito Ono, Shinsuke Mori |
| 2024 | COLING | Automatic Construction of a Large-Scale Corpus for Geoparsing Using Wikipedia Hyperlinks. | Keyaki Ohno, Hirotaka Kameko, Keisuke Shirai, Taichi Nishimura, Shinsuke Mori |
| 2024 | ICRA | Vision-Language Interpreter for Robot Task Planning. | Keisuke Shirai, Cristian C. Beltran-Hernandez, Masashi Hamaya, Atsushi Hashimoto, Shohei Tanaka, Kento Kawaharazuka, Kazutoshi Tanaka, Yoshitaka Ushiku, Shinsuke Mori |
| 2022 | COLING | Visual Recipe Flow: A Dataset for Learning Visual State Changes of Objects with Recipe Flows. | Keisuke Shirai, Atsushi Hashimoto, Taichi Nishimura, Hirotaka Kameko, Shuhei Kurita, Yoshitaka Ushiku, Shinsuke Mori |
| 2022 | HCI | Cross-modal Representation Learning for Understanding Manufacturing Procedure. | Atsushi Hashimoto, Taichi Nishimura, Yoshitaka Ushiku, Hirotaka Kameko, Shinsuke Mori |
| 2020 | LREC | A Contract Corpus for Recognizing Rights and Obligations. | Ruka Funaki, Yusuke Nagata, Kohei Suenaga, Shinsuke Mori |
| 2020 | LREC | Annotating Event Appearance for Japanese Chess Commentary Corpus. | Hirotaka Kameko, Shinsuke Mori |
| 2020 | LREC | Visual Grounding Annotation of Recipe Flow Graph. | Taichi Nishimura, Suzushi Tomori, Hayato Hashimoto, Atsushi Hashimoto, Yoko Yamakata, Jun Harashima, Yoshitaka Ushiku, Shinsuke Mori |
| 2020 | LREC | English Recipe Flow Graph Corpus. | Yoko Yamakata, Shinsuke Mori, John Carroll |
| 2019 | CICLING | A Hybrid Generative/Discriminative Model for Rapid Prototyping of Domain-Specific Named Entity Recognition. | Suzushi Tomori, Yugo Murawaki, Shinsuke Mori |
| 2019 | INLG | Procedural Text Generation from a Photo Sequence. | Taichi Nishimura, Atsushi Hashimoto, Shinsuke Mori |
| 2018 | LREC | Universal Dependencies Version 2 for Japanese. | Masayuki Asahara, Hiroshi Kanayama, Takaaki Tanaka, Yusuke Miyao, Sumire Uematsu, Shinsuke Mori, Yuji Matsumoto, Mai Omura, Yugo Murawaki |
| 2018 | LREC | Annotating Modality Expressions and Event Factuality for a Japanese Chess Commentary Corpus. | Suguru Matsuyoshi, Hirotaka Kameko, Yugo Murawaki, Shinsuke Mori |
| 2017 | IJCAI | A Comparison of Cooking Recipe Named Entities between Japanese and English. | Yoko Yamakata, John Carroll, Shinsuke Mori |
| 2017 | IJCNLP | Procedural Text Generation from an Execution Video. | Atsushi Ushiku, Hayato Hashimoto, Atsushi Hashimoto, Shinsuke Mori |
| 2017 | PACLIC | Japanese all-words WSD system using the Kyoto Text Analysis ToolKit. | Hiroyuki Shinnou, Kanako Komiya, Minoru Sasaki, Shinsuke Mori |
| 2017 | SIGIR | Game State Retrieval with Keyword Queries. | Atsushi Ushiku, Shinsuke Mori, Hirotaka Kameko, Yoshimasa Tsuruoka |
| 2016 | ACL | Domain Specific Named Entity Recognition Referring to the Real World by Deep Neural Networks. | Suzushi Tomori, Takashi Ninomiya, Shinsuke Mori |
| 2016 | HCI | Design in Everyday Cooking: Challenges for Assisting with Menu Planning and Food Preparation. | Atsushi Hashimoto, Jun Harashima, Yoko Yamakata, Shinsuke Mori |
| 2016 | LREC | A Japanese Chess Commentary Corpus. | Shinsuke Mori, John Richardson, Atsushi Ushiku, Tetsuro Sasada, Hirotaka Kameko, Yoshimasa Tsuruoka |
| 2016 | LREC | Wikification for Scriptio Continua. | Yugo Murawaki, Shinsuke Mori |
| 2016 | LREC | Universal Dependencies for Japanese. | Takaaki Tanaka, Yusuke Miyao, Masayuki Asahara, Sumire Uematsu, Hiroshi Kanayama, Shinsuke Mori, Yuji Matsumoto |
| 2016 | LREC | Language Resource Addition Strategies for Raw Text Parsing. | Atsushi Ushiku, Tetsuro Sasada, Shinsuke Mori |
| 2016 | LREC | Parallel Speech Corpora of Japanese Dialects. | Koichiro Yoshino, Naoki Hirayama, Shinsuke Mori, Fumihiko Takahashi, Katsutoshi Itoyama, Hiroshi G. Okuno |
| 2015 | EMNLP | Can Symbol Grounding Improve Low-Level NLP? Word Segmentation as a Case Study. | Hirotaka Kameko, Shinsuke Mori, Yoshimasa Tsuruoka |
| 2015 | EMNLP | Keyboard Logs as Natural Annotations for Word Segmentation. | Fumihiko Takahashi, Shinsuke Mori |
| 2014 | AMTA | Japanese-to-English patent translation system based on domain-adapted word segmentation and post-ordering. | Katsuhito Sudoh, Masaaki Nagata, Shinsuke Mori, Tatsuya Kawahara |
| 2014 | INLG | FlowGraph2Text: Automatic Sentence Skeleton Compilation for Procedural Text Generation. | Shinsuke Mori, Hirokuni Maeta, Tetsuro Sasada, Koichiro Yoshino, Atsushi Hashimoto, Takuya Funatomi, Yoko Yamakata |
| 2014 | LREC | Flow Graph Corpus from Recipe Texts. | Shinsuke Mori, Hirokuni Maeta, Yoko Yamakata, Tetsuro Sasada |
| 2014 | LREC | Language Resource Addition: Dictionary or Corpus? | Shinsuke Mori, Graham Neubig |
| 2014 | LREC | A Japanese Word Dependency Corpus. | Shinsuke Mori, Hideki Ogura, Tetsuro Sasada |
| 2013 | EMNLP | Noise-Aware Character Alignment for Bootstrapping Statistical Machine Transliteration from Bilingual Corpora. | Katsuhito Sudoh, Shinsuke Mori, Masaaki Nagata |
| 2013 | ICASSP | Incorporating semantic information to selection of web texts for language model of spoken dialogue system. | Koichiro Yoshino, Shinsuke Mori, Tatsuya Kawahara |
| 2013 | IJCNLP | A Framework and Tool for Collaborative Extraction of Reliable Information. | Graham Neubig, Shinsuke Mori, Masahiro Mizukami |
| 2013 | IJCNLP | Predicate Argument Structure Analysis using Partially Annotated Corpora. | Koichiro Yoshino, Shinsuke Mori, Tatsuya Kawahara |
| 2013 | Interspeech | Automatic estimation of dialect mixing ratio for dialect speech recognition. | Naoki Hirayama, Koichiro Yoshino, Katsutoshi Itoyama, Shinsuke Mori, Hiroshi G. Okuno |
| 2012 | ACL | Machine Translation without Words through Substring Alignment. | Graham Neubig, Taro Watanabe, Shinsuke Mori, Tatsuya Kawahara |
| 2012 | COLING | Statistical Method of Building Dialect Language Models for ASR Systems. | Naoki Hirayama, Shinsuke Mori, Hiroshi G. Okuno |
| 2012 | COLING | Language Modeling for Spoken Dialogue System based on Filtering using Predicate-Argument Structures. | Koichiro Yoshino, Shinsuke Mori, Tatsuya Kawahara |
| 2012 | EMNLP | Inducing a Discriminative Parser to Optimize Machine Translation Reordering. | Graham Neubig, Taro Watanabe, Shinsuke Mori |
| 2011 | ACL | Pointwise Prediction for Robust, Adaptable Japanese Morphological Analysis. | Graham Neubig, Yosuke Nakata, Shinsuke Mori |
| 2011 | ACL | An Unsupervised Model for Joint Phrase Alignment and Extraction. | Graham Neubig, Taro Watanabe, Eiichiro Sumita, Shinsuke Mori, Tatsuya Kawahara |
| 2011 | IJCNLP | Training Dependency Parsers from Partially Annotated Corpora. | Daniel Flannery, Yusuke Miyao, Graham Neubig, Shinsuke Mori |
| 2011 | IJCNLP | Discriminative Method for Japanese Kana-Kanji Input Method. | Hiroyuki Tokunaga, Daisuke Okanohara, Shinsuke Mori |
| 2011 | Interspeech | A Pointwise Approach to Pronunciation Estimation for a TTS Front-End. | Shinsuke Mori, Graham Neubig |
| 2011 | SIGdial | Spoken Dialogue System based on Information Extraction using Similarity of Predicate Argument Structures. | Koichiro Yoshino, Shinsuke Mori, Tatsuya Kawahara |
| 2010 | ICASSP | Improved statistical models for SMT-based speaking style transformation. | Graham Neubig, Yuya Akita, Shinsuke Mori, Tatsuya Kawahara |
| 2010 | Interspeech | Classroom note-taking system for hearing impaired students using automatic speech recognition adapted to lectures. | Tatsuya Kawahara, Norihiro Katsumaru, Yuya Akita, Shinsuke Mori |
| 2010 | Interspeech | Learning a language model from continuous speech. | Graham Neubig, Masato Mimura, Shinsuke Mori, Tatsuya Kawahara |
| 2010 | LREC | Word-based Partial Annotation for Efficient Corpus Construction. | Graham Neubig, Shinsuke Mori |
| 2010 | SMC | Semantic words similarity in triple relation using intermediate concept by PLSI. | Incheon Paik, Shinsuke Mori, Wuhui Chen |
| 2009 | Interspeech | A WFST-based log-linear framework for speaking-style transformation. | Graham Neubig, Shinsuke Mori, Tatsuya Kawahara |
| 2008 | COLING | Training Conditional Random Fields Using Incomplete Annotations. | Yuta Tsuboi, Hisashi Kashima, Shinsuke Mori, Hiroki Oda, Yuji Matsumoto |
| 2008 | Interspeech | Extracting word-pronunciation pairs from comparable set of text and speech. | Tetsuro Sasada, Shinsuke Mori, Tatsuya Kawahara |
| 2007 | ICASSP | Unsupervised Lexicon Acquisition from Speech and Text. | Gakuto Kurata, Shinsuke Mori, Nobuyasu Itoh, Masafumi Nishimura |
| 2006 | ACL | Phoneme-to-Text Transcription System with an Infinite Vocabulary. | Shinsuke Mori, Daisuke Takuma, Gakuto Kurata |
| 2006 | ICASSP | Unsupervised Adaptation of a Stochastic Language Model Using a Japanese Raw Corpus. | Gakuto Kurata, Shinsuke Mori, Masafumi Nishimura |
| 2006 | Interspeech | Language model adaptation with a word list and a raw corpus. | Shinsuke Mori |
| 2005 | Interspeech | Class-based variable memory length Markov model. | Shinsuke Mori, Gakuto Kurata |
| 2005 | Interspeech | A stochastic approach to phoneme and accent estimation. | Tohru Nagano, Shinsuke Mori, Masafumi Nishimura |
| 2004 | Interspeech | Word n-gram probability estimation from a Japanese raw corpus. | Shinsuke Mori, Daisuke Takuma |
| 2003 | Interspeech | Language model adaptation using word clustering. | Shinsuke Mori, Masafumi Nishimura, Nobuyasu Itoh |
| 2002 | COLING | A Stochastic Parser Based on an SLM with Arboreal Context Trees. | Shinsuke Mori |
| 2002 | Interspeech | An automatic sentence boundary detector based on a structured language model. | Shinsuke Mori |
| 2001 | Interspeech | Improvement of a structured language model: arbori-context tree. | Shinsuke Mori, Masafumi Nishimura, Nobuyasu Itoh |
| 2000 | COLING | A Stochastic Parser Based on a Structural Word Prediction Model. | Shinsuke Mori, Masafumi Nishimura, Nobuyasu Itoh, Shiho Ogino, Hideo Watanabe |
| 2000 | Interspeech | A method for style adaptation to spontaneous speech by using a semi-linear interpolation technique. | Nobuyasu Itoh, Masafumi Nishimura, Shinsuke Mori |
| 1998 | ACL | A Stochastic Language Model using Dependency and Its Improvement by Word Clustering. | Shinsuke Mori, Makoto Nagao |
| 1998 | Interspeech | Word clustering for a word bi-gram model. | Shinsuke Mori, Masafumi Nishimura, Nobuyasu Itoh |
| 1996 | COLING | Word Extraction from Corpora and Its Part-of-Speech Estimation Using Distributional Analysis. | Shinsuke Mori, Makoto Nagao |
| 1994 | COLING | A New Method of N-gram Statistics for Large Number of n and Automatic Extraction of Words and Phrases from Large Text Data of Japanese. | Makoto Nagao, Shinsuke Mori |