| 2026 | ACL | VLURes: Benchmarking Long-Text Grounding and Cross-Lingual Robustness in Vision Language Models. | Jesse Atuhurra, Iqra Ali, Tomoya Iwakura, Hidetaka Kamigaito, Tatsuya Hiraoka |
| 2026 | ACL | Corpus-Dependent Subcharacter Encoding via HMM-Guided Code Assignment. | Tatsuya Hiraoka |
| 2026 | EACL | Sycophancy Hides Linearly in the Attention Heads. | Rifo Ahmad Genadi, Munachiso Nwadike, Nurdaulet Mukhituly, Tatsuya Hiraoka, Hilal AlQuabeh, Kentaro Inui |
| 2025 | ACL | Library-Like Behavior In Language Models is Enhanced by Self-Referencing Causal Cycles. | Munachiso Nwadike, Zangir Iklassov, Toluwani Aremu, Tatsuya Hiraoka, Benjamin Heinzerling, Velibor Bojkovic, Hilal AlQuabeh, Martin Takc, Kentaro Inui |
| 2025 | COLING | SubRegWeigh: Effective and Efficient Annotation Weighing with Subword Regularization. | Kohei Tsuji, Tatsuya Hiraoka, Yuchang Cheng, Tomoya Iwakura |
| 2025 | EMNLP | Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters. | Tatsuya Hiraoka, Kentaro Inui |
| 2025 | EMNLP | Investigating Neurons and Heads in Transformer-based LLMs for Typographical Errors. | Kohei Tsuji, Tatsuya Hiraoka, Yuchang Cheng, Eiji Aramaki, Tomoya Iwakura |
| 2025 | IJCNLP | Understanding and Controlling Repetition Neurons and Induction Heads in In-Context Learning. | Nhi Hoai Doan, Tatsuya Hiraoka, Kentaro Inui |
| 2025 | NAACL | The Geometry of Numerical Reasoning: Language Models Compare Numeric Properties in Linear Subspaces. | Ahmed Oumar El-Shangiti, Tatsuya Hiraoka, Hilal AlQuabeh, Benjamin Heinzerling, Kentaro Inui |
| 2025 | NAACL | Repetition Neurons: How Do Language Models Produce Repetitions? | Tatsuya Hiraoka, Kentaro Inui |
| 2023 | PACLIC | Vocabulary Replacement in SentencePiece for Domain Adaptation. | Teruno Kajiura, Shiho Takano, Tatsuya Hiraoka, Kimio Kuramitsu |
| 2022 | ACL | Word-level Perturbation Considering Word Length and Compositional Subwords. | Tatsuya Hiraoka, Sho Takase, Kei Uchiumi, Atsushi Keyaki, Naoaki Okazaki |
| 2022 | ACL | Single Model Ensemble for Subword Regularized Models in Low-Resource Machine Translation. | Sho Takase, Tatsuya Hiraoka, Naoaki Okazaki |
| 2022 | COLING | MaxMatch-Dropout: Subword Regularization for WordPiece. | Tatsuya Hiraoka |
| 2021 | ACL | Joint Optimization of Tokenization and Downstream Model. | Tatsuya Hiraoka, Sho Takase, Kei Uchiumi, Atsushi Keyaki, Naoaki Okazaki |
| 2020 | EMNLP | Optimizing Word Segmentation for Downstream Task. | Tatsuya Hiraoka, Sho Takase, Kei Uchiumi, Atsushi Keyaki, Naoaki Okazaki |
| 2019 | ACL | Stochastic Tokenization with a Language Model for Neural Text Classification. | Tatsuya Hiraoka, Hiroyuki Shindo, Yuji Matsumoto |