| 2026 | ACL | Clustered Self-Assessment: A Simple yet Effective Method for Uncertainty Quantification in Large Language Models. | Qi Cao, Takeshi Kojima, Andrew Gambardella, Helinyi Peng, Yutaka Matsuo, Yusuke Iwasawa |
| 2026 | EACL | Semantic Token Clustering for Efficient Uncertainty Quantification in Large Language Models. | Qi Cao, Andrew Gambardella, Takeshi Kojima, Yutaka Matsuo, Yusuke Iwasawa |
| 2025 | ACL | Inconsistent Tokenizations Cause Language Models to be Perplexed by Japanese Grammar. | Andrew Gambardella, Takeshi Kojima, Yusuke Iwasawa, Yutaka Matsuo |
| 2025 | ACL | Answer When Needed, Forget When Not: Language Models Pretend to Forget via In-Context Knowledge Unlearning. | Shota Takashiro, Takeshi Kojima, Andrew Gambardella, Qi Cao, Yusuke Iwasawa, Yutaka Matsuo |
| 2025 | IJCNLP | Crypto-LLM: Two-Stage Language Model Pre-training with Ciphered and Natural Language Data. | Yohei Kobashi, Fumiya Uchiyama, Takeshi Kojima, Andrew Gambardella, Qi Cao, Yusuke Iwasawa, Yutaka Matsuo |
| 2024 | ACL | Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic Tasks. | Andrew Gambardella, Yusuke Iwasawa, Yutaka Matsuo |
| 2024 | EMNLP | Which Programming Language and What Features at Pre-training Stage Affect Downstream Logical Inference Performance? | Fumiya Uchiyama, Takeshi Kojima, Andrew Gambardella, Qi Cao, Yusuke Iwasawa, Yutaka Matsuo |
| 2020 | UAI | Multitask Soft Option Learning. | Maximilian Igl, Andrew Gambardella, Jinke He, Nantas Nardelli, N. Siddharth, Wendelin Boehmer, Shimon Whiteson |