| 2024 | ACCV | Fine-Tuning Large Language Models for Automatic Font Skeleton Generation: Exploration and Analysis. | Yuxuan Liu, Yasuhisa Fujii, Xinru Zhu, Kayoko Nohara |
| 2024 | ICLR | Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding. | Zilong Wang, Hao Zhang, Chun-Liang Li, Julian Martin Eisenschlos, Vincent Perot, Zifeng Wang, Lesly Miculicich, Yasuhisa Fujii, Jingbo Shang, Chen-Yu Lee, Tomas Pfister |
| 2024 | WACV | Hierarchical Text Spotter for Joint Text Spotting and Layout Analysis. | Shangbang Long, Siyang Qin, Yasuhisa Fujii, Alessandro Bissacco, Michalis Raptis |
| 2023 | ACL | Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes. | Cheng-Yu Hsieh, Chun-Liang Li, Chih-Kuan Yeh, Hootan Nakhost, Yasuhisa Fujii, Alex Ratner, Ranjay Krishna, Chen-Yu Lee, Tomas Pfister |
| 2023 | ACL | FormNetV2: Multimodal Graph Contrastive Learning for Form Document Information Extraction. | Chen-Yu Lee, Chun-Liang Li, Hao Zhang, Timothy Dozat, Vincent Perot, Guolong Su, Xiang Zhang, Kihyuk Sohn, Nikolay Glushnev, Renshen Wang, Joshua Ainslie, Shangbang Long, Siyang Qin, Yasuhisa Fujii, Nan Hua, Tomas Pfister |
| 2023 | ICDAR | OCR Language Models with Custom Vocabularies. | Peter Garst, R. Reeve Ingle, Yasuhisa Fujii |
| 2023 | ICDAR | ICDAR 2023 Competition on Hierarchical Text Detection and Recognition. | Shangbang Long, Siyang Qin, Dmitry Panteleev, Alessandro Bissacco, Yasuhisa Fujii, Michalis Raptis |
| 2023 | ICDAR | Text Reading Order in Uncontrolled Conditions by Sparse Graph Segmentation. | Renshen Wang, Yasuhisa Fujii, Alessandro Bissacco |
| 2022 | ACL | FormNet: Structural Encoding beyond Sequential Modeling in Form Document Information Extraction. | Chen-Yu Lee, Chun-Liang Li, Timothy Dozat, Vincent Perot, Guolong Su, Nan Hua, Joshua Ainslie, Renshen Wang, Yasuhisa Fujii, Tomas Pfister |
| 2022 | CVPR | Towards End-to-End Unified Scene Text Detection and Layout Analysis. | Shangbang Long, Siyang Qin, Dmitry Panteleev, Alessandro Bissacco, Yasuhisa Fujii, Michalis Raptis |
| 2022 | DAS | Unified Line and Paragraph Detection by Graph Convolutional Networks. | Shuang Liu, Renshen Wang, Michalis Raptis, Yasuhisa Fujii |
| 2022 | WACV | Post-OCR Paragraph Recognition by Graph Convolutional Networks. | Renshen Wang, Yasuhisa Fujii, Ashok C. Popat |
| 2021 | ACL | ROPE: Reading Order Equivariant Positional Encoding for Graph-based Document Information Extraction. | Chen-Yu Lee, Chun-Liang Li, Chu Wang, Renshen Wang, Yasuhisa Fujii, Siyang Qin, Ashok C. Popat, Tomas Pfister |
| 2019 | ICCV | Towards Unconstrained End-to-End Text Spotting. | Siyang Qin, Alessandro Bissacco, Michalis Raptis, Yasuhisa Fujii, Ying Xiao |
| 2019 | ICDAR | A Scalable Handwritten Text Recognition System. | R. Reeve Ingle, Yasuhisa Fujii, Thomas Deselaers, Jonathan Baccash, Ashok C. Popat |
| 2017 | ICDAR | Sequence-to-Label Script Identification for Multilingual OCR. | Yasuhisa Fujii, Karel Driesen, Jonathan Baccash, Ash Hurst, Ashok C. Popat |
| 2015 | ICDAR | Label transition and selection pruning and automatic decoding parameter optimization for time-synchronous Viterbi decoding. | Yasuhisa Fujii, Dmitriy Genzel, Ashok C. Popat, Remco Teunen |
| 2015 | ICDAR | Publication Date Estimation for Printed Historical Documents using Convolutional Neural Networks. | Yuanpeng Li, Dmitriy Genzel, Yasuhisa Fujii, Ashok C. Popat |
| 2013 | ICDAR | HMM-based script identification for OCR. | Dmitriy Genzel, Ashok C. Popat, Remco Teunen, Yasuhisa Fujii |
| 2011 | ICASSP | Automatic speech recognition using Hidden Conditional Neural Fields. | Yasuhisa Fujii, Kazumasa Yamamoto, Seiichi Nakagawa |
| 2011 | ICASSP | Efficient out-of-vocabulary term detection by n-gram array indices with distance from a syllable lattice. | Keisuke Iwami, Yasuhisa Fujii, Kazumasa Yamamoto, Seiichi Nakagawa |
| 2011 | Interspeech | Hidden Boosted MMI and Hierarchical State Posterior Feature for Automatic Speech Recognition Based on Hidden Conditional Neural Fields. | Yasuhisa Fujii, Kazumasa Yamamoto, Seiichi Nakagawa |
| 2010 | Interspeech | Improving the readability of class lecture ASR results using a confusion network. | Yasuhisa Fujii, Kazumasa Yamamoto, Seiichi Nakagawa |
| 2008 | Interspeech | Class lecture summarization taking into account consecutiveness of important sentences. | Yasuhisa Fujii, Kazumasa Yamamoto, Norihide Kitaoka, Seiichi Nakagawa |
| 2007 | Interspeech | Automatic extraction of cue phrases for important sentences in lecture speech and automatic lecture speech summarization. | Yasuhisa Fujii, Norihide Kitaoka, Seiichi Nakagawa |