| 2026 | CHI | DiverXplorer: Stock Image Exploration via Diversity Adjustment for Graphic Design. | Antonio Tejero-de-Pablos, Sichao Song, Naoto Ohsaka, Mayu Otani, Shin'ichi Satoh |
| 2026 | WACV | Robust Multimodal Emotion Recognition from Incomplete Modalities via Query-Based Unimodal and Cross-Modal Learning. | Ryo Miyoshi, Mayu Otani, Yuki Okafuji |
| 2024 | CVPR | Would Deep Generative Models Amplify Bias in Future Models? | Tianwei Chen, Yusuke Hirota, Mayu Otani, Noa Garcia, Yuta Nakashima |
| 2024 | ECCV | LayoutFlow: Flow Matching for Layout Generation. | Julian Jorge Andrade Guerreiro, Naoto Inoue, Kento Masui, Mayu Otani, Hideki Nakayama |
| 2024 | ECCV | Robust Nearest Neighbors for Source-Free Domain Adaptation Under Class Distribution Shift. | Antonio Tejero-de-Pablos, Riku Togashi, Mayu Otani, Shin'ichi Satoh |
| 2024 | WACV | Revisiting Pixel-Level Contrastive Pre-Training on Scene Images. | Zongshang Pang, Yuta Nakashima, Mayu Otani, Hajime Nagahara |
| 2023 | CVPR | LayoutDM: Discrete Diffusion Model for Controllable Layout Generation. | Naoto Inoue, Kotaro Kikuchi, Edgar Simo-Serra, Mayu Otani, Kota Yamaguchi |
| 2023 | CVPR | Towards Flexible Multi-modal Document Models. | Naoto Inoue, Kotaro Kikuchi, Edgar Simo-Serra, Mayu Otani, Kota Yamaguchi |
| 2023 | CVPR | Toward Verifiable and Reproducible Human Evaluation for Text-to-Image Generation. | Mayu Otani, Riku Togashi, Yu Sawai, Ryosuke Ishigami, Yuta Nakashima, Esa Rahtu, Janne Heikkil, Shin'ichi Satoh |
| 2023 | IUI | Coarse-to-fine font recommendation for banner designs. | Daichi Haraguchi, Mayu Otani |
| 2023 | WACV | Generative Colorization of Structured Mobile Web Pages. | Kotaro Kikuchi, Naoto Inoue, Mayu Otani, Edgar Simo-Serra, Kota Yamaguchi |
| 2023 | WACV | Contrastive Losses Are Natural Criteria for Unsupervised Video Summarization. | Zongshang Pang, Yuta Nakashima, Mayu Otani, Hajime Nagahara |
| 2023 | WACV | Color Recommendation for Vector Graphic Documents based on Multi-Palette Representation. | Qianru Qiu, Xueting Wang, Mayu Otani, Yuki Iwazaki |
| 2022 | CVPR | Optimal Correction Cost for Object Detection Evaluation. | Mayu Otani, Riku Togashi, Yuta Nakashima, Esa Rahtu, Janne Heikkil, Shin'ichi Satoh |
| 2022 | CVPR | AxIoU: An Axiomatically Justified Measure for Video Moment Retrieval. | Riku Togashi, Mayu Otani, Yuta Nakashima, Esa Rahtu, Janne Heikkil, Tetsuya Sakai |
| 2022 | CVPR | Does Robustness on ImageNet Transfer to Downstream Tasks? | Yutaro Yamada, Mayu Otani |
| 2022 | IUI | An Intelligent Color Recommendation Tool for Landing Page Design. | Qianru Qiu, Mayu Otani, Yuki Iwazaki |
| 2021 | ACL | Attending Self-Attention: A Case Study of Visually Grounded Supervision in Vision-and-Language Transformers. | Jules Samaran, Noa Garcia, Mayu Otani, Chenhui Chu, Yuta Nakashima |
| 2021 | BMVC | Transferring Domain-Agnostic Knowledge in Video Question Answering. | Tianran Wu, Noa Garcia, Mayu Otani, Chenhui Chu, Yuta Nakashima, Haruo Takemura |
| 2021 | WWW | Density-Ratio Based Personalised Ranking from Implicit Feedback. | Riku Togashi, Masahiro Kato, Mayu Otani, Shin'ichi Satoh |
| 2021 | SIGIR | Scalable Personalised Item Ranking through Parametric Density Estimation. | Riku Togashi, Masahiro Kato, Mayu Otani, Tetsuya Sakai, Shin'ichi Satoh |
| 2021 | WACV | The Laughing Machine: Predicting Humor in Video. | Yuta Kayatani, Zekun Yang, Mayu Otani, Noa Garcia, Chenhui Chu, Yuta Nakashima, Haruo Takemura |
| 2021 | WSDM | Alleviating Cold-Start Problems in Recommendation through Pseudo-Labelling over Knowledge Graph. | Riku Togashi, Mayu Otani, Shin'ichi Satoh |
| 2020 | AAAI | KnowIT VQA: Answering Knowledge-Based Questions about Videos. | Noa Garcia, Mayu Otani, Chenhui Chu, Yuta Nakashima |
| 2020 | BMVC | Uncovering Hidden Challenges in Query-Based Video Moment Retrieval. | Mayu Otani, Yuta Nakashima, Esa Rahtu, Janne Heikkil |
| 2020 | ECCV | A Dataset and Baselines for Visual Question Answering on Art. | Noa Garcia, Chentao Ye, Zihua Liu, Qingtao Hu, Mayu Otani, Chenhui Chu, Yuta Nakashima, Teruko Mitamura |
| 2020 | WACV | BERT Representations for Video Question Answering. | Zekun Yang, Noa Garcia, Chenhui Chu, Mayu Otani, Yuta Nakashima, Haruo Takemura |
| 2019 | CVPR | Rethinking the Evaluation of Video Summaries. | Mayu Otani, Yuta Nakashima, Esa Rahtu, Janne Heikkil |
| 2018 | COLING | iParaphrasing: Extracting Visually Grounded Paraphrases via an Image. | Chenhui Chu, Mayu Otani, Yuta Nakashima |
| 2016 | ACCV | Video Summarization Using Deep Semantic Features. | Mayu Otani, Yuta Nakashima, Esa Rahtu, Janne Heikkil, Naokazu Yokoya |
| 2016 | ECCV | Learning Joint Representations of Videos and Sentences with Web Image Search. | Mayu Otani, Yuta Nakashima, Esa Rahtu, Janne Heikkil, Naokazu Yokoya |