Soravit Changpinyo
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
20
Venues
7
Active years
2016–2024
Best venue rank
A*
Where they publish
Papers
20 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | CVPR | On Scaling Up a Multilingual Vision and Language Model. | Xi Chen, Josip Djolonga, Piotr Padlewski, Basil Mustafa, Soravit Changpinyo, Jialin Wu, Carlos Riquelme Ruiz, Sebastian Goodman, Xiao Wang, Yi Tay, Siamak Shakeri, Mostafa Dehghani, Daniel Salz, Mario Lucic, Michael Tschannen, Arsha Nagrani, Hexiang Hu, Mandar Joshi, Bo Pang, Ceslee Montgomery, Paulina Pietrzyk, Marvin Ritter, A. J. Piergiovanni, Matthias Minderer, Filip Pavetic, Austin Waters, Gang Li, Ibrahim Alabdulmohsin, Lucas Beyer, Julien Amelot, Kenton Lee, Andreas Peter Steiner, Yang Li, Daniel Keysers, Anurag Arnab, Yuanzhong Xu, Keran Rong, Alexander Kolesnikov, Mojtaba Seyedhosseini, Anelia Angelova, Xiaohua Zhai, Neil Houlsby, Radu Soricut |
| 2023 | CVPR | MetaCLUE: Towards Comprehensive Visual Metaphors Research. | Arjun R. Akula, Brendan Driscoll, Pradyumna Narayana, Soravit Changpinyo, Zhiwei Jia, Suyash Damle, Garima Pruthi, Sugato Basu, Leonidas J. Guibas, William T. Freeman, Yuanzhen Li, Varun Jampani |
| 2023 | CVPR | Connecting Vision and Language with Video Localized Narratives. | Paul Voigtlaender, Soravit Changpinyo, Jordi Pont-Tuset, Radu Soricut, Vittorio Ferrari |
| 2023 | EMNLP | MaXM: Towards Multilingual Visual Question Answering. | Soravit Changpinyo, Linting Xue, Michal Yarom, Ashish V. Thapliyal, Idan Szpektor, Julien Amelot, Xi Chen, Radu Soricut |
| 2023 | EMNLP | Can Pre-trained Vision and Language Models Answer Visual Information-Seeking Questions? | Yang Chen, Hexiang Hu, Yi Luan, Haitian Sun, Soravit Changpinyo, Alan Ritter, Ming-Wei Chang |
| 2023 | ICCV | PreSTU: Pre-Training for Scene-Text Understanding. | Jihyung Kil, Soravit Changpinyo, Xi Chen, Hexiang Hu, Sebastian Goodman, Wei-Lun Chao, Radu Soricut |
| 2023 | ICLR | PaLI: A Jointly-Scaled Multilingual Language-Image Model. | Xi Chen, Xiao Wang, Soravit Changpinyo, A. J. Piergiovanni, Piotr Padlewski, Daniel Salz, Sebastian Goodman, Adam Grycner, Basil Mustafa, Lucas Beyer, Alexander Kolesnikov, Joan Puigcerver, Nan Ding, Keran Rong, Hassan Akbari, Gaurav Mishra, Linting Xue, Ashish V. Thapliyal, James Bradbury, Weicheng Kuo |
| 2022 | COLING | Denoising Large-Scale Image Captioning from Alt-text Data Using Content Selection Models. | Khyathi Raghavi Chandu, Piyush Sharma, Soravit Changpinyo, Ashish V. Thapliyal, Radu Soricut |
| 2022 | ECCV | PACTran: PAC-Bayesian Metrics for Estimating the Transferability of Pretrained Models to Classification Tasks. | Nan Ding, Xi Chen, Tomer Levinboim, Soravit Changpinyo, Radu Soricut |
| 2022 | NAACL | All You May Need for VQA are Image Captions. | Soravit Changpinyo, Doron Kukliansky, Idan Szpektor, Xi Chen, Nan Ding, Radu Soricut |
| 2021 | CVPR | Conceptual 12M: Pushing Web-Scale Image-Text Pre-Training To Recognize Long-Tail Visual Concepts. | Soravit Changpinyo, Piyush Sharma, Nan Ding, Radu Soricut |
| 2021 | EMNLP | CrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA Generalization. | Arjun R. Akula, Soravit Changpinyo, Boqing Gong, Piyush Sharma, Song-Chun Zhu, Radu Soricut |
| 2021 | ICCV | Telling the What while Pointing to the Where: Multimodal Queries for Image Retrieval. | Soravit Changpinyo, Jordi Pont-Tuset, Vittorio Ferrari, Radu Soricut |
| 2021 | ICCV | MosaicOS: A Simple and Effective Use of Object-Centric Images for Long-Tailed Object Detection. | Cheng Zhang, Tai-Yu Pan, Yandong Li, Hexiang Hu, Dong Xuan, Soravit Changpinyo, Boqing Gong, Wei-Lun Chao |
| 2020 | ECCV | Connecting Vision and Language with Localized Narratives. | Jordi Pont-Tuset, Jasper R. R. Uijlings, Soravit Changpinyo, Radu Soricut, Vittorio Ferrari |
| 2019 | EMNLP | Decoupled Box Proposal and Featurization with Ultrafine-Grained Semantic Labels Improve Image Captioning and Visual Question Answering. | Soravit Changpinyo, Bo Pang, Piyush Sharma, Radu Soricut |
| 2018 | COLING | Multi-Task Learning for Sequence Tagging: An Empirical Study. | Soravit Changpinyo, Hexiang Hu, Fei Sha |
| 2017 | ICCV | Predicting Visual Exemplars of Unseen Classes for Zero-Shot Learning. | Soravit Changpinyo, Wei-Lun Chao, Fei Sha |
| 2016 | CVPR | Synthesized Classifiers for Zero-Shot Learning. | Soravit Changpinyo, Wei-Lun Chao, Boqing Gong, Fei Sha |
| 2016 | ECCV | An Empirical Study and Analysis of Generalized Zero-Shot Learning for Object Recognition in the Wild. | Wei-Lun Chao, Soravit Changpinyo, Boqing Gong, Fei Sha |