Radu Soricut
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
46
Venues
13
Active years
2002–2024
Best venue rank
A*
Where they publish
Papers
46 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | CVPR | On Scaling Up a Multilingual Vision and Language Model. | Xi Chen, Josip Djolonga, Piotr Padlewski, Basil Mustafa, Soravit Changpinyo, Jialin Wu, Carlos Riquelme Ruiz, Sebastian Goodman, Xiao Wang, Yi Tay, Siamak Shakeri, Mostafa Dehghani, Daniel Salz, Mario Lucic, Michael Tschannen, Arsha Nagrani, Hexiang Hu, Mandar Joshi, Bo Pang, Ceslee Montgomery, Paulina Pietrzyk, Marvin Ritter, A. J. Piergiovanni, Matthias Minderer, Filip Pavetic, Austin Waters, Gang Li, Ibrahim Alabdulmohsin, Lucas Beyer, Julien Amelot, Kenton Lee, Andreas Peter Steiner, Yang Li, Daniel Keysers, Anurag Arnab, Yuanzhong Xu, Keran Rong, Alexander Kolesnikov, Mojtaba Seyedhosseini, Anelia Angelova, Xiaohua Zhai, Neil Houlsby, Radu Soricut |
| 2024 | CVPR | Omni-SMoLA: Boosting Generalist Multimodal Models with Soft Mixture of Low-Rank Experts. | Jialin Wu, Xia Hu, Yaqing Wang, Bo Pang, Radu Soricut |
| 2024 | EMNLP | ImageInWords: Unlocking Hyper-Detailed Image Descriptions. | Roopal Garg, Andrea Burns, Burcu Karagol Ayan, Yonatan Bitton, Ceslee Montgomery, Yasumasa Onoe, Andrew Bunner, Ranjay Krishna, Jason Baldridge, Radu Soricut |
| 2024 | ICLR | CausalLM is not optimal for in-context learning. | Nan Ding, Tomer Levinboim, Jialin Wu, Sebastian Goodman, Radu Soricut |
| 2023 | CoRL | RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control. | Brianna Zitkovich, Tianhe Yu, Sichun Xu, Peng Xu, Ted Xiao, Fei Xia, Jialin Wu, Paul Wohlhart, Stefan Welker, Ayzaan Wahid, Quan Vuong, Vincent Vanhoucke, Huong T. Tran, Radu Soricut, Anikait Singh, Jaspiar Singh, Pierre Sermanet, Pannag R. Sanketi, Grecia Salazar, Michael S. Ryoo, Krista Reymann, Kanishka Rao, Karl Pertsch, Igor Mordatch, Henryk Michalewski, Yao Lu, Sergey Levine, Lisa Lee, Tsang-Wei Edward Lee, Isabel Leal, Yuheng Kuang, Dmitry Kalashnikov, Ryan Julian, Nikhil J. Joshi, Alex Irpan, Brian Ichter, Jasmine Hsu, Alexander Herzog, Karol Hausman, Keerthana Gopalakrishnan, Chuyuan Fu, Pete Florence, Chelsea Finn, Kumar Avinava Dubey, Danny Driess, Tianli Ding, Krzysztof Marcin Choromanski, Xi Chen, Yevgen Chebotar, Justice Carbajal, Noah Brown, Anthony Brohan, Montserrat Gonzalez Arenas, Kehang Han |
| 2023 | CVPR | Imagen Editor and EditBench: Advancing and Evaluating Text-Guided Image Inpainting. | Su Wang, Chitwan Saharia, Ceslee Montgomery, Jordi Pont-Tuset, Shai Noy, Stefano Pellegrini, Yasumasa Onoe, Sarah Laszlo, David J. Fleet, Radu Soricut, Jason Baldridge, Mohammad Norouzi, Peter Anderson, William Chan |
| 2023 | CVPR | Connecting Vision and Language with Video Localized Narratives. | Paul Voigtlaender, Soravit Changpinyo, Jordi Pont-Tuset, Radu Soricut, Vittorio Ferrari |
| 2023 | CVPR | Improving Robust Generalization by Direct PAC-Bayesian Bound Minimization. | Zifan Wang, Nan Ding, Tomer Levinboim, Xi Chen, Radu Soricut |
| 2023 | EMNLP | MaXM: Towards Multilingual Visual Question Answering. | Soravit Changpinyo, Linting Xue, Michal Yarom, Ashish V. Thapliyal, Idan Szpektor, Julien Amelot, Xi Chen, Radu Soricut |
| 2023 | ICCV | PreSTU: Pre-Training for Scene-Text Understanding. | Jihyung Kil, Soravit Changpinyo, Xi Chen, Hexiang Hu, Sebastian Goodman, Wei-Lun Chao, Radu Soricut |
| 2022 | COLING | Denoising Large-Scale Image Captioning from Alt-text Data Using Content Selection Models. | Khyathi Raghavi Chandu, Piyush Sharma, Soravit Changpinyo, Ashish V. Thapliyal, Radu Soricut |
| 2022 | COLING | End-to-end Dense Video Captioning as Sequence Generation. | Wanrong Zhu, Bo Pang, Ashish V. Thapliyal, William Yang Wang, Radu Soricut |
| 2022 | ECCV | PACTran: PAC-Bayesian Metrics for Estimating the Transferability of Pretrained Models to Classification Tasks. | Nan Ding, Xi Chen, Tomer Levinboim, Soravit Changpinyo, Radu Soricut |
| 2022 | EMNLP | Crossmodal-3600: A Massively Multilingual Multimodal Evaluation Dataset. | Ashish V. Thapliyal, Jordi Pont-Tuset, Xi Chen, Radu Soricut |
| 2022 | NAACL | All You May Need for VQA are Image Captions. | Soravit Changpinyo, Doron Kukliansky, Idan Szpektor, Xi Chen, Nan Ding, Radu Soricut |
| 2021 | ACL | H-Transformer-1D: Fast One-Dimensional Hierarchical Attention for Sequences. | Zhenhai Zhu, Radu Soricut |
| 2021 | CoNLL | Understanding Guided Image Captioning Performance across Domains. | Edwin G. Ng, Bo Pang, Piyush Sharma, Radu Soricut |
| 2021 | CVPR | Conceptual 12M: Pushing Web-Scale Image-Text Pre-Training To Recognize Long-Tail Visual Concepts. | Soravit Changpinyo, Piyush Sharma, Nan Ding, Radu Soricut |
| 2021 | EMNLP | CrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA Generalization. | Arjun R. Akula, Soravit Changpinyo, Boqing Gong, Piyush Sharma, Song-Chun Zhu, Radu Soricut |
| 2021 | EMNLP | COSMic: A Coherence-Aware Generation Metric for Image Descriptions. | Mert Inan, Piyush Sharma, Baber Khalid, Radu Soricut, Matthew Stone, Malihe Alikhani |
| 2021 | ICCV | Telling the What while Pointing to the Where: Multimodal Queries for Image Retrieval. | Soravit Changpinyo, Jordi Pont-Tuset, Vittorio Ferrari, Radu Soricut |
| 2021 | NAACL | Quality Estimation for Image Captions Based on Large-scale Human Evaluations. | Tomer Levinboim, Ashish V. Thapliyal, Piyush Sharma, Radu Soricut |
| 2020 | AAAI | Reinforcing an Image Caption Generator Using Off-Line Human Feedback. | Paul Hongsuck Seo, Piyush Sharma, Tomer Levinboim, Bohyung Han, Radu Soricut |
| 2020 | ACL | Cross-modal Coherence Modeling for Caption Generation. | Malihe Alikhani, Piyush Sharma, Shengjie Li, Radu Soricut, Matthew Stone |
| 2020 | ACL | Cross-modal Language Generation using Pivot Stabilization for Web-scale Language Coverage. | Ashish V. Thapliyal, Radu Soricut |
| 2020 | ECCV | Connecting Vision and Language with Localized Narratives. | Jordi Pont-Tuset, Jasper R. R. Uijlings, Soravit Changpinyo, Radu Soricut, Vittorio Ferrari |
| 2020 | EMNLP | TeaForN: Teacher-Forcing with N-grams. | Sebastian Goodman, Nan Ding, Radu Soricut |
| 2020 | EMNLP | Beyond Instructional Videos: Probing for More Diverse Visual-Textual Grounding on YouTube. | Jack Hessel, Zhenhai Zhu, Bo Pang, Radu Soricut |
| 2020 | ICLR | ALBERT: A Lite BERT for Self-supervised Learning of Language Representations. | Zhenzhong Lan, Mingda Chen, Sebastian Goodman, Kevin Gimpel, Piyush Sharma, Radu Soricut |
| 2020 | IJCNLP | Multimodal Pretraining for Dense Video Captioning. | Gabriel Huang, Bo Pang, Zhenhai Zhu, Clara Rivera, Radu Soricut |
| 2019 | ACL | Informative Image Captioning with External Sources of Information. | Sanqiang Zhao, Piyush Sharma, Tomer Levinboim, Radu Soricut |
| 2019 | CoNLL | A Case Study on Combining ASR and Visual Features for Generating Instructional Video Captions. | Jack Hessel, Bo Pang, Zhenhai Zhu, Radu Soricut |
| 2019 | EMNLP | Decoupled Box Proposal and Featurization with Ultrafine-Grained Semantic Labels Improve Image Captioning and Visual Question Answering. | Soravit Changpinyo, Bo Pang, Piyush Sharma, Radu Soricut |
| 2018 | ACL | Conceptual Captions: A Cleaned, Hypernymed, Image Alt-text Dataset For Automatic Image Captioning. | Piyush Sharma, Nan Ding, Sebastian Goodman, Radu Soricut |
| 2018 | NAACL | SHAPED: Shared-Private Encoder-Decoder for Text Style Adaptation. | Ye Zhang, Nan Ding, Radu Soricut |
| 2015 | NAACL | Unsupervised Morphology Induction Using Word Embeddings. | Radu Soricut, Franz Josef Och |
| 2010 | ACL | TrustRank: Inducing Trust in Automatic Translations via Ranking. | Radu Soricut, Abdessamad Echihabi |
| 2008 | EMNLP | Automatic Prediction of Parser Accuracy. | Sujith Ravi, Kevin Knight, Radu Soricut |
| 2006 | ACL | Stochastic Language Generation Using WIDL-Expressions and its Application in Machine Translation and Summarization. | Radu Soricut, Daniel Marcu |
| 2006 | ACL | Discourse Generation Using Utility-Trained Coherence Models. | Radu Soricut, Daniel Marcu |
| 2005 | AAAI | Natural Language Generation for Text-to-Text Applications Using an Information-Slim Representation. | Radu Soricut |
| 2005 | ACL | Towards Developing Generation Algorithms for Text-to-Text Applications. | Radu Soricut, Daniel Marcu |
| 2004 | ACL | A Unified Framework For Automatic Evaluation Using 4-Gram Co-occurrence Statistics. | Radu Soricut, Eric Brill |
| 2004 | NAACL | Automatic Question Answering: Beyond the Factoid. | Radu Soricut, Eric Brill |
| 2003 | NAACL | Sentence Level Discourse Parsing using Syntactic and Lexical Information. | Radu Soricut, Daniel Marcu |
| 2002 | AMTA | Using a Large Monolingual Corpus to Improve Translation Accuracy. | Radu Soricut, Kevin Knight, Daniel Marcu |