Skip to content

Radu Soricut

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

46

Venues

13

Active years

2002–2024

Best venue rank

A*

Where they publish

Papers

46 indexed papers, newest first.

YearVenueTitleAuthors
2024CVPROn Scaling Up a Multilingual Vision and Language Model.Xi Chen, Josip Djolonga, Piotr Padlewski, Basil Mustafa, Soravit Changpinyo, Jialin Wu, Carlos Riquelme Ruiz, Sebastian Goodman, Xiao Wang, Yi Tay, Siamak Shakeri, Mostafa Dehghani, Daniel Salz, Mario Lucic, Michael Tschannen, Arsha Nagrani, Hexiang Hu, Mandar Joshi, Bo Pang, Ceslee Montgomery, Paulina Pietrzyk, Marvin Ritter, A. J. Piergiovanni, Matthias Minderer, Filip Pavetic, Austin Waters, Gang Li, Ibrahim Alabdulmohsin, Lucas Beyer, Julien Amelot, Kenton Lee, Andreas Peter Steiner, Yang Li, Daniel Keysers, Anurag Arnab, Yuanzhong Xu, Keran Rong, Alexander Kolesnikov, Mojtaba Seyedhosseini, Anelia Angelova, Xiaohua Zhai, Neil Houlsby, Radu Soricut
2024CVPROmni-SMoLA: Boosting Generalist Multimodal Models with Soft Mixture of Low-Rank Experts.Jialin Wu, Xia Hu, Yaqing Wang, Bo Pang, Radu Soricut
2024EMNLPImageInWords: Unlocking Hyper-Detailed Image Descriptions.Roopal Garg, Andrea Burns, Burcu Karagol Ayan, Yonatan Bitton, Ceslee Montgomery, Yasumasa Onoe, Andrew Bunner, Ranjay Krishna, Jason Baldridge, Radu Soricut
2024ICLRCausalLM is not optimal for in-context learning.Nan Ding, Tomer Levinboim, Jialin Wu, Sebastian Goodman, Radu Soricut
2023CoRLRT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control.Brianna Zitkovich, Tianhe Yu, Sichun Xu, Peng Xu, Ted Xiao, Fei Xia, Jialin Wu, Paul Wohlhart, Stefan Welker, Ayzaan Wahid, Quan Vuong, Vincent Vanhoucke, Huong T. Tran, Radu Soricut, Anikait Singh, Jaspiar Singh, Pierre Sermanet, Pannag R. Sanketi, Grecia Salazar, Michael S. Ryoo, Krista Reymann, Kanishka Rao, Karl Pertsch, Igor Mordatch, Henryk Michalewski, Yao Lu, Sergey Levine, Lisa Lee, Tsang-Wei Edward Lee, Isabel Leal, Yuheng Kuang, Dmitry Kalashnikov, Ryan Julian, Nikhil J. Joshi, Alex Irpan, Brian Ichter, Jasmine Hsu, Alexander Herzog, Karol Hausman, Keerthana Gopalakrishnan, Chuyuan Fu, Pete Florence, Chelsea Finn, Kumar Avinava Dubey, Danny Driess, Tianli Ding, Krzysztof Marcin Choromanski, Xi Chen, Yevgen Chebotar, Justice Carbajal, Noah Brown, Anthony Brohan, Montserrat Gonzalez Arenas, Kehang Han
2023CVPRImagen Editor and EditBench: Advancing and Evaluating Text-Guided Image Inpainting.Su Wang, Chitwan Saharia, Ceslee Montgomery, Jordi Pont-Tuset, Shai Noy, Stefano Pellegrini, Yasumasa Onoe, Sarah Laszlo, David J. Fleet, Radu Soricut, Jason Baldridge, Mohammad Norouzi, Peter Anderson, William Chan
2023CVPRConnecting Vision and Language with Video Localized Narratives.Paul Voigtlaender, Soravit Changpinyo, Jordi Pont-Tuset, Radu Soricut, Vittorio Ferrari
2023CVPRImproving Robust Generalization by Direct PAC-Bayesian Bound Minimization.Zifan Wang, Nan Ding, Tomer Levinboim, Xi Chen, Radu Soricut
2023EMNLPMaXM: Towards Multilingual Visual Question Answering.Soravit Changpinyo, Linting Xue, Michal Yarom, Ashish V. Thapliyal, Idan Szpektor, Julien Amelot, Xi Chen, Radu Soricut
2023ICCVPreSTU: Pre-Training for Scene-Text Understanding.Jihyung Kil, Soravit Changpinyo, Xi Chen, Hexiang Hu, Sebastian Goodman, Wei-Lun Chao, Radu Soricut
2022COLINGDenoising Large-Scale Image Captioning from Alt-text Data Using Content Selection Models.Khyathi Raghavi Chandu, Piyush Sharma, Soravit Changpinyo, Ashish V. Thapliyal, Radu Soricut
2022COLINGEnd-to-end Dense Video Captioning as Sequence Generation.Wanrong Zhu, Bo Pang, Ashish V. Thapliyal, William Yang Wang, Radu Soricut
2022ECCVPACTran: PAC-Bayesian Metrics for Estimating the Transferability of Pretrained Models to Classification Tasks.Nan Ding, Xi Chen, Tomer Levinboim, Soravit Changpinyo, Radu Soricut
2022EMNLPCrossmodal-3600: A Massively Multilingual Multimodal Evaluation Dataset.Ashish V. Thapliyal, Jordi Pont-Tuset, Xi Chen, Radu Soricut
2022NAACLAll You May Need for VQA are Image Captions.Soravit Changpinyo, Doron Kukliansky, Idan Szpektor, Xi Chen, Nan Ding, Radu Soricut
2021ACLH-Transformer-1D: Fast One-Dimensional Hierarchical Attention for Sequences.Zhenhai Zhu, Radu Soricut
2021CoNLLUnderstanding Guided Image Captioning Performance across Domains.Edwin G. Ng, Bo Pang, Piyush Sharma, Radu Soricut
2021CVPRConceptual 12M: Pushing Web-Scale Image-Text Pre-Training To Recognize Long-Tail Visual Concepts.Soravit Changpinyo, Piyush Sharma, Nan Ding, Radu Soricut
2021EMNLPCrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA Generalization.Arjun R. Akula, Soravit Changpinyo, Boqing Gong, Piyush Sharma, Song-Chun Zhu, Radu Soricut
2021EMNLPCOSMic: A Coherence-Aware Generation Metric for Image Descriptions.Mert Inan, Piyush Sharma, Baber Khalid, Radu Soricut, Matthew Stone, Malihe Alikhani
2021ICCVTelling the What while Pointing to the Where: Multimodal Queries for Image Retrieval.Soravit Changpinyo, Jordi Pont-Tuset, Vittorio Ferrari, Radu Soricut
2021NAACLQuality Estimation for Image Captions Based on Large-scale Human Evaluations.Tomer Levinboim, Ashish V. Thapliyal, Piyush Sharma, Radu Soricut
2020AAAIReinforcing an Image Caption Generator Using Off-Line Human Feedback.Paul Hongsuck Seo, Piyush Sharma, Tomer Levinboim, Bohyung Han, Radu Soricut
2020ACLCross-modal Coherence Modeling for Caption Generation.Malihe Alikhani, Piyush Sharma, Shengjie Li, Radu Soricut, Matthew Stone
2020ACLCross-modal Language Generation using Pivot Stabilization for Web-scale Language Coverage.Ashish V. Thapliyal, Radu Soricut
2020ECCVConnecting Vision and Language with Localized Narratives.Jordi Pont-Tuset, Jasper R. R. Uijlings, Soravit Changpinyo, Radu Soricut, Vittorio Ferrari
2020EMNLPTeaForN: Teacher-Forcing with N-grams.Sebastian Goodman, Nan Ding, Radu Soricut
2020EMNLPBeyond Instructional Videos: Probing for More Diverse Visual-Textual Grounding on YouTube.Jack Hessel, Zhenhai Zhu, Bo Pang, Radu Soricut
2020ICLRALBERT: A Lite BERT for Self-supervised Learning of Language Representations.Zhenzhong Lan, Mingda Chen, Sebastian Goodman, Kevin Gimpel, Piyush Sharma, Radu Soricut
2020IJCNLPMultimodal Pretraining for Dense Video Captioning.Gabriel Huang, Bo Pang, Zhenhai Zhu, Clara Rivera, Radu Soricut
2019ACLInformative Image Captioning with External Sources of Information.Sanqiang Zhao, Piyush Sharma, Tomer Levinboim, Radu Soricut
2019CoNLLA Case Study on Combining ASR and Visual Features for Generating Instructional Video Captions.Jack Hessel, Bo Pang, Zhenhai Zhu, Radu Soricut
2019EMNLPDecoupled Box Proposal and Featurization with Ultrafine-Grained Semantic Labels Improve Image Captioning and Visual Question Answering.Soravit Changpinyo, Bo Pang, Piyush Sharma, Radu Soricut
2018ACLConceptual Captions: A Cleaned, Hypernymed, Image Alt-text Dataset For Automatic Image Captioning.Piyush Sharma, Nan Ding, Sebastian Goodman, Radu Soricut
2018NAACLSHAPED: Shared-Private Encoder-Decoder for Text Style Adaptation.Ye Zhang, Nan Ding, Radu Soricut
2015NAACLUnsupervised Morphology Induction Using Word Embeddings.Radu Soricut, Franz Josef Och
2010ACLTrustRank: Inducing Trust in Automatic Translations via Ranking.Radu Soricut, Abdessamad Echihabi
2008EMNLPAutomatic Prediction of Parser Accuracy.Sujith Ravi, Kevin Knight, Radu Soricut
2006ACLStochastic Language Generation Using WIDL-Expressions and its Application in Machine Translation and Summarization.Radu Soricut, Daniel Marcu
2006ACLDiscourse Generation Using Utility-Trained Coherence Models.Radu Soricut, Daniel Marcu
2005AAAINatural Language Generation for Text-to-Text Applications Using an Information-Slim Representation.Radu Soricut
2005ACLTowards Developing Generation Algorithms for Text-to-Text Applications.Radu Soricut, Daniel Marcu
2004ACLA Unified Framework For Automatic Evaluation Using 4-Gram Co-occurrence Statistics.Radu Soricut, Eric Brill
2004NAACLAutomatic Question Answering: Beyond the Factoid.Radu Soricut, Eric Brill
2003NAACLSentence Level Discourse Parsing using Syntactic and Lexical Information.Radu Soricut, Daniel Marcu
2002AMTAUsing a Large Monolingual Corpus to Improve Translation Accuracy.Radu Soricut, Kevin Knight, Daniel Marcu