Skip to content

Ronghang Hu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

6

Active years

2014–2025

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRSAM 2: Segment Anything in Images and Videos.Nikhila Ravi, Valentin Gabeur, Yuan-Ting Hu, Ronghang Hu, Chaitanya Ryali, Tengyu Ma, Haitham Khedr, Roman Rdle, Chlo Rolland, Laura Gustafson, Eric Mintun, Junting Pan, Kalyan Vasudev Alwala, Nicolas Carion, Chao-Yuan Wu, Ross B. Girshick, Piotr Dollr, Christoph Feichtenhofer
2023CVPRScaling Language-Image Pre-Training via Masking.Yanghao Li, Haoqi Fan, Ronghang Hu, Christoph Feichtenhofer, Kaiming He
2023CVPRConvNeXt V2: Co-designing and Scaling ConvNets with Masked Autoencoders.Sanghyun Woo, Shoubhik Debnath, Ronghang Hu, Xinlei Chen, Zhuang Liu, In So Kweon, Saining Xie
2023ICCVUniT3D: A Unified Transformer for 3D Dense Captioning and Visual Grounding.Dave Zhenyu Chen, Ronghang Hu, Xinlei Chen, Matthias Niener, Angel X. Chang
2022CVPRFLAVA: A Foundational Language And Vision Alignment Model.Amanpreet Singh, Ronghang Hu, Vedanuj Goswami, Guillaume Couairon, Wojciech Galuba, Marcus Rohrbach, Douwe Kiela
2021ICCVWorldsheet: Wrapping the World in a 3D Sheet for View Synthesis from a Single Image.Ronghang Hu, Nikhila Ravi, Alexander C. Berg, Deepak Pathak
2021ICCVUniT: Multimodal Multitask Learning with a Unified Transformer.Ronghang Hu, Amanpreet Singh
2020CVPRIterative Answer Prediction With Pointer-Augmented Multimodal Transformers for TextVQA.Ronghang Hu, Amanpreet Singh, Trevor Darrell, Marcus Rohrbach
2020ECCVTextCaps: A Dataset for Image Captioning with Reading Comprehension.Oleksii Sidorov, Ronghang Hu, Marcus Rohrbach, Amanpreet Singh
2019ACLAre You Looking? Grounding to Multiple Modalities in Vision-and-Language Navigation.Ronghang Hu, Daniel Fried, Anna Rohrbach, Dan Klein, Trevor Darrell, Kate Saenko
2019ICCVLanguage-Conditioned Graph Networks for Relational Reasoning.Ronghang Hu, Anna Rohrbach, Trevor Darrell, Kate Saenko
2018CVPRLearning to Segment Every Thing.Ronghang Hu, Piotr Dollr, Kaiming He, Trevor Darrell, Ross B. Girshick
2018ECCVGrounding Visual Explanations.Lisa Anne Hendricks, Ronghang Hu, Trevor Darrell, Zeynep Akata
2018ECCVExplainable Neural Computation via Stack Neural Module Networks.Ronghang Hu, Jacob Andreas, Trevor Darrell, Kate Saenko
2017CVPRModeling Relationships in Referential Expressions with Compositional Modular Networks.Ronghang Hu, Marcus Rohrbach, Jacob Andreas, Trevor Darrell, Kate Saenko
2017ICCVLearning to Reason: End-to-End Module Networks for Visual Question Answering.Ronghang Hu, Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Kate Saenko
2016CVPRNatural Language Object Retrieval.Ronghang Hu, Huazhe Xu, Marcus Rohrbach, Jiashi Feng, Kate Saenko, Trevor Darrell
2016ECCVSegmentation from Natural Language Expressions.Ronghang Hu, Marcus Rohrbach, Trevor Darrell
2016ECCVGrounding of Textual Phrases in Images by Reconstruction.Anna Rohrbach, Marcus Rohrbach, Ronghang Hu, Trevor Darrell, Bernt Schiele
2015ICCVSpatial Semantic Regularisation for Large Scale Object Detection.Damian Mrowca, Marcus Rohrbach, Judy Hoffman, Ronghang Hu, Kate Saenko, Trevor Darrell
2014ICPRRobust Head-Shoulder Detection Using a Two-Stage Cascade Framework.Ronghang Hu, Ruiping Wang, Shiguang Shan, Xilin Chen