Ronghang Hu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
6
Active years
2014–2025
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICLR | SAM 2: Segment Anything in Images and Videos. | Nikhila Ravi, Valentin Gabeur, Yuan-Ting Hu, Ronghang Hu, Chaitanya Ryali, Tengyu Ma, Haitham Khedr, Roman Rdle, Chlo Rolland, Laura Gustafson, Eric Mintun, Junting Pan, Kalyan Vasudev Alwala, Nicolas Carion, Chao-Yuan Wu, Ross B. Girshick, Piotr Dollr, Christoph Feichtenhofer |
| 2023 | CVPR | Scaling Language-Image Pre-Training via Masking. | Yanghao Li, Haoqi Fan, Ronghang Hu, Christoph Feichtenhofer, Kaiming He |
| 2023 | CVPR | ConvNeXt V2: Co-designing and Scaling ConvNets with Masked Autoencoders. | Sanghyun Woo, Shoubhik Debnath, Ronghang Hu, Xinlei Chen, Zhuang Liu, In So Kweon, Saining Xie |
| 2023 | ICCV | UniT3D: A Unified Transformer for 3D Dense Captioning and Visual Grounding. | Dave Zhenyu Chen, Ronghang Hu, Xinlei Chen, Matthias Niener, Angel X. Chang |
| 2022 | CVPR | FLAVA: A Foundational Language And Vision Alignment Model. | Amanpreet Singh, Ronghang Hu, Vedanuj Goswami, Guillaume Couairon, Wojciech Galuba, Marcus Rohrbach, Douwe Kiela |
| 2021 | ICCV | Worldsheet: Wrapping the World in a 3D Sheet for View Synthesis from a Single Image. | Ronghang Hu, Nikhila Ravi, Alexander C. Berg, Deepak Pathak |
| 2021 | ICCV | UniT: Multimodal Multitask Learning with a Unified Transformer. | Ronghang Hu, Amanpreet Singh |
| 2020 | CVPR | Iterative Answer Prediction With Pointer-Augmented Multimodal Transformers for TextVQA. | Ronghang Hu, Amanpreet Singh, Trevor Darrell, Marcus Rohrbach |
| 2020 | ECCV | TextCaps: A Dataset for Image Captioning with Reading Comprehension. | Oleksii Sidorov, Ronghang Hu, Marcus Rohrbach, Amanpreet Singh |
| 2019 | ACL | Are You Looking? Grounding to Multiple Modalities in Vision-and-Language Navigation. | Ronghang Hu, Daniel Fried, Anna Rohrbach, Dan Klein, Trevor Darrell, Kate Saenko |
| 2019 | ICCV | Language-Conditioned Graph Networks for Relational Reasoning. | Ronghang Hu, Anna Rohrbach, Trevor Darrell, Kate Saenko |
| 2018 | CVPR | Learning to Segment Every Thing. | Ronghang Hu, Piotr Dollr, Kaiming He, Trevor Darrell, Ross B. Girshick |
| 2018 | ECCV | Grounding Visual Explanations. | Lisa Anne Hendricks, Ronghang Hu, Trevor Darrell, Zeynep Akata |
| 2018 | ECCV | Explainable Neural Computation via Stack Neural Module Networks. | Ronghang Hu, Jacob Andreas, Trevor Darrell, Kate Saenko |
| 2017 | CVPR | Modeling Relationships in Referential Expressions with Compositional Modular Networks. | Ronghang Hu, Marcus Rohrbach, Jacob Andreas, Trevor Darrell, Kate Saenko |
| 2017 | ICCV | Learning to Reason: End-to-End Module Networks for Visual Question Answering. | Ronghang Hu, Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Kate Saenko |
| 2016 | CVPR | Natural Language Object Retrieval. | Ronghang Hu, Huazhe Xu, Marcus Rohrbach, Jiashi Feng, Kate Saenko, Trevor Darrell |
| 2016 | ECCV | Segmentation from Natural Language Expressions. | Ronghang Hu, Marcus Rohrbach, Trevor Darrell |
| 2016 | ECCV | Grounding of Textual Phrases in Images by Reconstruction. | Anna Rohrbach, Marcus Rohrbach, Ronghang Hu, Trevor Darrell, Bernt Schiele |
| 2015 | ICCV | Spatial Semantic Regularisation for Large Scale Object Detection. | Damian Mrowca, Marcus Rohrbach, Judy Hoffman, Ronghang Hu, Kate Saenko, Trevor Darrell |
| 2014 | ICPR | Robust Head-Shoulder Detection Using a Two-Stage Cascade Framework. | Ronghang Hu, Ruiping Wang, Shiguang Shan, Xilin Chen |