Skip to content

Marcus Rohrbach

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

73

Venues

12

Active years

2010–2026

Best venue rank

A*

Where they publish

Papers

73 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLVeriTaS: The First Dynamic Benchmark for Multimodal Automated Fact-Checking.Mark Rothermel, Marcus Kornmann, Marcus Rohrbach, Anna Rohrbach
2025ACLPredicting Implicit Arguments in Procedural Video Instructions.Anil Batra, Laura Sevilla-Lara, Marcus Rohrbach, Frank Keller
2025CVPRV^2Dial: Unification of Video and Visual Dialog via Multimodal Experts.Adnen Abdessaied, Anna Rohrbach, Marcus Rohrbach, Andreas Bulling
2025ICCVChrono: A Simple Blueprint for Representing Time in MLLMs.Boris Meinardus, Hector G. Rodriguez, Anil Batra, Anna Rohrbach, Marcus Rohrbach
2025ICMLDEFAME: Dynamic Evidence-based FAct-checking with Multimodal Experts.Tobias Braun, Mark Rothermel, Marcus Rohrbach, Anna Rohrbach
2024ECCVEfficient Pre-training for Localized Instruction Generation of Procedural Videos.Anil Batra, Davide Moltisanti, Laura Sevilla-Lara, Marcus Rohrbach, Frank Keller
2024WACVSimple Token-Level Confidence Improves Caption Correctness.Suzanne Petryk, Spencer Whitehead, Joseph E. Gonzalez, Trevor Darrell, Anna Rohrbach, Marcus Rohrbach
2023CVPRImproving Selective Visual Question Answering by Learning from Your Peers.Corentin Dancette, Spencer Whitehead, Rishabh Maheshwary, Ramakrishna Vedantam, Stefan Scherer, Xinlei Chen, Matthieu Cord, Marcus Rohrbach
2022CVPRLearning To Recognize Procedural Activities with Distant Supervision.Xudong Lin, Fabio Petroni, Gedas Bertasius, Marcus Rohrbach, Shih-Fu Chang, Lorenzo Torresani
2022CVPRFLAVA: A Foundational Language And Vision Alignment Model.Amanpreet Singh, Ronghang Hu, Vedanuj Goswami, Guillaume Couairon, Wojciech Galuba, Marcus Rohrbach, Douwe Kiela
2022ECCVLearn2Augment: Learning to Composite Videos for Data Augmentation in Action Recognition.Shreyank N. Gowda, Marcus Rohrbach, Frank Keller, Laura Sevilla-Lara
2022ECCVCLASTER: Clustering with Reinforcement Learning for Zero-Shot Action Recognition.Shreyank N. Gowda, Laura Sevilla-Lara, Frank Keller, Marcus Rohrbach
2022ECCVReliable Visual Question Answering: Abstain Rather Than Answer Incorrectly.Spencer Whitehead, Suzanne Petryk, Vedaad Shakib, Joseph Gonzalez, Trevor Darrell, Anna Rohrbach, Marcus Rohrbach
2021AAAISMART Frame Selection for Action Recognition.Shreyank N. Gowda, Marcus Rohrbach, Laura Sevilla-Lara
2021CVPRKRISP: Integrating Implicit and Symbolic Knowledge for Open-Domain Knowledge-Based VQA.Kenneth Marino, Xinlei Chen, Devi Parikh, Abhinav Gupta, Marcus Rohrbach
2021ICLRRemembering for the Right Reasons: Explanations Reduce Catastrophic Forgetting.Sayna Ebrahimi, Suzanne Petryk, Akash Gokul, William Gan, Joseph E. Gonzalez, Marcus Rohrbach, Trevor Darrell
2020CVPRIterative Answer Prediction With Pointer-Augmented Multimodal Transformers for TextVQA.Ronghang Hu, Amanpreet Singh, Trevor Darrell, Marcus Rohrbach
2020CVPRIn Defense of Grid Features for Visual Question Answering.Huaizu Jiang, Ishan Misra, Marcus Rohrbach, Erik G. Learned-Miller, Xinlei Chen
2020CVPR12-in-1: Multi-Task Vision and Language Representation Learning.Jiasen Lu, Vedanuj Goswami, Marcus Rohrbach, Devi Parikh, Stefan Lee
2020ECCVAdversarial Continual Learning.Sayna Ebrahimi, Franziska Meier, Roberto Calandra, Trevor Darrell, Marcus Rohrbach
2020ECCVLearning to Generate Grounded Visual Captions Without Localization Supervision.Chih-Yao Ma, Yannis Kalantidis, Ghassan AlRegib, Peter Vajda, Marcus Rohrbach, Zsolt Kira
2020ECCVTextCaps: A Dataset for Image Captioning with Reading Comprehension.Oleksii Sidorov, Ronghang Hu, Marcus Rohrbach, Amanpreet Singh
2020ICLRUncertainty-guided Continual Learning with Bayesian Neural Networks.Sayna Ebrahimi, Mohamed Elhoseiny, Trevor Darrell, Marcus Rohrbach
2020ICLRDecoupling Representation and Classifier for Long-Tailed Recognition.Bingyi Kang, Saining Xie, Marcus Rohrbach, Zhicheng Yan, Albert Gordo, Jiashi Feng, Yannis Kalantidis
2019AAAILarge-Scale Visual Relationship Understanding.Ji Zhang, Yannis Kalantidis, Marcus Rohrbach, Manohar Paluri, Ahmed Elgammal, Mohamed Elhoseiny
2019ACLCoDraw: Collaborative Drawing as a Testbed for Grounded Goal-driven Communication.Jin-Hwa Kim, Nikita Kitaev, Xinlei Chen, Marcus Rohrbach, Byoung-Tak Zhang, Yuandong Tian, Dhruv Batra, Devi Parikh
2019CVPRGraph-Based Global Reasoning Networks.Yunpeng Chen, Marcus Rohrbach, Zhicheng Yan, Shuicheng Yan, Jiashi Feng, Yannis Kalantidis
2019CVPRUncertainty-Guided Continual Learning in Bayesian Neural Networks - Extended Abstract.Sayna Ebrahimi, Mohamed Elhoseiny, Trevor Darrell, Marcus Rohrbach
2019CVPRAdversarial Inference for Multi-Sentence Video Description.Jae Sung Park, Marcus Rohrbach, Trevor Darrell, Anna Rohrbach
2019CVPRAdversarial Inference for Multi-Sentence Video Description.Jae Sung Park, Marcus Rohrbach, Trevor Darrell, Anna Rohrbach
2019CVPRCycle-Consistency for Robust Visual Question Answering.Meet Shah, Xinlei Chen, Marcus Rohrbach, Devi Parikh
2019CVPRDMC-Net: Generating Discriminative Motion Cues for Fast Compressed Video Action Recognition.Zheng Shou, Xudong Lin, Yannis Kalantidis, Laura Sevilla-Lara, Marcus Rohrbach, Shih-Fu Chang, Zhicheng Yan
2019CVPRTowards VQA Models That Can Read.Amanpreet Singh, Vivek Natarajan, Meet Shah, Yu Jiang, Xinlei Chen, Dhruv Batra, Devi Parikh, Marcus Rohrbach
2019CVPRGrounded Video Description.Luowei Zhou, Yannis Kalantidis, Xinlei Chen, Jason J. Corso, Marcus Rohrbach
2019CVPRGrounded Video Description.Luowei Zhou, Yannis Kalantidis, Xinlei Chen, Jason J. Corso, Marcus Rohrbach
2019ICCVDrop an Octave: Reducing Spatial Redundancy in Convolutional Neural Networks With Octave Convolution.Yunpeng Chen, Haoqi Fan, Bing Xu, Zhicheng Yan, Yannis Kalantidis, Marcus Rohrbach, Shuicheng Yan, Jiashi Feng
2019ICLRSelfless Sequential Learning.Rahaf Aljundi, Marcus Rohrbach, Tinne Tuytelaars
2019ICLREfficient Lifelong Learning with A-GEM.Arslan Chaudhry, Marc'Aurelio Ranzato, Marcus Rohrbach, Mohamed Elhoseiny
2019ICMLProbabilistic Neural Symbolic Models for Interpretable Visual Question Answering.Ramakrishna Vedantam, Karan Desai, Stefan Lee, Marcus Rohrbach, Dhruv Batra, Devi Parikh
2019NAACLCLEVR-Dialog: A Diagnostic Dataset for Multi-Round Reasoning in Visual Dialog.Satwik Kottur, Jos M. F. Moura, Devi Parikh, Dhruv Batra, Marcus Rohrbach
2018ACCVExploring the Challenges Towards Lifelong Fact Learning.Mohamed Elhoseiny, Francesca Babiloni, Rahaf Aljundi, Marcus Rohrbach, Manohar Paluri, Tinne Tuytelaars
2018CVPRMultimodal Explanations: Justifying Decisions and Pointing to the Evidence.Dong Huk Park, Lisa Anne Hendricks, Zeynep Akata, Anna Rohrbach, Bernt Schiele, Trevor Darrell, Marcus Rohrbach
2018ECCVMemory Aware Synapses: Learning What (not) to Forget.Rahaf Aljundi, Francesca Babiloni, Mohamed Elhoseiny, Marcus Rohrbach, Tinne Tuytelaars
2018ECCVVisual Coreference Resolution in Visual Dialog Using Neural Module Networks.Satwik Kottur, Jos M. F. Moura, Devi Parikh, Dhruv Batra, Marcus Rohrbach
2018EMNLPA Dataset for Telling the Stories of Social Media Videos.Spandana Gella, Mike Lewis, Marcus Rohrbach
2017CVPRModeling Relationships in Referential Expressions with Compositional Modular Networks.Ronghang Hu, Marcus Rohrbach, Jacob Andreas, Trevor Darrell, Kate Saenko
2017CVPRGenerating Descriptions with Grounded and Co-referenced People.Anna Rohrbach, Marcus Rohrbach, Siyu Tang, Seong Joon Oh, Bernt Schiele
2017CVPRCaptioning Images with Diverse Objects.Subhashini Venugopalan, Lisa Anne Hendricks, Marcus Rohrbach, Raymond J. Mooney, Trevor Darrell, Kate Saenko
2017ICCVLearning to Reason: End-to-End Module Networks for Visual Question Answering.Ronghang Hu, Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Kate Saenko
2017ICCVSpeaking the Same Language: Matching Machine to Human Captions by Adversarial Training.Rakshith Shetty, Marcus Rohrbach, Lisa Anne Hendricks, Mario Fritz, Bernt Schiele
2016AAAICommonsense in Parts: Mining Part-Whole Relations from the Web and Image Tags.Niket Tandon, Charles Hariman, Jacopo Urbani, Anna Rohrbach, Marcus Rohrbach, Gerhard Weikum
2016CVPRNeural Module Networks.Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Dan Klein
2016CVPRDeep Compositional Captioning: Describing Novel Object Categories without Paired Training Data.Lisa Anne Hendricks, Subhashini Venugopalan, Marcus Rohrbach, Raymond J. Mooney, Kate Saenko, Trevor Darrell
2016CVPRNatural Language Object Retrieval.Ronghang Hu, Huazhe Xu, Marcus Rohrbach, Jiashi Feng, Kate Saenko, Trevor Darrell
2016ECCVGenerating Visual Explanations.Lisa Anne Hendricks, Zeynep Akata, Marcus Rohrbach, Jeff Donahue, Bernt Schiele, Trevor Darrell
2016ECCVSegmentation from Natural Language Expressions.Ronghang Hu, Marcus Rohrbach, Trevor Darrell
2016ECCVGrounding of Textual Phrases in Images by Reconstruction.Anna Rohrbach, Marcus Rohrbach, Ronghang Hu, Trevor Darrell, Bernt Schiele
2016EMNLPMultimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding.Akira Fukui, Dong Huk Park, Daylen Yang, Anna Rohrbach, Trevor Darrell, Marcus Rohrbach
2016NAACLLearning to Compose Neural Networks for Question Answering.Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Dan Klein
2015CVPRLong-term recurrent convolutional networks for visual recognition and description.Jeff Donahue, Lisa Anne Hendricks, Sergio Guadarrama, Marcus Rohrbach, Subhashini Venugopalan, Trevor Darrell, Kate Saenko
2015CVPRA dataset for Movie Description.Anna Rohrbach, Marcus Rohrbach, Niket Tandon, Bernt Schiele
2015ICCVAsk Your Neurons: A Neural-Based Approach to Answering Questions about Images.Mateusz Malinowski, Marcus Rohrbach, Mario Fritz
2015ICCVSpatial Semantic Regularisation for Large Scale Object Detection.Damian Mrowca, Marcus Rohrbach, Judy Hoffman, Ronghang Hu, Kate Saenko, Trevor Darrell
2015ICCVSequence to Sequence - Video to Text.Subhashini Venugopalan, Marcus Rohrbach, Jeffrey Donahue, Raymond J. Mooney, Trevor Darrell, Kate Saenko
2015NAACLTranslating Videos to Natural Language Using Deep Recurrent Neural Networks.Subhashini Venugopalan, Huijuan Xu, Jeff Donahue, Marcus Rohrbach, Raymond J. Mooney, Kate Saenko
2013BMVCMulti-view Pictorial Structures for 3D Human Pose Estimation.Sikandar Amin, Mykhaylo Andriluka, Marcus Rohrbach, Bernt Schiele
2013ICCVTranslating Video Content to Natural Language Descriptions.Marcus Rohrbach, Wei Qiu, Ivan Titov, Stefan Thater, Manfred Pinkal, Bernt Schiele
2012CVPRA database for fine grained activity detection of cooking activities.Marcus Rohrbach, Sikandar Amin, Mykhaylo Andriluka, Bernt Schiele
2012ECCVScript Data for Attribute-Based Recognition of Composite Activities.Marcus Rohrbach, Michaela Regneri, Mykhaylo Andriluka, Sikandar Amin, Manfred Pinkal, Bernt Schiele
2012ECCV3D Object Detection with Multiple Kinects.Wandi Susanto, Marcus Rohrbach, Bernt Schiele
2011CVPREvaluating knowledge transfer and zero-shot learning in a large-scale setting.Marcus Rohrbach, Michael Stark, Bernt Schiele
2010CVPRWhat helps where - and why? Semantic relatedness for knowledge transfer.Marcus Rohrbach, Michael Stark, Gyrgy Szarvas, Iryna Gurevych, Bernt Schiele
2010ECCVCombining Language Sources and Robust Semantic Relatedness for Attribute-Based Knowledge Transfer.Marcus Rohrbach, Michael Stark, Gyrgy Szarvas, Bernt Schiele