Marcus Rohrbach
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
73
Venues
12
Active years
2010–2026
Best venue rank
A*
Where they publish
Papers
73 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | VeriTaS: The First Dynamic Benchmark for Multimodal Automated Fact-Checking. | Mark Rothermel, Marcus Kornmann, Marcus Rohrbach, Anna Rohrbach |
| 2025 | ACL | Predicting Implicit Arguments in Procedural Video Instructions. | Anil Batra, Laura Sevilla-Lara, Marcus Rohrbach, Frank Keller |
| 2025 | CVPR | V^2Dial: Unification of Video and Visual Dialog via Multimodal Experts. | Adnen Abdessaied, Anna Rohrbach, Marcus Rohrbach, Andreas Bulling |
| 2025 | ICCV | Chrono: A Simple Blueprint for Representing Time in MLLMs. | Boris Meinardus, Hector G. Rodriguez, Anil Batra, Anna Rohrbach, Marcus Rohrbach |
| 2025 | ICML | DEFAME: Dynamic Evidence-based FAct-checking with Multimodal Experts. | Tobias Braun, Mark Rothermel, Marcus Rohrbach, Anna Rohrbach |
| 2024 | ECCV | Efficient Pre-training for Localized Instruction Generation of Procedural Videos. | Anil Batra, Davide Moltisanti, Laura Sevilla-Lara, Marcus Rohrbach, Frank Keller |
| 2024 | WACV | Simple Token-Level Confidence Improves Caption Correctness. | Suzanne Petryk, Spencer Whitehead, Joseph E. Gonzalez, Trevor Darrell, Anna Rohrbach, Marcus Rohrbach |
| 2023 | CVPR | Improving Selective Visual Question Answering by Learning from Your Peers. | Corentin Dancette, Spencer Whitehead, Rishabh Maheshwary, Ramakrishna Vedantam, Stefan Scherer, Xinlei Chen, Matthieu Cord, Marcus Rohrbach |
| 2022 | CVPR | Learning To Recognize Procedural Activities with Distant Supervision. | Xudong Lin, Fabio Petroni, Gedas Bertasius, Marcus Rohrbach, Shih-Fu Chang, Lorenzo Torresani |
| 2022 | CVPR | FLAVA: A Foundational Language And Vision Alignment Model. | Amanpreet Singh, Ronghang Hu, Vedanuj Goswami, Guillaume Couairon, Wojciech Galuba, Marcus Rohrbach, Douwe Kiela |
| 2022 | ECCV | Learn2Augment: Learning to Composite Videos for Data Augmentation in Action Recognition. | Shreyank N. Gowda, Marcus Rohrbach, Frank Keller, Laura Sevilla-Lara |
| 2022 | ECCV | CLASTER: Clustering with Reinforcement Learning for Zero-Shot Action Recognition. | Shreyank N. Gowda, Laura Sevilla-Lara, Frank Keller, Marcus Rohrbach |
| 2022 | ECCV | Reliable Visual Question Answering: Abstain Rather Than Answer Incorrectly. | Spencer Whitehead, Suzanne Petryk, Vedaad Shakib, Joseph Gonzalez, Trevor Darrell, Anna Rohrbach, Marcus Rohrbach |
| 2021 | AAAI | SMART Frame Selection for Action Recognition. | Shreyank N. Gowda, Marcus Rohrbach, Laura Sevilla-Lara |
| 2021 | CVPR | KRISP: Integrating Implicit and Symbolic Knowledge for Open-Domain Knowledge-Based VQA. | Kenneth Marino, Xinlei Chen, Devi Parikh, Abhinav Gupta, Marcus Rohrbach |
| 2021 | ICLR | Remembering for the Right Reasons: Explanations Reduce Catastrophic Forgetting. | Sayna Ebrahimi, Suzanne Petryk, Akash Gokul, William Gan, Joseph E. Gonzalez, Marcus Rohrbach, Trevor Darrell |
| 2020 | CVPR | Iterative Answer Prediction With Pointer-Augmented Multimodal Transformers for TextVQA. | Ronghang Hu, Amanpreet Singh, Trevor Darrell, Marcus Rohrbach |
| 2020 | CVPR | In Defense of Grid Features for Visual Question Answering. | Huaizu Jiang, Ishan Misra, Marcus Rohrbach, Erik G. Learned-Miller, Xinlei Chen |
| 2020 | CVPR | 12-in-1: Multi-Task Vision and Language Representation Learning. | Jiasen Lu, Vedanuj Goswami, Marcus Rohrbach, Devi Parikh, Stefan Lee |
| 2020 | ECCV | Adversarial Continual Learning. | Sayna Ebrahimi, Franziska Meier, Roberto Calandra, Trevor Darrell, Marcus Rohrbach |
| 2020 | ECCV | Learning to Generate Grounded Visual Captions Without Localization Supervision. | Chih-Yao Ma, Yannis Kalantidis, Ghassan AlRegib, Peter Vajda, Marcus Rohrbach, Zsolt Kira |
| 2020 | ECCV | TextCaps: A Dataset for Image Captioning with Reading Comprehension. | Oleksii Sidorov, Ronghang Hu, Marcus Rohrbach, Amanpreet Singh |
| 2020 | ICLR | Uncertainty-guided Continual Learning with Bayesian Neural Networks. | Sayna Ebrahimi, Mohamed Elhoseiny, Trevor Darrell, Marcus Rohrbach |
| 2020 | ICLR | Decoupling Representation and Classifier for Long-Tailed Recognition. | Bingyi Kang, Saining Xie, Marcus Rohrbach, Zhicheng Yan, Albert Gordo, Jiashi Feng, Yannis Kalantidis |
| 2019 | AAAI | Large-Scale Visual Relationship Understanding. | Ji Zhang, Yannis Kalantidis, Marcus Rohrbach, Manohar Paluri, Ahmed Elgammal, Mohamed Elhoseiny |
| 2019 | ACL | CoDraw: Collaborative Drawing as a Testbed for Grounded Goal-driven Communication. | Jin-Hwa Kim, Nikita Kitaev, Xinlei Chen, Marcus Rohrbach, Byoung-Tak Zhang, Yuandong Tian, Dhruv Batra, Devi Parikh |
| 2019 | CVPR | Graph-Based Global Reasoning Networks. | Yunpeng Chen, Marcus Rohrbach, Zhicheng Yan, Shuicheng Yan, Jiashi Feng, Yannis Kalantidis |
| 2019 | CVPR | Uncertainty-Guided Continual Learning in Bayesian Neural Networks - Extended Abstract. | Sayna Ebrahimi, Mohamed Elhoseiny, Trevor Darrell, Marcus Rohrbach |
| 2019 | CVPR | Adversarial Inference for Multi-Sentence Video Description. | Jae Sung Park, Marcus Rohrbach, Trevor Darrell, Anna Rohrbach |
| 2019 | CVPR | Adversarial Inference for Multi-Sentence Video Description. | Jae Sung Park, Marcus Rohrbach, Trevor Darrell, Anna Rohrbach |
| 2019 | CVPR | Cycle-Consistency for Robust Visual Question Answering. | Meet Shah, Xinlei Chen, Marcus Rohrbach, Devi Parikh |
| 2019 | CVPR | DMC-Net: Generating Discriminative Motion Cues for Fast Compressed Video Action Recognition. | Zheng Shou, Xudong Lin, Yannis Kalantidis, Laura Sevilla-Lara, Marcus Rohrbach, Shih-Fu Chang, Zhicheng Yan |
| 2019 | CVPR | Towards VQA Models That Can Read. | Amanpreet Singh, Vivek Natarajan, Meet Shah, Yu Jiang, Xinlei Chen, Dhruv Batra, Devi Parikh, Marcus Rohrbach |
| 2019 | CVPR | Grounded Video Description. | Luowei Zhou, Yannis Kalantidis, Xinlei Chen, Jason J. Corso, Marcus Rohrbach |
| 2019 | CVPR | Grounded Video Description. | Luowei Zhou, Yannis Kalantidis, Xinlei Chen, Jason J. Corso, Marcus Rohrbach |
| 2019 | ICCV | Drop an Octave: Reducing Spatial Redundancy in Convolutional Neural Networks With Octave Convolution. | Yunpeng Chen, Haoqi Fan, Bing Xu, Zhicheng Yan, Yannis Kalantidis, Marcus Rohrbach, Shuicheng Yan, Jiashi Feng |
| 2019 | ICLR | Selfless Sequential Learning. | Rahaf Aljundi, Marcus Rohrbach, Tinne Tuytelaars |
| 2019 | ICLR | Efficient Lifelong Learning with A-GEM. | Arslan Chaudhry, Marc'Aurelio Ranzato, Marcus Rohrbach, Mohamed Elhoseiny |
| 2019 | ICML | Probabilistic Neural Symbolic Models for Interpretable Visual Question Answering. | Ramakrishna Vedantam, Karan Desai, Stefan Lee, Marcus Rohrbach, Dhruv Batra, Devi Parikh |
| 2019 | NAACL | CLEVR-Dialog: A Diagnostic Dataset for Multi-Round Reasoning in Visual Dialog. | Satwik Kottur, Jos M. F. Moura, Devi Parikh, Dhruv Batra, Marcus Rohrbach |
| 2018 | ACCV | Exploring the Challenges Towards Lifelong Fact Learning. | Mohamed Elhoseiny, Francesca Babiloni, Rahaf Aljundi, Marcus Rohrbach, Manohar Paluri, Tinne Tuytelaars |
| 2018 | CVPR | Multimodal Explanations: Justifying Decisions and Pointing to the Evidence. | Dong Huk Park, Lisa Anne Hendricks, Zeynep Akata, Anna Rohrbach, Bernt Schiele, Trevor Darrell, Marcus Rohrbach |
| 2018 | ECCV | Memory Aware Synapses: Learning What (not) to Forget. | Rahaf Aljundi, Francesca Babiloni, Mohamed Elhoseiny, Marcus Rohrbach, Tinne Tuytelaars |
| 2018 | ECCV | Visual Coreference Resolution in Visual Dialog Using Neural Module Networks. | Satwik Kottur, Jos M. F. Moura, Devi Parikh, Dhruv Batra, Marcus Rohrbach |
| 2018 | EMNLP | A Dataset for Telling the Stories of Social Media Videos. | Spandana Gella, Mike Lewis, Marcus Rohrbach |
| 2017 | CVPR | Modeling Relationships in Referential Expressions with Compositional Modular Networks. | Ronghang Hu, Marcus Rohrbach, Jacob Andreas, Trevor Darrell, Kate Saenko |
| 2017 | CVPR | Generating Descriptions with Grounded and Co-referenced People. | Anna Rohrbach, Marcus Rohrbach, Siyu Tang, Seong Joon Oh, Bernt Schiele |
| 2017 | CVPR | Captioning Images with Diverse Objects. | Subhashini Venugopalan, Lisa Anne Hendricks, Marcus Rohrbach, Raymond J. Mooney, Trevor Darrell, Kate Saenko |
| 2017 | ICCV | Learning to Reason: End-to-End Module Networks for Visual Question Answering. | Ronghang Hu, Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Kate Saenko |
| 2017 | ICCV | Speaking the Same Language: Matching Machine to Human Captions by Adversarial Training. | Rakshith Shetty, Marcus Rohrbach, Lisa Anne Hendricks, Mario Fritz, Bernt Schiele |
| 2016 | AAAI | Commonsense in Parts: Mining Part-Whole Relations from the Web and Image Tags. | Niket Tandon, Charles Hariman, Jacopo Urbani, Anna Rohrbach, Marcus Rohrbach, Gerhard Weikum |
| 2016 | CVPR | Neural Module Networks. | Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Dan Klein |
| 2016 | CVPR | Deep Compositional Captioning: Describing Novel Object Categories without Paired Training Data. | Lisa Anne Hendricks, Subhashini Venugopalan, Marcus Rohrbach, Raymond J. Mooney, Kate Saenko, Trevor Darrell |
| 2016 | CVPR | Natural Language Object Retrieval. | Ronghang Hu, Huazhe Xu, Marcus Rohrbach, Jiashi Feng, Kate Saenko, Trevor Darrell |
| 2016 | ECCV | Generating Visual Explanations. | Lisa Anne Hendricks, Zeynep Akata, Marcus Rohrbach, Jeff Donahue, Bernt Schiele, Trevor Darrell |
| 2016 | ECCV | Segmentation from Natural Language Expressions. | Ronghang Hu, Marcus Rohrbach, Trevor Darrell |
| 2016 | ECCV | Grounding of Textual Phrases in Images by Reconstruction. | Anna Rohrbach, Marcus Rohrbach, Ronghang Hu, Trevor Darrell, Bernt Schiele |
| 2016 | EMNLP | Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding. | Akira Fukui, Dong Huk Park, Daylen Yang, Anna Rohrbach, Trevor Darrell, Marcus Rohrbach |
| 2016 | NAACL | Learning to Compose Neural Networks for Question Answering. | Jacob Andreas, Marcus Rohrbach, Trevor Darrell, Dan Klein |
| 2015 | CVPR | Long-term recurrent convolutional networks for visual recognition and description. | Jeff Donahue, Lisa Anne Hendricks, Sergio Guadarrama, Marcus Rohrbach, Subhashini Venugopalan, Trevor Darrell, Kate Saenko |
| 2015 | CVPR | A dataset for Movie Description. | Anna Rohrbach, Marcus Rohrbach, Niket Tandon, Bernt Schiele |
| 2015 | ICCV | Ask Your Neurons: A Neural-Based Approach to Answering Questions about Images. | Mateusz Malinowski, Marcus Rohrbach, Mario Fritz |
| 2015 | ICCV | Spatial Semantic Regularisation for Large Scale Object Detection. | Damian Mrowca, Marcus Rohrbach, Judy Hoffman, Ronghang Hu, Kate Saenko, Trevor Darrell |
| 2015 | ICCV | Sequence to Sequence - Video to Text. | Subhashini Venugopalan, Marcus Rohrbach, Jeffrey Donahue, Raymond J. Mooney, Trevor Darrell, Kate Saenko |
| 2015 | NAACL | Translating Videos to Natural Language Using Deep Recurrent Neural Networks. | Subhashini Venugopalan, Huijuan Xu, Jeff Donahue, Marcus Rohrbach, Raymond J. Mooney, Kate Saenko |
| 2013 | BMVC | Multi-view Pictorial Structures for 3D Human Pose Estimation. | Sikandar Amin, Mykhaylo Andriluka, Marcus Rohrbach, Bernt Schiele |
| 2013 | ICCV | Translating Video Content to Natural Language Descriptions. | Marcus Rohrbach, Wei Qiu, Ivan Titov, Stefan Thater, Manfred Pinkal, Bernt Schiele |
| 2012 | CVPR | A database for fine grained activity detection of cooking activities. | Marcus Rohrbach, Sikandar Amin, Mykhaylo Andriluka, Bernt Schiele |
| 2012 | ECCV | Script Data for Attribute-Based Recognition of Composite Activities. | Marcus Rohrbach, Michaela Regneri, Mykhaylo Andriluka, Sikandar Amin, Manfred Pinkal, Bernt Schiele |
| 2012 | ECCV | 3D Object Detection with Multiple Kinects. | Wandi Susanto, Marcus Rohrbach, Bernt Schiele |
| 2011 | CVPR | Evaluating knowledge transfer and zero-shot learning in a large-scale setting. | Marcus Rohrbach, Michael Stark, Bernt Schiele |
| 2010 | CVPR | What helps where - and why? Semantic relatedness for knowledge transfer. | Marcus Rohrbach, Michael Stark, Gyrgy Szarvas, Iryna Gurevych, Bernt Schiele |
| 2010 | ECCV | Combining Language Sources and Robust Semantic Relatedness for Attribute-Based Knowledge Transfer. | Marcus Rohrbach, Michael Stark, Gyrgy Szarvas, Bernt Schiele |