Skip to content

Anurag Arnab

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

44

Venues

12

Active years

2015–2025

Best venue rank

A*

Where they publish

Papers

44 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRFlexible Frame Selection for Efficient Video Reasoning.Shyamal Buch, Arsha Nagrani, Anurag Arnab, Cordelia Schmid
2025EMNLPOVFact: Measuring and Improving Open-Vocabulary Factuality for Long Caption Models.Monika Wysoczanska, Shyamal Buch, Anurag Arnab, Cordelia Schmid
2025ICCVPrinciples of Visual Tokens for Efficient Video Understanding.Xinyue Hao, Gen Li, Shreyank N. Gowda, Robert B. Fisher, Jonathan Huang, Anurag Arnab, Laura Sevilla-Lara
2025ICCVFrom Image to Video: An Empirical Study of Diffusion Representations.Pedro Vlez, Luisa F. Polana, Yi Yang, Chuhan Zhang, Rishabh Kabra, Anurag Arnab, Mehdi S. M. Sajjadi
2025ICLRDense Video Object Captioning from Disjoint Supervision.Xingyi Zhou, Anurag Arnab, Chen Sun, Cordelia Schmid
2024CVPROn Scaling Up a Multilingual Vision and Language Model.Xi Chen, Josip Djolonga, Piotr Padlewski, Basil Mustafa, Soravit Changpinyo, Jialin Wu, Carlos Riquelme Ruiz, Sebastian Goodman, Xiao Wang, Yi Tay, Siamak Shakeri, Mostafa Dehghani, Daniel Salz, Mario Lucic, Michael Tschannen, Arsha Nagrani, Hexiang Hu, Mandar Joshi, Bo Pang, Ceslee Montgomery, Paulina Pietrzyk, Marvin Ritter, A. J. Piergiovanni, Matthias Minderer, Filip Pavetic, Austin Waters, Gang Li, Ibrahim Alabdulmohsin, Lucas Beyer, Julien Amelot, Kenton Lee, Andreas Peter Steiner, Yang Li, Daniel Keysers, Anurag Arnab, Yuanzhong Xu, Keran Rong, Alexander Kolesnikov, Mojtaba Seyedhosseini, Anelia Angelova, Xiaohua Zhai, Neil Houlsby, Radu Soricut
2024CVPRCAT-Seg: Cost Aggregation for Open-Vocabulary Semantic Segmentation.Seokju Cho, Heeseong Shin, Sunghwan Hong, Anurag Arnab, Paul Hongsuck Seo, Seungryong Kim
2024CVPREnd-to-End Spatio-Temporal Action Localisation with Video Transformers.Alexey A. Gritsenko, Xuehan Xiong, Josip Djolonga, Mostafa Dehghani, Chen Sun, Mario Lucic, Cordelia Schmid, Anurag Arnab
2024CVPRVicTR: Video-conditioned Text Representations for Activity Recognition.Kumara Kahatapitiya, Anurag Arnab, Arsha Nagrani, Michael S. Ryoo
2024CVPRTime-, Memory- and Parameter-Efficient Visual Adaptation.Otniel-Bogdan Mercea, Alexey A. Gritsenko, Cordelia Schmid, Anurag Arnab
2024CVPRPixel Aligned Language Models.Jiarui Xu, Xingyi Zhou, Shen Yan, Xiuye Gu, Anurag Arnab, Chen Sun, Xiaolong Wang, Cordelia Schmid
2024CVPRStreaming Dense Video Captioning.Xingyi Zhou, Anurag Arnab, Shyamal Buch, Shen Yan, Austin Myers, Xuehan Xiong, Arsha Nagrani, Cordelia Schmid
2024ECCVOptimizing Factorized Encoder Models: Time and Memory Reduction for Scalable and Efficient Action Recognition.Shreyank N. Gowda, Anurag Arnab, Jonathan Huang
2024EMNLPVIEWS: Entity-Aware News Video Captioning.Hammad A. Ayyubi, Tianqi Liu, Arsha Nagrani, Xudong Lin, Mingda Zhang, Anurag Arnab, Feng Han, Yukun Zhu, Xuande Feng, Kevin Zhang, Jialu Liu, Shih-Fu Chang
2024IGARSSPLANTED: A Dataset for Planted Forest Identification from Multi-Satellite Time Series.Luis Miguel Pazos-Outn, Cristina Nader Vasconcelos, Anton Raichuk, Anurag Arnab, Dan Morris, Maxim Neumann
2023CVPRToken Turing Machines.Michael S. Ryoo, Keerthana Gopalakrishnan, Kumara Kahatapitiya, Ted Xiao, Kanishka Rao, Austin Stone, Yao Lu, Julian Ibarz, Anurag Arnab
2023CVPRHow can objects help action recognition?Xingyi Zhou, Anurag Arnab, Chen Sun, Cordelia Schmid
2023ICCVAudiovisual Masked Autoencoders.Mariana-Iuliana Georgescu, Eduardo Fonseca, Radu Tudor Ionescu, Mario Lucic, Cordelia Schmid, Anurag Arnab
2023ICCVUnLoc: A Unified Framework for Video Localization Tasks.Shen Yan, Xuehan Xiong, Arsha Nagrani, Anurag Arnab, Zhonghao Wang, Weina Ge, David Ross, Cordelia Schmid
2023ICMLScaling Vision Transformers to 22 Billion Parameters.Mostafa Dehghani, Josip Djolonga, Basil Mustafa, Piotr Padlewski, Jonathan Heek, Justin Gilmer, Andreas Peter Steiner, Mathilde Caron, Robert Geirhos, Ibrahim Alabdulmohsin, Rodolphe Jenatton, Lucas Beyer, Michael Tschannen, Anurag Arnab, Xiao Wang, Carlos Riquelme Ruiz, Matthias Minderer, Joan Puigcerver, Utku Evci, Manoj Kumar, Sjoerd van Steenkiste, Gamaleldin Fathy Elsayed, Aravindh Mahendran, Fisher Yu, Avital Oliver, Fantine Huot, Jasmijn Bastings, Mark Collier, Alexey A. Gritsenko, Vighnesh Birodkar, Cristina Nader Vasconcelos, Yi Tay, Thomas Mensink, Alexander Kolesnikov, Filip Pavetic, Dustin Tran, Thomas Kipf, Mario Lucic, Xiaohua Zhai, Daniel Keysers, Jeremiah J. Harmsen, Neil Houlsby
2023ICMLAdaptive Computation with Elastic Input Sequence.Fuzhao Xue, Valerii Likhosherstov, Anurag Arnab, Neil Houlsby, Mostafa Dehghani, Yang You
2022CVPRSCENIC: A JAX Library for Computer Vision Research and Beyond.Mostafa Dehghani, Alexey A. Gritsenko, Anurag Arnab, Matthias Minderer, Yi Tay
2022CVPRLearning with Neighbor Consistency for Noisy Labels.Ahmet Iscen, Jack Valmadre, Anurag Arnab, Cordelia Schmid
2022CVPREnd-to-end Generative Pretraining for Multimodal Video Captioning.Paul Hongsuck Seo, Arsha Nagrani, Anurag Arnab, Cordelia Schmid
2022CVPRMultiview Transformers for Video Recognition.Shen Yan, Xuehan Xiong, Anurag Arnab, Zhichao Lu, Mi Zhang, Chen Sun, Cordelia Schmid
2022ECCVSimple Open-Vocabulary Object Detection.Matthias Minderer, Alexey A. Gritsenko, Austin Stone, Maxim Neumann, Dirk Weissenborn, Alexey Dosovitskiy, Aravindh Mahendran, Anurag Arnab, Mostafa Dehghani, Zhuoran Shen, Xiao Wang, Xiaohua Zhai, Thomas Kipf, Neil Houlsby
2022ICLRThe Efficiency Misnomer.Mostafa Dehghani, Yi Tay, Anurag Arnab, Lucas Beyer, Ashish Vaswani
2021ICCVViViT: A Video Vision Transformer.Anurag Arnab, Mostafa Dehghani, Georg Heigold, Chen Sun, Mario Lucic, Cordelia Schmid
2021ICCVUnified Graph Structured Models for Video Understanding.Anurag Arnab, Chen Sun, Cordelia Schmid
2020ACCVDynamic Depth Fusion and Transformation for Monocular 3D Object Detection.Erli Ouyang, Li Zhang, Mohan Chen, Anurag Arnab, Yanwei Fu
2020CVPRDynamic Graph Message Passing Networks.Li Zhang, Dan Xu, Anurag Arnab, Philip H. S. Torr
2020ECCVUncertainty-Aware Weakly Supervised Action Detection from Untrimmed Videos.Anurag Arnab, Chen Sun, Arsha Nagrani, Cordelia Schmid
2020IROSMeta-Learning Deep Visual Words for Fast Video Object Segmentation.Harkirat Singh Behl, Mohammad Najafi, Anurag Arnab, Philip H. S. Torr
2019BMVCDual Graph Convolutional Network for Semantic Segmentation.Li Zhang, Xiangtai Li, Anurag Arnab, Kuiyuan Yang, Yunhai Tong, Philip H. S. Torr
2019CVPRExploiting Temporal Context for 3D Human Pose Estimation in the Wild.Anurag Arnab, Carl Doersch, Andrew Zisserman
2018ACMLDeep Fully-Connected Part-Based Models for Human Pose Estimation.Rodrigo Andrade de Bem, Anurag Arnab, Stuart Golodetz, Michael Sapienza, Philip H. S. Torr
2018CVPROn the Robustness of Semantic Segmentation Models to Adversarial Attacks.Anurag Arnab, Ondrej Miksik, Philip H. S. Torr
2018ECCVWeakly- and Semi-supervised Panoptic Segmentation.Qizhu Li, Anurag Arnab, Philip H. S. Torr
2017BMVCHolistic, Instance-level Human Parsing.Qizhu Li, Anurag Arnab, Philip H. S. Torr
2017CVPRPixelwise Instance Segmentation with a Dynamically Instantiated Network.Anurag Arnab, Philip H. S. Torr
2016BMVCBottom-up Instance Segmentation using Deep Higher-Order CRFs.Anurag Arnab, Philip H. S. Torr
2016ECCVHigher Order Conditional Random Fields in Deep Neural Networks.Anurag Arnab, Sadeep Jayasumana, Shuai Zheng, Philip H. S. Torr
2015BMVCJoint Object-Material Category Segmentation from Audio-Visual Cues.Anurag Arnab, Michael Sapienza, Stuart Golodetz, Julien P. C. Valentin, Ondrej Miksik, Shahram Izadi, Philip H. S. Torr
2015SIGGRAPHSemanticPaint: interactive segmentation and learning of 3D worlds.Stuart Golodetz, Michael Sapienza, Julien P. C. Valentin, Vibhav Vineet, Ming-Ming Cheng, Victor Adrian Prisacariu, Olaf Khler, Carl Yuheng Ren, Anurag Arnab, Stephen L. Hicks, David William Murray, Shahram Izadi, Philip H. S. Torr