Anurag Arnab
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
44
Venues
12
Active years
2015–2025
Best venue rank
A*
Where they publish
Papers
44 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | CVPR | Flexible Frame Selection for Efficient Video Reasoning. | Shyamal Buch, Arsha Nagrani, Anurag Arnab, Cordelia Schmid |
| 2025 | EMNLP | OVFact: Measuring and Improving Open-Vocabulary Factuality for Long Caption Models. | Monika Wysoczanska, Shyamal Buch, Anurag Arnab, Cordelia Schmid |
| 2025 | ICCV | Principles of Visual Tokens for Efficient Video Understanding. | Xinyue Hao, Gen Li, Shreyank N. Gowda, Robert B. Fisher, Jonathan Huang, Anurag Arnab, Laura Sevilla-Lara |
| 2025 | ICCV | From Image to Video: An Empirical Study of Diffusion Representations. | Pedro Vlez, Luisa F. Polana, Yi Yang, Chuhan Zhang, Rishabh Kabra, Anurag Arnab, Mehdi S. M. Sajjadi |
| 2025 | ICLR | Dense Video Object Captioning from Disjoint Supervision. | Xingyi Zhou, Anurag Arnab, Chen Sun, Cordelia Schmid |
| 2024 | CVPR | On Scaling Up a Multilingual Vision and Language Model. | Xi Chen, Josip Djolonga, Piotr Padlewski, Basil Mustafa, Soravit Changpinyo, Jialin Wu, Carlos Riquelme Ruiz, Sebastian Goodman, Xiao Wang, Yi Tay, Siamak Shakeri, Mostafa Dehghani, Daniel Salz, Mario Lucic, Michael Tschannen, Arsha Nagrani, Hexiang Hu, Mandar Joshi, Bo Pang, Ceslee Montgomery, Paulina Pietrzyk, Marvin Ritter, A. J. Piergiovanni, Matthias Minderer, Filip Pavetic, Austin Waters, Gang Li, Ibrahim Alabdulmohsin, Lucas Beyer, Julien Amelot, Kenton Lee, Andreas Peter Steiner, Yang Li, Daniel Keysers, Anurag Arnab, Yuanzhong Xu, Keran Rong, Alexander Kolesnikov, Mojtaba Seyedhosseini, Anelia Angelova, Xiaohua Zhai, Neil Houlsby, Radu Soricut |
| 2024 | CVPR | CAT-Seg: Cost Aggregation for Open-Vocabulary Semantic Segmentation. | Seokju Cho, Heeseong Shin, Sunghwan Hong, Anurag Arnab, Paul Hongsuck Seo, Seungryong Kim |
| 2024 | CVPR | End-to-End Spatio-Temporal Action Localisation with Video Transformers. | Alexey A. Gritsenko, Xuehan Xiong, Josip Djolonga, Mostafa Dehghani, Chen Sun, Mario Lucic, Cordelia Schmid, Anurag Arnab |
| 2024 | CVPR | VicTR: Video-conditioned Text Representations for Activity Recognition. | Kumara Kahatapitiya, Anurag Arnab, Arsha Nagrani, Michael S. Ryoo |
| 2024 | CVPR | Time-, Memory- and Parameter-Efficient Visual Adaptation. | Otniel-Bogdan Mercea, Alexey A. Gritsenko, Cordelia Schmid, Anurag Arnab |
| 2024 | CVPR | Pixel Aligned Language Models. | Jiarui Xu, Xingyi Zhou, Shen Yan, Xiuye Gu, Anurag Arnab, Chen Sun, Xiaolong Wang, Cordelia Schmid |
| 2024 | CVPR | Streaming Dense Video Captioning. | Xingyi Zhou, Anurag Arnab, Shyamal Buch, Shen Yan, Austin Myers, Xuehan Xiong, Arsha Nagrani, Cordelia Schmid |
| 2024 | ECCV | Optimizing Factorized Encoder Models: Time and Memory Reduction for Scalable and Efficient Action Recognition. | Shreyank N. Gowda, Anurag Arnab, Jonathan Huang |
| 2024 | EMNLP | VIEWS: Entity-Aware News Video Captioning. | Hammad A. Ayyubi, Tianqi Liu, Arsha Nagrani, Xudong Lin, Mingda Zhang, Anurag Arnab, Feng Han, Yukun Zhu, Xuande Feng, Kevin Zhang, Jialu Liu, Shih-Fu Chang |
| 2024 | IGARSS | PLANTED: A Dataset for Planted Forest Identification from Multi-Satellite Time Series. | Luis Miguel Pazos-Outn, Cristina Nader Vasconcelos, Anton Raichuk, Anurag Arnab, Dan Morris, Maxim Neumann |
| 2023 | CVPR | Token Turing Machines. | Michael S. Ryoo, Keerthana Gopalakrishnan, Kumara Kahatapitiya, Ted Xiao, Kanishka Rao, Austin Stone, Yao Lu, Julian Ibarz, Anurag Arnab |
| 2023 | CVPR | How can objects help action recognition? | Xingyi Zhou, Anurag Arnab, Chen Sun, Cordelia Schmid |
| 2023 | ICCV | Audiovisual Masked Autoencoders. | Mariana-Iuliana Georgescu, Eduardo Fonseca, Radu Tudor Ionescu, Mario Lucic, Cordelia Schmid, Anurag Arnab |
| 2023 | ICCV | UnLoc: A Unified Framework for Video Localization Tasks. | Shen Yan, Xuehan Xiong, Arsha Nagrani, Anurag Arnab, Zhonghao Wang, Weina Ge, David Ross, Cordelia Schmid |
| 2023 | ICML | Scaling Vision Transformers to 22 Billion Parameters. | Mostafa Dehghani, Josip Djolonga, Basil Mustafa, Piotr Padlewski, Jonathan Heek, Justin Gilmer, Andreas Peter Steiner, Mathilde Caron, Robert Geirhos, Ibrahim Alabdulmohsin, Rodolphe Jenatton, Lucas Beyer, Michael Tschannen, Anurag Arnab, Xiao Wang, Carlos Riquelme Ruiz, Matthias Minderer, Joan Puigcerver, Utku Evci, Manoj Kumar, Sjoerd van Steenkiste, Gamaleldin Fathy Elsayed, Aravindh Mahendran, Fisher Yu, Avital Oliver, Fantine Huot, Jasmijn Bastings, Mark Collier, Alexey A. Gritsenko, Vighnesh Birodkar, Cristina Nader Vasconcelos, Yi Tay, Thomas Mensink, Alexander Kolesnikov, Filip Pavetic, Dustin Tran, Thomas Kipf, Mario Lucic, Xiaohua Zhai, Daniel Keysers, Jeremiah J. Harmsen, Neil Houlsby |
| 2023 | ICML | Adaptive Computation with Elastic Input Sequence. | Fuzhao Xue, Valerii Likhosherstov, Anurag Arnab, Neil Houlsby, Mostafa Dehghani, Yang You |
| 2022 | CVPR | SCENIC: A JAX Library for Computer Vision Research and Beyond. | Mostafa Dehghani, Alexey A. Gritsenko, Anurag Arnab, Matthias Minderer, Yi Tay |
| 2022 | CVPR | Learning with Neighbor Consistency for Noisy Labels. | Ahmet Iscen, Jack Valmadre, Anurag Arnab, Cordelia Schmid |
| 2022 | CVPR | End-to-end Generative Pretraining for Multimodal Video Captioning. | Paul Hongsuck Seo, Arsha Nagrani, Anurag Arnab, Cordelia Schmid |
| 2022 | CVPR | Multiview Transformers for Video Recognition. | Shen Yan, Xuehan Xiong, Anurag Arnab, Zhichao Lu, Mi Zhang, Chen Sun, Cordelia Schmid |
| 2022 | ECCV | Simple Open-Vocabulary Object Detection. | Matthias Minderer, Alexey A. Gritsenko, Austin Stone, Maxim Neumann, Dirk Weissenborn, Alexey Dosovitskiy, Aravindh Mahendran, Anurag Arnab, Mostafa Dehghani, Zhuoran Shen, Xiao Wang, Xiaohua Zhai, Thomas Kipf, Neil Houlsby |
| 2022 | ICLR | The Efficiency Misnomer. | Mostafa Dehghani, Yi Tay, Anurag Arnab, Lucas Beyer, Ashish Vaswani |
| 2021 | ICCV | ViViT: A Video Vision Transformer. | Anurag Arnab, Mostafa Dehghani, Georg Heigold, Chen Sun, Mario Lucic, Cordelia Schmid |
| 2021 | ICCV | Unified Graph Structured Models for Video Understanding. | Anurag Arnab, Chen Sun, Cordelia Schmid |
| 2020 | ACCV | Dynamic Depth Fusion and Transformation for Monocular 3D Object Detection. | Erli Ouyang, Li Zhang, Mohan Chen, Anurag Arnab, Yanwei Fu |
| 2020 | CVPR | Dynamic Graph Message Passing Networks. | Li Zhang, Dan Xu, Anurag Arnab, Philip H. S. Torr |
| 2020 | ECCV | Uncertainty-Aware Weakly Supervised Action Detection from Untrimmed Videos. | Anurag Arnab, Chen Sun, Arsha Nagrani, Cordelia Schmid |
| 2020 | IROS | Meta-Learning Deep Visual Words for Fast Video Object Segmentation. | Harkirat Singh Behl, Mohammad Najafi, Anurag Arnab, Philip H. S. Torr |
| 2019 | BMVC | Dual Graph Convolutional Network for Semantic Segmentation. | Li Zhang, Xiangtai Li, Anurag Arnab, Kuiyuan Yang, Yunhai Tong, Philip H. S. Torr |
| 2019 | CVPR | Exploiting Temporal Context for 3D Human Pose Estimation in the Wild. | Anurag Arnab, Carl Doersch, Andrew Zisserman |
| 2018 | ACML | Deep Fully-Connected Part-Based Models for Human Pose Estimation. | Rodrigo Andrade de Bem, Anurag Arnab, Stuart Golodetz, Michael Sapienza, Philip H. S. Torr |
| 2018 | CVPR | On the Robustness of Semantic Segmentation Models to Adversarial Attacks. | Anurag Arnab, Ondrej Miksik, Philip H. S. Torr |
| 2018 | ECCV | Weakly- and Semi-supervised Panoptic Segmentation. | Qizhu Li, Anurag Arnab, Philip H. S. Torr |
| 2017 | BMVC | Holistic, Instance-level Human Parsing. | Qizhu Li, Anurag Arnab, Philip H. S. Torr |
| 2017 | CVPR | Pixelwise Instance Segmentation with a Dynamically Instantiated Network. | Anurag Arnab, Philip H. S. Torr |
| 2016 | BMVC | Bottom-up Instance Segmentation using Deep Higher-Order CRFs. | Anurag Arnab, Philip H. S. Torr |
| 2016 | ECCV | Higher Order Conditional Random Fields in Deep Neural Networks. | Anurag Arnab, Sadeep Jayasumana, Shuai Zheng, Philip H. S. Torr |
| 2015 | BMVC | Joint Object-Material Category Segmentation from Audio-Visual Cues. | Anurag Arnab, Michael Sapienza, Stuart Golodetz, Julien P. C. Valentin, Ondrej Miksik, Shahram Izadi, Philip H. S. Torr |
| 2015 | SIGGRAPH | SemanticPaint: interactive segmentation and learning of 3D worlds. | Stuart Golodetz, Michael Sapienza, Julien P. C. Valentin, Vibhav Vineet, Ming-Ming Cheng, Victor Adrian Prisacariu, Olaf Khler, Carl Yuheng Ren, Anurag Arnab, Stephen L. Hicks, David William Murray, Shahram Izadi, Philip H. S. Torr |