Skip to content

IEEE Workshop on Applications of Computer Vision

WACV

A

CORE rank

CORE rank (raw)

A

Fields of research

Computer Vision and Multimedia Computation

Papers indexed

7,071

1992–2026

Papers per year

19921,095 peak2026

WACV papers

7,071 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2024A Visual Active Search Framework for Geospatial Exploration.Anindya Sarkar, Michael Lanier, Scott Alfeld, Jiarui Feng, Roman Garnett, Nathan Jacobs, Yevgeniy Vorobeychik
2024Open-Set Object Detection By Aligning Known Class Representations.Hiran Sarkar, Vishal M. Chudasama, Naoyuki Onoe, Pankaj Wasnik, Vineeth N. Balasubramanian
2024Benchmark Generation Framework with Customizable Distortions for Image Classifier Robustness.Soumyendu Sarkar, Ashwin Ramesh Babu, Sajad Mousavi, Zachariah Carmichael, Vineet Gundecha, Sahand Ghorbanpour, Ricardo Luna Gutirrez, Antonio Guillen, Avisek Naug
2024Aligning Non-Causal Factors for Transformer-Based Source-Free Domain Adaptation.Sunandini Sanyal, Ashish Ramayee Asokan, Suvaansh Bhambri, Pradyumna YM, Akshay R. Kulkarni, Jogendra Nath Kundu, R. Venkatesh Babu
2024On Manipulating Scene Text in the Wild with Diffusion Models.Joshua Santoso, Christian Simon, Williem
2024SICKLE: A Multi-Sensor Satellite Imagery Dataset Annotated with Multiple Key Cropping Parameters.Depanshu Sani, Sandeep Mahato, Sourabh Saini, Harsh Kumar Agarwal, Charu Chandra Devshali, Saket Anand, Gaurav Arora, Thiagarajan Jayaraman
2024HIDRO-VQA: High Dynamic Range Oracle for Video Quality Assessment.Shreshth Saini, Avinab Saha, Alan C. Bovik
2024POP-VQA - Privacy preserving, On-device, Personalized Visual Question Answering.Pragya Paramita Sahu, Abhishek Raut, Jagdish Singh Samant, Mahesh Gorijala, Vignesh Lakshminarayanan, Pinaki Bhaskar
2024Enhancing Multimodal Compositional Reasoning of Visual Language Models with Generative Negative Mining.Ugur Sahin, Hang Li, Qadeer Khan, Daniel Cremers, Volker Tresp
2024MAdVerse: A Hierarchical Dataset of Multi-Lingual Ads from Diverse Sources and Categories.Amruth Sagar, Rishabh Srivastava, Rakshitha R. T, Venkata Kesav Venna, Ravi Kiran Sarvadevabhatla
2024Auto-BPA: An Enhanced Ball-Pivoting Algorithm with Adaptive Radius using Contextual Bandits.Houda Saffi, Naima Otberdout, Youssef Hmamouche, Amal El Fallah Seghrouchni
2024Leveraging Task-Specific Pre-Training to Reason across Images and Videos.Arka Sadhu, Ram Nevatia
2024Rank2Tell: A Multimodal Driving Dataset for Joint Importance Ranking and Reasoning.Enna Sachdeva, Nakul Agarwal, Suhas Chundi, Sean Roelofs, Jiachen Li, Mykel J. Kochenderfer, Chiho Choi, Behzad Dariush
2024On the Importance of Large Objects in CNN Based Object Detection Algorithms.Ahmed Ben Saad, Gabriele Facciolo, Axel Davy
2024Describe Images in a Boring Way: Towards Cross-Modal Sarcasm Generation.Jie Ruan, Yue Wu, Xiaojun Wan, Yuesheng Zhu
2024TriCoLo: Trimodal Contrastive Loss for Text to Shape Retrieval.Yue Ruan, Han-Hung Lee, Yiming Zhang, Ke Zhang, Angel X. Chang
2024MobileNVC: Real-time 1080p Neural Video Compression on a Mobile Device.Ties van Rozendaal, Tushar Singhal, Hoang Le, Guillaume Sautire, Amir Said, Krishna Buska, Anjuman Raha, Dimitris Kalatzis, Hitarth Mehta, Frank Mayer, Liang Zhang, Markus Nagel, Auke J. Wiggers
2024Efficient Expansion and Gradient Based Task Inference for Replay Free Incremental Learning.Soumya Roy, Vinay Kumar Verma, Deepak Gupta
2024Interaction Region Visual Transformer for Egocentric Action Anticipation.Debaditya Roy, Ramanathan Rajendiran, Basura Fernando
2024FuseCap: Leveraging Large Language Models for Enriched Fused Image Captions.Noam Rotstein, David Bensad, Shaked Brody, Roy Ganz, Ron Kimmel
2024Time to Shine: Fine-Tuning Object Detection Models with Synthetic Adverse Weather Images.Thomas Rothmeier, Werner Huber, Alois C. Knoll
2024Effects of Markers in Training Datasets on the Accuracy of 6D Pose Estimation.Janis Rosskamp, Ren Weller, Gabriel Zachmann
2024Recognition of Unseen Bird Species by Learning from Field Guides.Andrs C. Rodrguez, Stefano D'Aronco, Rodrigo Caye Daudt, Jan D. Wegner, Konrad Schindler
2024Source-Free Domain Adaptation for RGB-D Semantic Segmentation with Vision Transformers.Giulia Rizzoli, Donald Shenaj, Pietro Zanuttigh
2024MotionGPT: Human Motion Synthesis with Improved Diversity and Realism via GPT-3 Prompting.Jos Ribeiro-Gomes, Tianhui Cai, Zoltn dm Milacski, Chen Wu, Aayush Prakash, Shingo Takagi, Amaury Aubel, Daeil Kim, Alexandre Bernardino, Fernando De la Torre
2,4012,425 of 7,071← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.