| 2026 | AAAI | Temporal Object-Aware Vision Transformer for Few-Shot Video Object Detection. | Yogesh Kumar, Anand Mishra |
| 2026 | AAAI | PatientVLM Meets DocVLM: Pre-Consultation Dialogue Between Vision-Language Models for Efficient Diagnosis. | K. Lokesh, Abhirama Subramanyam Penamakuri, Uday Agarwal, Apoorva Challa, Shreya K. Gowda, Somesh Gupta, Anand Mishra |
| 2025 | AAAI | PatentLMM: Large Multimodal Model for Generating Descriptions for Patent Figures. | Shreya Shukla, Nakul Sharma, Manish Gupta, Anand Mishra |
| 2025 | EMNLP | When Big Models Train Small Ones: Label-Free Model Parity Alignment for Efficient Visual Question Answering using Small VLMs. | Abhirama Subramanyam Penamakuri, Navlika Singh, Piyush Arora, Anand Mishra |
| 2025 | ICCV | Aligning Moments in Time Using Video Queries. | Yogesh Kumar, Uday Agarwal, Manish Gupta, Anand Mishra |
| 2025 | ICDAR | AI-Generated Lecture Slides for Improving Slide Element Detection and Retrieval. | Suyash Maniyar, Vishvesh Trivedi, Ajoy Mondal, Anand Mishra, C. V. Jawahar |
| 2024 | AAAI | Composite Sketch+Text Queries for Retrieving Objects with Elusive Names and Complex Interactions. | Prajwal Gatti, Kshitij Parikh, Dhriti Prasanna Paul, Manish Gupta, Anand Mishra |
| 2024 | AAAI | QDETRv: Query-Guided DETR for One-Shot Object Localization in Videos. | Yogesh Kumar, Saswat Mallick, Anand Mishra, Sowmya Rasipuram, Anutosh Maitra, Roshni R. Ramnani |
| 2024 | CVPR | Sketch-guided Image Inpainting with Partial Discrete Diffusion Process. | Nakul Sharma, Aditay Tripathi, Anirban Chakraborty, Anand Mishra |
| 2024 | EMNLP | Visual Text Matters: Improving Text-KVQA with Visual Text Entity Knowledge-aware Large Multimodal Assistant. | Abhirama Subramanyam Penamakuri, Anand Mishra |
| 2024 | ICPR | Show Me the World in My Language: Establishing the First Baseline for Scene-Text to Scene-Text Translation. | Shreyas Vaidya, Arvind Kumar Sharma, Prajwal Gatti, Anand Mishra |
| 2024 | WACV | Semantic Labels-Aware Transformer Model for Searching over a Large Collection of Lecture-Slides. | K. V. Jobin, Anand Mishra, C. V. Jawahar |
| 2024 | WACV | Query-guided Attention in Vision Transformers for Localizing Objects Using a Single Sketch. | Aditay Tripathi, Anand Mishra, Anirban Chakraborty |
| 2023 | CVPR | Few-Shot Referring Relationships in Videos. | Yogesh Kumar, Anand Mishra |
| 2023 | ICDAR | Towards Making Flowchart Images Machine Interpretable. | Shreya Shukla, Prajwal Gatti, Yogesh Kumar, Vikash Yadav, Anand Mishra |
| 2023 | IJCAI | Answer Mining from a Pool of Images: Towards Retrieval-Based Visual Question Answering. | Abhirama Subramanyam Penamakuri, Manish Gupta, Mithun Das Gupta, Anand Mishra |
| 2023 | WACV | Grounding Scene Graphs on Natural Images via Visio-Lingual Message Passing. | Aditay Tripathi, Anand Mishra, Anirban Chakraborty |
| 2022 | EMNLP | VisToT: Vision-Augmented Table-to-Text Generation. | Prajwal Gatti, Anand Mishra, Manish Gupta, Mithun Das Gupta |
| 2022 | IJCNLP | COFAR: Commonsense and Factual Reasoning in Image Search. | Prajwal Gatti, Abhirama Subramanyam Penamakuri, Revant Teotia, Anand Mishra, Shubhashis Sengupta, Roshni R. Ramnani |
| 2021 | ICCV | Few-Shot Visual Relationship Co-Localization. | Revant Teotia, Vaibhav Mishra, Mayank Maheshwari, Anand Mishra |
| 2021 | ICDAR | Look, Read and Ask: Learning to Ask Questions by Reading Text in Images. | Soumya Jahagirdar, Shankar Gangisetty, Anand Mishra |
| 2020 | ECCV | Sketch-Guided Object Localization in Natural Images. | Aditay Tripathi, Rajath R. Dani, Anand Mishra, Anirban Chakraborty |
| 2019 | AAAI | KVQA: Knowledge-Aware Visual Question Answering. | Sanket Shah, Anand Mishra, Naganand Yadati, Partha Pratim Talukdar |
| 2019 | ICCV | From Strings to Things: Knowledge-Enabled VQA Model That Can Read and Reason. | Ajeet Kumar Singh, Anand Mishra, Shashank Shekhar, Anirban Chakraborty |
| 2019 | ICDAR | OCR-VQA: Visual Question Answering by Reading Text in Images. | Anand Mishra, Shashank Shekhar, Ajeet Kumar Singh, Anirban Chakraborty |
| 2018 | ACCV | Deep Embedding Using Bayesian Risk Minimization with Application to Sketch Recognition. | Anand Mishra, Ajeet Kumar Singh |
| 2016 | DAS | A Simple and Effective Solution for Script Identification in the Wild. | Ajeet Kumar Singh, Anand Mishra, Pranav Dabral, C. V. Jawahar |
| 2016 | ECCV | IIIT-CFW: A Benchmark Database of Cartoon Faces in the Wild. | Ashutosh Mishra, Shyam Nandan Rai, Anand Mishra, C. V. Jawahar |
| 2016 | WACV | Efficient object annotation for surveillance and automotive applications. | Sirnam Swetha, Anand Mishra, Guruprasad M. Hegde, C. V. Jawahar |
| 2014 | ACCV | Scene Text Recognition and Retrieval for Large Lexicons. | Udit Roy, Anand Mishra, Karteek Alahari, C. V. Jawahar |
| 2013 | ICCV | Image Retrieval Using Textual Cues. | Anand Mishra, Karteek Alahari, C. V. Jawahar |
| 2013 | ICDAR | Whole is Greater than Sum of Parts: Recognizing Scene Text Words. | Vibhor Goel, Anand Mishra, Karteek Alahari, C. V. Jawahar |
| 2013 | ICDAR | Sparse Document Image Coding for Restoration. | Vijay Kumar, Amit Bansal, Goutam Hari Tulsiyan, Anand Mishra, Anoop M. Namboodiri, C. V. Jawahar |
| 2012 | BMVC | Scene Text Recognition using Higher Order Language Priors. | Anand Mishra, Karteek Alahari, C. V. Jawahar |
| 2012 | CVPR | Top-down and bottom-up cues for scene text recognition. | Anand Mishra, Karteek Alahari, C. V. Jawahar |
| 2011 | ICDAR | An MRF Model for Binarization of Natural Scene Text. | Anand Mishra, Karteek Alahari, C. V. Jawahar |
| 2010 | LREC | Using NLP Methods for the Analysis of Rituals. | Nils Reiter, Oliver Hellwig, Anand Mishra, Anette Frank, Jens Burkhardt |
| 1999 | IJCNN | Bayesian belief networks for effective troubleshooting. | Anand Mishra, Tlay Adali |