| 2026 | AAAI | PatientVLM Meets DocVLM: Pre-Consultation Dialogue Between Vision-Language Models for Efficient Diagnosis. | K. Lokesh, Abhirama Subramanyam Penamakuri, Uday Agarwal, Apoorva Challa, Shreya K. Gowda, Somesh Gupta, Anand Mishra |
| 2025 | EMNLP | When Big Models Train Small Ones: Label-Free Model Parity Alignment for Efficient Visual Question Answering using Small VLMs. | Abhirama Subramanyam Penamakuri, Navlika Singh, Piyush Arora, Anand Mishra |
| 2025 | ICASSP | Audiopedia: Audio QA with Knowledge. | Abhirama Subramanyam Penamakuri, Kiran Chhatre, Akshat Jain |
| 2024 | EMNLP | Visual Text Matters: Improving Text-KVQA with Visual Text Entity Knowledge-aware Large Multimodal Assistant. | Abhirama Subramanyam Penamakuri, Anand Mishra |
| 2023 | IJCAI | Answer Mining from a Pool of Images: Towards Retrieval-Based Visual Question Answering. | Abhirama Subramanyam Penamakuri, Manish Gupta, Mithun Das Gupta, Anand Mishra |
| 2022 | IJCNLP | COFAR: Commonsense and Factual Reasoning in Image Search. | Prajwal Gatti, Abhirama Subramanyam Penamakuri, Revant Teotia, Anand Mishra, Shubhashis Sengupta, Roshni R. Ramnani |