| 2025 | WACV | A Video is Worth 10, 000 Words: Training and Benchmarking with Diverse Captions for Better Long Video Retrieval. | Matthew Gwilliam, Michael Cogswell, Meng Ye, Karan Sikka, Abhinav Shrivastava, Ajay Divakaran |
| 2024 | ACL | Demonstrations Are All You Need: Advancing Offensive Content Paraphrasing using In-Context Learning. | Anirudh Som, Karan Sikka, Helen Gent, Ajay Divakaran, Andreas Kathol, Dimitra Vergyri |
| 2024 | CVPR | DRESS : Instructing Large Vision-Language Models to Align and Interact with Humans via Natural Language Feedback. | Yangyi Chen, Karan Sikka, Michael Cogswell, Heng Ji, Ajay Divakaran |
| 2024 | EMNLP | Pelican: Correcting Hallucination in Vision-LLMs via Claim Decomposition and Program of Thought Verification. | Pritish Sahu, Karan Sikka, Ajay Divakaran |
| 2024 | ICAPS | SayNav: Grounding Large Language Models for Dynamic Planning to Navigation in New Environments. | Abhinav Rajvanshi, Karan Sikka, Xiao Lin, Bhoram Lee, Han-Pang Chiu, Alvaro Velasquez |
| 2024 | NAACL | Measuring and Improving Chain-of-Thought Reasoning in Vision-Language Models. | Yangyi Chen, Karan Sikka, Michael Cogswell, Heng Ji, Ajay Divakaran |
| 2023 | EACL | Multilingual Content Moderation: A Case Study on Reddit. | Meng Ye, Karan Sikka, Katherine Atwell, Sabit Hassan, Ajay Divakaran, Malihe Alikhani |
| 2023 | ICCV | TIJO: Trigger Inversion with Joint Optimization for Defending Multimodal Backdoored Models. | Indranil Sur, Karan Sikka, Matthew Walmer, Kaushik Koneripalli, Anirban Roy, Xiao Lin, Ajay Divakaran, Susmit Jha |
| 2023 | KDD | Predicting Information Pathways Across Online Communities. | Yiqiao Jin, Yeon-Chang Lee, Kartik Sharma, Meng Ye, Karan Sikka, Ajay Divakaran, Srijan Kumar |
| 2022 | CVPR | Dual-Key Multimodal Backdoors for Visual Question Answering. | Matthew Walmer, Karan Sikka, Indranil Sur, Abhinav Shrivastava, Susmit Jha |
| 2022 | WWW | MUWS'22: 1st International Workshop on Multimodal Understanding for the Web and Social Media. | Sherzod Hakimov, Gullal Singh Cheema, Marc A. Kastner, Rajiv Ratn Shah, Karan Sikka |
| 2022 | WACV | Challenges in Procedural Multimodal Machine Comprehension: A Novel Way To Benchmark. | Pritish Sahu, Karan Sikka, Ajay Divakaran |
| 2021 | ACSAC | MISA: Online Defense of Trojaned Models using Misattributions. | Panagiota Kiourti, Wenchao Li, Anirban Roy, Karan Sikka, Susmit Jha |
| 2019 | BMVC | Semantically-Aware Attentive Neural Embeddings for 2D Long-Term Visual Localization. | Zachary Seymour, Karan Sikka, Han-Pang Chiu, Supun Samarasekera, Rakesh Kumar |
| 2019 | EMNLP | Integrating Text and Image: Determining Multimodal Document Intent in Instagram Posts. | Julia Kruk, Jonah Lubin, Karan Sikka, Xiao Lin, Dan Jurafsky, Ajay Divakaran |
| 2019 | EMNLP | Sunny and Dark Outside?! Improving Answer Consistency in VQA through Entailed Question Generation. | Arijit Ray, Karan Sikka, Ajay Divakaran, Stefan Lee, Giedrius Burachas |
| 2019 | ICCV | Align2Ground: Weakly Supervised Phrase Grounding Guided by Image-Caption Alignment. | Samyak Datta, Karan Sikka, Anirban Roy, Karuna Ahuja, Devi Parikh, Ajay Divakaran |
| 2018 | ECCV | Zero-Shot Object Detection. | Ankan Bansal, Karan Sikka, Gaurav Sharma, Rama Chellappa, Ajay Divakaran |
| 2017 | CVPR | AdaScan: Adaptive Scan Pooling in Deep Convolutional Neural Networks for Human Action Recognition in Videos. | Amlan Kar, Nishant Rai, Karan Sikka, Gaurav Sharma |
| 2016 | CVPR | LOMo: Latent Ordinal Model for Facial Analysis in Videos. | Karan Sikka, Gaurav Sharma, Marian Stewart Bartlett |
| 2015 | BMVC | Deep Q-learning for Active Recognition of GERMS: Baseline performance on a standardized dataset for active learning. | Mohsen Malmir, Karan Sikka, Deborah Forster, Javier R. Movellan, Garison Cottrell |
| 2015 | BMVC | Joint Clustering and Classification for Multiple Instance Learning. | Karan Sikka, Ritwik Giri, Marian Stewart Bartlett |
| 2015 | CVPR | Exemplar Hidden Markov Models for classification of facial expressions in videos. | Karan Sikka, Abhinav Dhall, Marian Stewart Bartlett |
| 2014 | ICMI | Emotion Recognition In The Wild Challenge 2014: Baseline, Data and Protocol. | Abhinav Dhall, Roland Goecke, Jyoti Joshi, Karan Sikka, Tom Gedeon |
| 2014 | ICMI | Facial Expression Analysis for Estimating Pain in Clinical Settings. | Karan Sikka |
| 2014 | WACV | A discriminative parts based model approach for fiducial points free and shape constrained head pose normalisation in the wild. | Abhinav Dhall, Karan Sikka, Gwen Littlewort, Roland Goecke, Marian Stewart Bartlett |
| 2014 | WACV | A discriminative parts based model approach for fiducial points free and shape constrained head pose normalisation in the wild. | Abhinav Dhall, Karan Sikka, Gwen Littlewort, Roland Goecke, Marian Stewart Bartlett |
| 2013 | ICMI | Multiple kernel learning for emotion recognition in the wild. | Karan Sikka, Karmen Dykstra, Suchitra Sathyanarayana, Gwen Littlewort, Marian Stewart Bartlett |
| 2012 | ECCV | Exploring Bag of Words Architectures in the Facial Expression Domain. | Karan Sikka, Tingfan Wu, Joshua M. Susskind, Marian Stewart Bartlett |