Skip to content

Srikar Appalaraju

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

18

Venues

8

Active years

2019–2025

Best venue rank

A*

Where they publish

Papers

18 indexed papers, newest first.

YearVenueTitleAuthors
2025ACLR-VLM: Region-Aware Vision Language Model for Precise GUI Grounding.Joonhyung Park, Peng Tang, Sagnik Das, Srikar Appalaraju, Kunwar Yashraj Singh, R. Manmatha, Shabnam Ghadar
2025ACLTurbocharging Web Automation: The Impact of Compressed History States.Xiyue Zhu, Peng Tang, Haofu Liao, Srikar Appalaraju
2025NAACLOn the Analysis and Distillation of Emergent Outlier Properties in Pre-trained Language Models.Tianyang Zhao, Kunwar Yashraj Singh, Srikar Appalaraju, Peng Tang, Ying Nian Wu, Li Erran Li
2024AAAIDocFormerv2: Local Features for Document Understanding.Srikar Appalaraju, Peng Tang, Qi Dong, Nishant Sankaran, Yichu Zhou, R. Manmatha
2024AAAINo Head Left Behind - Multi-Head Alignment Distillation for Transformers.Tianyang Zhao, Kunwar Yashraj Singh, Srikar Appalaraju, Peng Tang, Vijay Mahadevan, R. Manmatha, Ying Nian Wu
2024CVPREnhancing Vision-Language Pre-Training with Rich Supervisions.Yuan Gao, Kunyu Shi, Pengkai Zhu, Edouard Belval, Oren Nuriel, Srikar Appalaraju, Shabnam Ghadar, Zhuowen Tu, Vijay Mahadevan, Stefano Soatto
2024ECCVVisFocus: Prompt-Guided Vision Encoders for OCR-Free Dense Document Understanding.Ofir Abramovich, Niv Nayman, Sharon Fogel, Inbal Lavi, Ron Litman, Shahar Tsiper, Royee Tichauer, Srikar Appalaraju, Shai Mazor, R. Manmatha
2024EMNLPDocKD: Knowledge Distillation from LLMs for Open-World Document Understanding Models.Sungnyun Kim, Haofu Liao, Srikar Appalaraju, Peng Tang, Zhuowen Tu, Ravi Kumar Satzoda, R. Manmatha, Vijay Mahadevan, Stefano Soatto
2024NAACLMultiple-Question Multiple-Answer Text-VQA.Peng Tang, Srikar Appalaraju, R. Manmatha, Yusheng Xie, Vijay Mahadevan
2024NAACLDEED: Dynamic Early Exit on Decoder for Accelerating Encoder-Decoder Transformer Models.Peng Tang, Pengkai Zhu, Tian Li, Srikar Appalaraju, Vijay Mahadevan, R. Manmatha
2023EMNLPA Multi-Modal Multilingual Benchmark for Document Image Classification.Yoshinari Fujinuma, Siddharth Varia, Nishant Sankaran, Srikar Appalaraju, Bonan Min, Yogarshi Vyas
2023WACVMixGen: A New Multi-Modal Data Augmentation.Xiaoshuai Hao, Yi Zhu, Srikar Appalaraju, Aston Zhang, Wanqian Zhang, Bo Li, Mu Li
2022CVPRLaTr: Layout-Aware Transformer for Scene-Text VQA.Ali Furkan Biten, Ron Litman, Yusheng Xie, Srikar Appalaraju, R. Manmatha
2022ECCVYORO - Lightweight End to End Visual Grounding.Chih-Hui Ho, Srikar Appalaraju, Bhavan Jasani, R. Manmatha, Nuno Vasconcelos
2022WACVSeeTek: Very Large-Scale Open-set Logo Recognition with Text-Aware Metric Learning.Chenge Li, Istvn Fehrvri, Xiaonan Zhao, Ives Macdo, Srikar Appalaraju
2021ICCVDocFormer: End-to-End Transformer for Document Understanding.Srikar Appalaraju, Bhavan Jasani, Bhargava Urala Kota, Yusheng Xie, R. Manmatha
2021WACVSaliency Driven Perceptual Image Compression.Yash Patel, Srikar Appalaraju, R. Manmatha
2019WACVScalable Logo Recognition Using Proxies.Istvn Fehrvri, Srikar Appalaraju