Skip to content

Ashish Seth

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

7

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLFIGMA: Towards FIne-Grained Music retrievAl.Nishit Anand, Ashish Seth, Sreyan Ghosh, Dinesh Manocha, Ramani Duraiswami
2026ACLPolyAudio: Advancing Multi-Audio Reasoning in Large Audio Language Models with Interleaved Multi-Audio Contexts.Sonal Kumar, Sreyan Ghosh, Yueqian Lin, S. Sakshi, Ashish Seth, Yiran Chen, Ramani Duraiswami, Dinesh Manocha
2025EMNLPMULTIVOX: A Benchmark for Evaluating Voice Assistants for Multimodal Interactions.Ramaneswaran Selvakumar, Ashish Seth, Nishit Anand, Utkarsh Tyagi, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha
2025EMNLPEGOILLUSION: Benchmarking Hallucinations in Egocentric Video Understanding.Ashish Seth, Utkarsh Tyagi, Ramaneswaran Selvakumar, Nishit Anand, Sonal Kumar, Sreyan Ghosh, Ramani Duraiswami, Chirag Agarwal, Dinesh Manocha
2025ICASSPTSPE: Task-Specific Prompt Ensemble for Improved Zero-Shot Audio Classification.Nishit Anand, Ashish Seth, Ramani Duraiswami, Dinesh Manocha
2025ICLRMMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark.S. Sakshi, Utkarsh Tyagi, Sonal Kumar, Ashish Seth, Ramaneswaran Selvakumar, Oriol Nieto, Ramani Duraiswami, Sreyan Ghosh, Dinesh Manocha
2025NAACLDo Audio-Language Models Understand Linguistic Variations?Ramaneswaran Selvakumar, Sonal Kumar, Hemant Kumar Giri, Nishit Anand, Ashish Seth, Sreyan Ghosh, Dinesh Manocha
2025NAACLPAT: Parameter-Free Audio-Text Aligner to Boost Zero-Shot Audio Classification.Ashish Seth, Ramaneswaran Selvakumar, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha
2024EMNLPGAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities.Sreyan Ghosh, Sonal Kumar, Ashish Seth, Chandra Kiran Reddy Evuru, Utkarsh Tyagi, S. Sakshi, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha
2024EMNLPEH-MAM: Easy-to-Hard Masked Acoustic Modeling for Self-Supervised Speech Representation Learning.Ashish Seth, Ramaneswaran Selvakumar, S. Sakshi, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha
2024ICASSPStable Distillation: Regularizing Continued Pre-Training for Low-Resource Automatic Speech Recognition.Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha
2024ICASSPFusDom: Combining in-Domain and Out-of-Domain Knowledge for Continuous Self-Supervised Learning.Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha
2024ICLRCompA: Addressing the Gap in Compositional Reasoning in Audio-Language Models.Sreyan Ghosh, Ashish Seth, Sonal Kumar, Utkarsh Tyagi, Chandra Kiran Reddy Evuru, Ramaneswaran S., Sakshi Singh, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha
2024InterspeechLipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition.Sreyan Ghosh, Sonal Kumar, Ashish Seth, Purva Chiniya, Utkarsh Tyagi, Ramani Duraiswami, Dinesh Manocha
2023CVPRDeAR: Debiasing Vision-Language Models with Additive Residuals.Ashish Seth, Mayur Hemani, Chirag Agarwal
2023ICASSPMAST: Multiscale Audio Spectrogram Transformers.Sreyan Ghosh, Ashish Seth, Srinivasan Umesh, Dinesh Manocha
2023ICASSPUnfused: Unsupervised Finetuning Using Self Supervised Distillation.Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha
2023ICASSPSLICER: Learning Universal Audio Representations Using Low-Resource Self-Supervised Pre-Training.Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha
2023InterspeechTechnology Pipeline for Large Scale Cross-Lingual Dubbing of Lecture Videos into Multiple Indian Languages.Anusha Prakash, Arun Kumar A, Ashish Seth, Bhagyashree Mukherjee, Ishika Gupta, Jom Kuriakose, Jordan Fernandes, K. V. Vikram, Mano Ranjith Kumar M., Metilda Sagaya Mary, Mohammad Wajahat, Mohana N, Mudit Batra, Navina K, Nihal John George, Nithya Ravi, Pruthwik Mishra, Sudhanshu Srivastava, Vasista Sai Lodagala, Vandan Mujadia, Kada Sai Venkata Vineeth, Vrunda N. Sukhadia, Dipti Misra Sharma, Hema A. Murthy, Pushpak Bhattacharyya, Srinivasan Umesh, Rajeev Sangal
2022InterspeechGram Vaani ASR Challenge on spontaneous telephone speech recordings in regional variations of Hindi.Anish Bhanushali, Grant Bridgman, Deekshitha G, Prasanta Kumar Ghosh, Pratik Kumar, Saurabh Kumar, Adithya Raj Kolladath, Nithya Ravi, Aaditeshwar Seth, Ashish Seth, Abhayjeet Singh, Vrunda N. Sukhadia, Srinivasan Umesh, Sathvik Udupa, Lodagala V. S. V. Durga Prasad
2021InterspeechDual Script E2E Framework for Multilingual and Code-Switching ASR.Mari Ganesh Kumar, Jom Kuriakose, Anand Thyagachandran, Arun Kumar A, Ashish Seth, Lodagala Durga Prasad, Saish Jaiswal, Anusha Prakash, Hema A. Murthy