Ashish Seth
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
7
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | FIGMA: Towards FIne-Grained Music retrievAl. | Nishit Anand, Ashish Seth, Sreyan Ghosh, Dinesh Manocha, Ramani Duraiswami |
| 2026 | ACL | PolyAudio: Advancing Multi-Audio Reasoning in Large Audio Language Models with Interleaved Multi-Audio Contexts. | Sonal Kumar, Sreyan Ghosh, Yueqian Lin, S. Sakshi, Ashish Seth, Yiran Chen, Ramani Duraiswami, Dinesh Manocha |
| 2025 | EMNLP | MULTIVOX: A Benchmark for Evaluating Voice Assistants for Multimodal Interactions. | Ramaneswaran Selvakumar, Ashish Seth, Nishit Anand, Utkarsh Tyagi, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha |
| 2025 | EMNLP | EGOILLUSION: Benchmarking Hallucinations in Egocentric Video Understanding. | Ashish Seth, Utkarsh Tyagi, Ramaneswaran Selvakumar, Nishit Anand, Sonal Kumar, Sreyan Ghosh, Ramani Duraiswami, Chirag Agarwal, Dinesh Manocha |
| 2025 | ICASSP | TSPE: Task-Specific Prompt Ensemble for Improved Zero-Shot Audio Classification. | Nishit Anand, Ashish Seth, Ramani Duraiswami, Dinesh Manocha |
| 2025 | ICLR | MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark. | S. Sakshi, Utkarsh Tyagi, Sonal Kumar, Ashish Seth, Ramaneswaran Selvakumar, Oriol Nieto, Ramani Duraiswami, Sreyan Ghosh, Dinesh Manocha |
| 2025 | NAACL | Do Audio-Language Models Understand Linguistic Variations? | Ramaneswaran Selvakumar, Sonal Kumar, Hemant Kumar Giri, Nishit Anand, Ashish Seth, Sreyan Ghosh, Dinesh Manocha |
| 2025 | NAACL | PAT: Parameter-Free Audio-Text Aligner to Boost Zero-Shot Audio Classification. | Ashish Seth, Ramaneswaran Selvakumar, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha |
| 2024 | EMNLP | GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities. | Sreyan Ghosh, Sonal Kumar, Ashish Seth, Chandra Kiran Reddy Evuru, Utkarsh Tyagi, S. Sakshi, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2024 | EMNLP | EH-MAM: Easy-to-Hard Masked Acoustic Modeling for Self-Supervised Speech Representation Learning. | Ashish Seth, Ramaneswaran Selvakumar, S. Sakshi, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha |
| 2024 | ICASSP | Stable Distillation: Regularizing Continued Pre-Training for Low-Resource Automatic Speech Recognition. | Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha |
| 2024 | ICASSP | FusDom: Combining in-Domain and Out-of-Domain Knowledge for Continuous Self-Supervised Learning. | Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha |
| 2024 | ICLR | CompA: Addressing the Gap in Compositional Reasoning in Audio-Language Models. | Sreyan Ghosh, Ashish Seth, Sonal Kumar, Utkarsh Tyagi, Chandra Kiran Reddy Evuru, Ramaneswaran S., Sakshi Singh, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2024 | Interspeech | LipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition. | Sreyan Ghosh, Sonal Kumar, Ashish Seth, Purva Chiniya, Utkarsh Tyagi, Ramani Duraiswami, Dinesh Manocha |
| 2023 | CVPR | DeAR: Debiasing Vision-Language Models with Additive Residuals. | Ashish Seth, Mayur Hemani, Chirag Agarwal |
| 2023 | ICASSP | MAST: Multiscale Audio Spectrogram Transformers. | Sreyan Ghosh, Ashish Seth, Srinivasan Umesh, Dinesh Manocha |
| 2023 | ICASSP | Unfused: Unsupervised Finetuning Using Self Supervised Distillation. | Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha |
| 2023 | ICASSP | SLICER: Learning Universal Audio Representations Using Low-Resource Self-Supervised Pre-Training. | Ashish Seth, Sreyan Ghosh, Srinivasan Umesh, Dinesh Manocha |
| 2023 | Interspeech | Technology Pipeline for Large Scale Cross-Lingual Dubbing of Lecture Videos into Multiple Indian Languages. | Anusha Prakash, Arun Kumar A, Ashish Seth, Bhagyashree Mukherjee, Ishika Gupta, Jom Kuriakose, Jordan Fernandes, K. V. Vikram, Mano Ranjith Kumar M., Metilda Sagaya Mary, Mohammad Wajahat, Mohana N, Mudit Batra, Navina K, Nihal John George, Nithya Ravi, Pruthwik Mishra, Sudhanshu Srivastava, Vasista Sai Lodagala, Vandan Mujadia, Kada Sai Venkata Vineeth, Vrunda N. Sukhadia, Dipti Misra Sharma, Hema A. Murthy, Pushpak Bhattacharyya, Srinivasan Umesh, Rajeev Sangal |
| 2022 | Interspeech | Gram Vaani ASR Challenge on spontaneous telephone speech recordings in regional variations of Hindi. | Anish Bhanushali, Grant Bridgman, Deekshitha G, Prasanta Kumar Ghosh, Pratik Kumar, Saurabh Kumar, Adithya Raj Kolladath, Nithya Ravi, Aaditeshwar Seth, Ashish Seth, Abhayjeet Singh, Vrunda N. Sukhadia, Srinivasan Umesh, Sathvik Udupa, Lodagala V. S. V. Durga Prasad |
| 2021 | Interspeech | Dual Script E2E Framework for Multilingual and Code-Switching ASR. | Mari Ganesh Kumar, Jom Kuriakose, Anand Thyagachandran, Arun Kumar A, Ashish Seth, Lodagala Durga Prasad, Saish Jaiswal, Anusha Prakash, Hema A. Murthy |