| 2025 | ASRU | MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection. | Zihan Pan, Hardik B. Sailor, Jinyang Wu |
| 2025 | ASRU | Diversity and complementarity of speech encoders across diverse tasks in a multi-modal large language model. | Jeremy H. M. Wong, Muhammad Huzaifah, Hardik B. Sailor, Shuo Sun, Kye Min Tan, Bin Wang, Qiongqiong Wang, Wenyu Zhang, Xunlong Zou, Nancy F. Chen, Ai Ti Aw |
| 2025 | EMNLP | Benchmarking Contextual and Paralinguistic Reasoning in Speech-LLMs: A Case Study with In-the-Wild Data. | Qiongqiong Wang, Hardik B. Sailor, Tianchi Liu, Wenyu Zhang, Muhammad Huzaifah, Nattadaporn Lertcheva, Shuo Sun, Nancy F. Chen, Jinyang Wu, AiTi Aw |
| 2025 | Interspeech | Contextual Paralinguistic Data Creation for Multi-Modal Speech-LLM: Data Condensation and Spoken QA Generation. | Qiongqiong Wang, Hardik B. Sailor, Tianchi Liu, Ai Ti Aw |
| 2024 | Interspeech | Attentive Merging of Hidden Embeddings from Pre-trained Speech Model for Anti-spoofing Detection. | Zihan Pan, Tianchi Liu, Hardik B. Sailor, Qiongqiong Wang |
| 2022 | Interspeech | Spectral Modification Based Data Augmentation For Improving End-to-End ASR For Children's Speech. | Vishwanath Pratap Singh, Hardik B. Sailor, Supratik Bhattacharya, Abhishek Pandey |
| 2021 | ASRU | Warped Ensembles: A Novel Technique for Improving CTC Based End-to-End Speech Recognition. | Kiran Praveen, Hardik B. Sailor, Abhishek Pandey |
| 2021 | Interspeech | SRI-B End-to-End System for Multilingual and Code-Switching ASR Challenges for Low Resource Indian Languages. | Hardik B. Sailor, Kiran Praveen, Vikas Agrawal, Abhinav Jain, Abhishek Pandey |
| 2020 | Interspeech | Multilingual Speech Recognition Using Language-Specific Phoneme Recognition as Auxiliary Task for Indian Languages. | Hardik B. Sailor, Thomas Hain |
| 2019 | ASRU | Unsupervised Adaptation of Acoustic Models for ASR Using Utterance-Level Embeddings from Squeeze and Excitation Networks. | Hardik B. Sailor, Salil Deena, Md Asif Jalal, Rasa Lileikyte, Thomas Hain |
| 2019 | Interspeech | Whether to Pretrain DNN or not?: An Empirical Analysis for Voice Conversion. | Nirmesh J. Shah, Hardik B. Sailor, Hemant A. Patil |
| 2018 | Interspeech | DA-IICT/IIITV System for Low Resource Speech Recognition Challenge 2018. | Hardik B. Sailor, Maddala Venkata Siva Krishna, Diksha Chhabra, Ankur T. Patil, Madhu R. Kamble, Hemant A. Patil |
| 2018 | Interspeech | Auditory Filterbank Learning for Temporal Modulation Features in Replay Spoof Speech Detection. | Hardik B. Sailor, Madhu R. Kamble, Hemant A. Patil |
| 2018 | Interspeech | Auditory Filterbank Learning Using ConvRBM for Infant Cry Classification. | Hardik B. Sailor, Hemant A. Patil |
| 2017 | Interspeech | Unsupervised Filterbank Learning Using Convolutional Restricted Boltzmann Machine for Environmental Sound Classification. | Hardik B. Sailor, Dharmesh M. Agrawal, Hemant A. Patil |
| 2017 | Interspeech | Unsupervised Representation Learning Using Convolutional Restricted Boltzmann Machine for Spoof Speech Detection. | Hardik B. Sailor, Madhu R. Kamble, Hemant A. Patil |
| 2016 | ICASSP | Filterbank learning using Convolutional Restricted Boltzmann Machine for speech recognition. | Hardik B. Sailor, Hemant A. Patil |
| 2016 | Interspeech | Native Language Identification Using Spectral and Source-Based Features. | Avni Rajpal, Tanvina B. Patel, Hardik B. Sailor, Maulik C. Madhavi, Hemant A. Patil, Hiroya Fujisaki |
| 2016 | Interspeech | Unsupervised Deep Auditory Model Using Stack of Convolutional RBMs for Speech Recognition. | Hardik B. Sailor, Hemant A. Patil |
| 2014 | ICASSP | Effectiveness of PLP-based phonetic segmentation for speech synthesis. | Nirmesh J. Shah, Bhavik B. Vachhani, Hardik B. Sailor, Hemant A. Patil |