| 2024 | ICASSP | Geodesic Interpolation of Frame-Wise Speaker Embeddings for the Diarization of Meeting Scenarios. | Tobias Cord-Landwehr, Christoph Bddeker, Catalin Zorila, Rama Doddipatla, Reinhold Haeb-Umbach |
| 2023 | ASRU | Towards a Unified End-to-End Language Understanding System for Speech and Text Inputs. | Mohan Li, Catalin Zorila, Cong-Thanh Do, Rama Doddipatla |
| 2023 | ICASSP | Frame-Wise and Overlap-Robust Speaker Embeddings for Meeting Diarization. | Tobias Cord-Landwehr, Christoph Bddeker, Catalin Zorila, Rama Doddipatla, Reinhold Haeb-Umbach |
| 2023 | ICASSP | On the Effectiveness of Monoaural Target Source Extraction for Distant end-to-end Automatic Speech Recognition. | Catalin Zorila, Rama Doddipatla |
| 2023 | Interspeech | A Teacher-Student Approach for Extracting Informative Speaker Embeddings From Speech Mixtures. | Tobias Cord-Landwehr, Christoph Bddeker, Catalin Zorila, Rama Doddipatla, Reinhold Haeb-Umbach |
| 2022 | ICASSP | Transformer-Based Streaming ASR with Cumulative Attention. | Mohan Li, Shucong Zhang, Catalin Zorila, Rama Doddipatla |
| 2022 | ICASSP | Speaker Reinforcement Using Target Source Extraction for Robust Automatic Speech Recognition. | Catalin Zorila, Rama Doddipatla |
| 2022 | Interspeech | Self-regularised Minimum Latency Training for Streaming Transformer-based Speech Recognition. | Mohan Li, Rama Sanand Doddipatla, Catalin Zorila |
| 2022 | Interspeech | On monoaural speech enhancement for automatic recognition of real noisy speech using mixture invariant training. | Jisi Zhang, Catalin Zorila, Rama Doddipatla, Jon Barker |
| 2021 | ICASSP | Head-Synchronous Decoding for Transformer-Based Streaming ASR. | Mohan Li, Catalin Zorila, Rama Doddipatla |
| 2021 | ICASSP | Time-Domain Speech Extraction with Spatial Information and Multi Speaker Conditioning Mechanism. | Jisi Zhang, Catalin Zorila, Rama Doddipatla, Jon Barker |
| 2021 | Interspeech | Teacher-Student MixIT for Unsupervised and Semi-Supervised Speech Separation. | Jisi Zhang, Catalin Zorila, Rama Doddipatla, Jon Barker |
| 2020 | ICASSP | On End-to-end Multi-channel Time Domain Speech Separation in Reverberant Environments. | Jisi Zhang, Catalin Zorila, Rama Doddipatla, Jon Barker |
| 2019 | ASRU | An Investigation into the Effectiveness of Enhancement in ASR Training and Test for Chime-5 Dinner Party Transcription. | Catalin Zorila, Christoph Bddeker, Rama Doddipatla, Reinhold Haeb-Umbach |
| 2019 | ICASSP | On Reducing the Effect of Speaker Overlap for Chime-5. | Catalin Zorila, Rama Doddipatla |