Ahmed Hussen Abdelaziz
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
33
Venues
7
Active years
2012–2025
Best venue rank
A*
Where they publish
Papers
33 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Speaker-IPL: Unsupervised Learning of Speaker Characteristics with i-Vector based Pseudo-Labels. | Zakaria Aldeneh, Takuya Higuchi, Jee-Weon Jung, Li-Wei Chen, Stephen Shum, Ahmed Hussen Abdelaziz, Shinji Watanabe, Tatiana Likhomanenko, Barry-John Theobald |
| 2025 | ICASSP | Exploring Prediction Targets in Masked Pre-Training for Speech Foundation Models. | Li-Wei Chen, Takuya Higuchi, He Bai, Ahmed Hussen Abdelaziz, Shinji Watanabe, Alexander Rudnicky, Tatiana Likhomanenko, Barry-John Theobald, Zakaria Aldeneh |
| 2025 | ICML | A Variational Framework for Improving Naturalness in Generative Spoken Language Models. | Li-Wei Chen, Takuya Higuchi, Zakaria Aldeneh, Ahmed Hussen Abdelaziz, Alexander Rudnicky |
| 2025 | Interspeech | DiceHuBERT: Distilling HuBERT with a Self-Supervised Learning Objective. | Hyung-Gun Chi, Zakaria Aldeneh, Tatiana Likhomanenko, Oggi Rudovic, Takuya Higuchi, Li-Wei Chen, Shinji Watanabe, Ahmed Hussen Abdelaziz |
| 2025 | Interspeech | Adaptive Knowledge Distillation for Device-Directed Speech Detection. | Hyung-Gun Chi, Florian Pesce, Wonil Chang, Oggi Rudovic, Arturo Argueta, Stefan Braun, Vineet Garg, Ahmed Hussen Abdelaziz |
| 2024 | ICASSP | Modality Drop-Out for Multimodal Device Directed Speech Detection Using Verbal and Non-Verbal Features. | Gautam Krishna, Sameer Dharur, Oggi Rudovic, Pranay Dighe, Saurabh Adya, Ahmed Hussen Abdelaziz, Ahmed H. Tewfik |
| 2024 | Interspeech | Can you Remove the Downstream Model for Speaker Recognition with Self-Supervised Speech Features? | Zakaria Aldeneh, Takuya Higuchi, Jee-weon Jung, Skyler Seto, Tatiana Likhomanenko, Stephen Shum, Ahmed Hussen Abdelaziz, Shinji Watanabe, Barry-John Theobald |
| 2024 | Interspeech | Comparative Analysis of Personalized Voice Activity Detection Systems: Assessing Real-World Effectiveness. | Sai Srujana Buddi, Satyam Kumar, Utkarsh Oggy Sarawgi, Vineet Garg, Shivesh Ranjan, Ognjen Rudovic, Ahmed Hussen Abdelaziz, Saurabh Adya |
| 2024 | Interspeech | ESPnet-SPK: full pipeline speaker embedding toolkit with reproducible recipes, self-supervised front-ends, and off-the-shelf models. | Jee-weon Jung, Wangyou Zhang, Jiatong Shi, Zakaria Aldeneh, Takuya Higuchi, Alex Gichamba, Barry-John Theobald, Ahmed Hussen Abdelaziz, Shinji Watanabe |
| 2024 | Interspeech | Multimodal Large Language Models with Fusion Low Rank Adaptation for Device Directed Speech Detection. | Shruti Palaskar, Ognjen Rudovic, Sameer Dharur, Florian Pesce, Gautam Krishna, Aswin Sivaraman, Jack Berkowitz, Ahmed Hussen Abdelaziz, Saurabh Adya, Ahmed H. Tewfik |
| 2023 | ICASSP | Less Is More: A Unified Architecture for Device-Directed Speech Detection with Multiple Invocation Types. | Oggi Rudovic, Wonil Chang, Vineet Garg, Pranay Dighe, Pramod Simha, Jack Berkowitz, Ahmed Hussen Abdelaziz, Sachin Kajarekar, Erik Marchi, Saurabh Adya |
| 2022 | Interspeech | Device-Directed Speech Detection: Regularization via Distillation for Weakly-Supervised Models. | Vineet Garg, Ognjen Rudovic, Pranay Dighe, Ahmed Hussen Abdelaziz, Erik Marchi, Saurabh Adya, Chandra Dhir, Ahmed H. Tewfik |
| 2021 | BMVC | MorphGAN: One-Shot Face Synthesis GAN for Detecting Recognition Bias. | Nataniel Ruiz, Barry-John Theobald, Anurag Ranjan, Ahmed Hussen Abdelaziz, Nicholas Apostoloff |
| 2021 | ICASSP | On The Role of Visual Cues in Audiovisual Speech Enhancement. | Zakaria Aldeneh, Anushree Prasanna Kumar, Barry-John Theobald, Erik Marchi, Sachin Kajarekar, Devang Naik, Ahmed Hussen Abdelaziz |
| 2021 | ICMI | Audiovisual Speech Synthesis using Tacotron2. | Ahmed Hussen Abdelaziz, Anushree Prasanna Kumar, Chloe Seivwright, Gabriele Fanelli, Justin Binder, Yannis Stylianou, Sachin Kajareker |
| 2020 | ICMI | Modality Dropout for Improved Performance-driven Talking Faces. | Ahmed Hussen Abdelaziz, Barry-John Theobald, Paul Dixon, Reinhard Knothe, Nicholas Apostoloff, Sachin Kajareker |
| 2019 | ICMI | Speaker-Independent Speech-Driven Visual Speech Synthesis using Domain-Adapted Acoustic Models. | Ahmed Hussen Abdelaziz, Barry-John Theobald, Justin Binder, Gabriele Fanelli, Paul Dixon, Nicholas Apostoloff, Thibaut Weise, Sachin Kajareker |
| 2017 | Interspeech | Turbo Decoders for Audio-Visual Continuous Speech Recognition. | Ahmed Hussen Abdelaziz |
| 2017 | Interspeech | NTCD-TIMIT: A New Database and Baseline for Noise-Robust Audio-Visual Speech Recognition. | Ahmed Hussen Abdelaziz |
| 2016 | ICASSP | Twin-HMM-based non-intrusive speech intelligibility prediction. | Mahdie Karbasi, Ahmed Hussen Abdelaziz, Dorothea Kolossa |
| 2016 | Interspeech | Dynamic Stream Weighting for Turbo-Decoding-Based Audiovisual ASR. | Sebastian Gergen, Steffen Zeiler, Ahmed Hussen Abdelaziz, Robert M. Nickel, Dorothea Kolossa |
| 2016 | Interspeech | Blind Non-Intrusive Speech Intelligibility Prediction Using Twin-HMMs. | Mahdie Karbasi, Ahmed Hussen Abdelaziz, Hendrik Meutzner, Dorothea Kolossa |
| 2016 | Interspeech | Introducing the Turbo-Twin-HMM for Audio-Visual Speech Enhancement. | Steffen Zeiler, Hendrik Meutzner, Ahmed Hussen Abdelaziz, Dorothea Kolossa |
| 2015 | Interspeech | Uncertainty propagation through deep neural networks. | Ahmed Hussen Abdelaziz, Shinji Watanabe, John R. Hershey, Emmanuel Vincent, Dorothea Kolossa |
| 2015 | Interspeech | Robust speech processing using observation uncertainty and uncertainty propagation: session and paper overview. | Ramn Fernandez Astudillo, Shinji Watanabe, Ahmed Hussen Abdelaziz, Dorothea Kolossa |
| 2014 | HRI | Human-robot collaborative tutoring using multiparty multimodal spoken dialogue. | Samer Al Moubayed, Jonas Beskow, Bajibabu Bollepalli, Joakim Gustafson, Ahmed Hussen Abdelaziz, Martin Johansson, Maria Koutsombogera, Jos David guas Lopes, Jekaterina Novikova, Catharine Oertel, Gabriel Skantze, Kalin Stefanov, Gl Varol |
| 2014 | ICASSP | A newem estimationof dynamic stream weights for coupled-HMM-based audio-visual ASR. | Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa |
| 2014 | Interspeech | Dynamic stream weight estimation in coupled-HMM-based audio-visual speech recognition using multilayer perceptrons. | Ahmed Hussen Abdelaziz, Dorothea Kolossa |
| 2014 | LREC | The Tutorbot Corpus ― A Corpus for Studying Tutoring Behaviour in Multiparty Face-to-Face Spoken Dialogue. | Maria Koutsombogera, Samer Al Moubayed, Bajibabu Bollepalli, Ahmed Hussen Abdelaziz, Martin Johansson, Jos David guas Lopes, Jekaterina Novikova, Catharine Oertel, Kalin Stefanov, Gl Varol |
| 2013 | ICASSP | Twin-HMM-based audio-visual speech enhancement. | Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa |
| 2013 | ICASSP | GMM-based significance decoding. | Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa, Volker Leutnant, Reinhold Haeb-Umbach |
| 2013 | Interspeech | Using twin-HMM-based audio-visual speech enhancement as a front-end for robust audio-visual speech recognition. | Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa |
| 2012 | Interspeech | Decoding of Uncertain Features Using the Posterior Distribution of the Clean Data for Robust Speech Recognition. | Ahmed Hussen Abdelaziz, Dorothea Kolossa |