Skip to content

Ahmed Hussen Abdelaziz

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

33

Venues

7

Active years

2012–2025

Best venue rank

A*

Where they publish

Papers

33 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPSpeaker-IPL: Unsupervised Learning of Speaker Characteristics with i-Vector based Pseudo-Labels.Zakaria Aldeneh, Takuya Higuchi, Jee-Weon Jung, Li-Wei Chen, Stephen Shum, Ahmed Hussen Abdelaziz, Shinji Watanabe, Tatiana Likhomanenko, Barry-John Theobald
2025ICASSPExploring Prediction Targets in Masked Pre-Training for Speech Foundation Models.Li-Wei Chen, Takuya Higuchi, He Bai, Ahmed Hussen Abdelaziz, Shinji Watanabe, Alexander Rudnicky, Tatiana Likhomanenko, Barry-John Theobald, Zakaria Aldeneh
2025ICMLA Variational Framework for Improving Naturalness in Generative Spoken Language Models.Li-Wei Chen, Takuya Higuchi, Zakaria Aldeneh, Ahmed Hussen Abdelaziz, Alexander Rudnicky
2025InterspeechDiceHuBERT: Distilling HuBERT with a Self-Supervised Learning Objective.Hyung-Gun Chi, Zakaria Aldeneh, Tatiana Likhomanenko, Oggi Rudovic, Takuya Higuchi, Li-Wei Chen, Shinji Watanabe, Ahmed Hussen Abdelaziz
2025InterspeechAdaptive Knowledge Distillation for Device-Directed Speech Detection.Hyung-Gun Chi, Florian Pesce, Wonil Chang, Oggi Rudovic, Arturo Argueta, Stefan Braun, Vineet Garg, Ahmed Hussen Abdelaziz
2024ICASSPModality Drop-Out for Multimodal Device Directed Speech Detection Using Verbal and Non-Verbal Features.Gautam Krishna, Sameer Dharur, Oggi Rudovic, Pranay Dighe, Saurabh Adya, Ahmed Hussen Abdelaziz, Ahmed H. Tewfik
2024InterspeechCan you Remove the Downstream Model for Speaker Recognition with Self-Supervised Speech Features?Zakaria Aldeneh, Takuya Higuchi, Jee-weon Jung, Skyler Seto, Tatiana Likhomanenko, Stephen Shum, Ahmed Hussen Abdelaziz, Shinji Watanabe, Barry-John Theobald
2024InterspeechComparative Analysis of Personalized Voice Activity Detection Systems: Assessing Real-World Effectiveness.Sai Srujana Buddi, Satyam Kumar, Utkarsh Oggy Sarawgi, Vineet Garg, Shivesh Ranjan, Ognjen Rudovic, Ahmed Hussen Abdelaziz, Saurabh Adya
2024InterspeechESPnet-SPK: full pipeline speaker embedding toolkit with reproducible recipes, self-supervised front-ends, and off-the-shelf models.Jee-weon Jung, Wangyou Zhang, Jiatong Shi, Zakaria Aldeneh, Takuya Higuchi, Alex Gichamba, Barry-John Theobald, Ahmed Hussen Abdelaziz, Shinji Watanabe
2024InterspeechMultimodal Large Language Models with Fusion Low Rank Adaptation for Device Directed Speech Detection.Shruti Palaskar, Ognjen Rudovic, Sameer Dharur, Florian Pesce, Gautam Krishna, Aswin Sivaraman, Jack Berkowitz, Ahmed Hussen Abdelaziz, Saurabh Adya, Ahmed H. Tewfik
2023ICASSPLess Is More: A Unified Architecture for Device-Directed Speech Detection with Multiple Invocation Types.Oggi Rudovic, Wonil Chang, Vineet Garg, Pranay Dighe, Pramod Simha, Jack Berkowitz, Ahmed Hussen Abdelaziz, Sachin Kajarekar, Erik Marchi, Saurabh Adya
2022InterspeechDevice-Directed Speech Detection: Regularization via Distillation for Weakly-Supervised Models.Vineet Garg, Ognjen Rudovic, Pranay Dighe, Ahmed Hussen Abdelaziz, Erik Marchi, Saurabh Adya, Chandra Dhir, Ahmed H. Tewfik
2021BMVCMorphGAN: One-Shot Face Synthesis GAN for Detecting Recognition Bias.Nataniel Ruiz, Barry-John Theobald, Anurag Ranjan, Ahmed Hussen Abdelaziz, Nicholas Apostoloff
2021ICASSPOn The Role of Visual Cues in Audiovisual Speech Enhancement.Zakaria Aldeneh, Anushree Prasanna Kumar, Barry-John Theobald, Erik Marchi, Sachin Kajarekar, Devang Naik, Ahmed Hussen Abdelaziz
2021ICMIAudiovisual Speech Synthesis using Tacotron2.Ahmed Hussen Abdelaziz, Anushree Prasanna Kumar, Chloe Seivwright, Gabriele Fanelli, Justin Binder, Yannis Stylianou, Sachin Kajareker
2020ICMIModality Dropout for Improved Performance-driven Talking Faces.Ahmed Hussen Abdelaziz, Barry-John Theobald, Paul Dixon, Reinhard Knothe, Nicholas Apostoloff, Sachin Kajareker
2019ICMISpeaker-Independent Speech-Driven Visual Speech Synthesis using Domain-Adapted Acoustic Models.Ahmed Hussen Abdelaziz, Barry-John Theobald, Justin Binder, Gabriele Fanelli, Paul Dixon, Nicholas Apostoloff, Thibaut Weise, Sachin Kajareker
2017InterspeechTurbo Decoders for Audio-Visual Continuous Speech Recognition.Ahmed Hussen Abdelaziz
2017InterspeechNTCD-TIMIT: A New Database and Baseline for Noise-Robust Audio-Visual Speech Recognition.Ahmed Hussen Abdelaziz
2016ICASSPTwin-HMM-based non-intrusive speech intelligibility prediction.Mahdie Karbasi, Ahmed Hussen Abdelaziz, Dorothea Kolossa
2016InterspeechDynamic Stream Weighting for Turbo-Decoding-Based Audiovisual ASR.Sebastian Gergen, Steffen Zeiler, Ahmed Hussen Abdelaziz, Robert M. Nickel, Dorothea Kolossa
2016InterspeechBlind Non-Intrusive Speech Intelligibility Prediction Using Twin-HMMs.Mahdie Karbasi, Ahmed Hussen Abdelaziz, Hendrik Meutzner, Dorothea Kolossa
2016InterspeechIntroducing the Turbo-Twin-HMM for Audio-Visual Speech Enhancement.Steffen Zeiler, Hendrik Meutzner, Ahmed Hussen Abdelaziz, Dorothea Kolossa
2015InterspeechUncertainty propagation through deep neural networks.Ahmed Hussen Abdelaziz, Shinji Watanabe, John R. Hershey, Emmanuel Vincent, Dorothea Kolossa
2015InterspeechRobust speech processing using observation uncertainty and uncertainty propagation: session and paper overview.Ramn Fernandez Astudillo, Shinji Watanabe, Ahmed Hussen Abdelaziz, Dorothea Kolossa
2014HRIHuman-robot collaborative tutoring using multiparty multimodal spoken dialogue.Samer Al Moubayed, Jonas Beskow, Bajibabu Bollepalli, Joakim Gustafson, Ahmed Hussen Abdelaziz, Martin Johansson, Maria Koutsombogera, Jos David guas Lopes, Jekaterina Novikova, Catharine Oertel, Gabriel Skantze, Kalin Stefanov, Gl Varol
2014ICASSPA newem estimationof dynamic stream weights for coupled-HMM-based audio-visual ASR.Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa
2014InterspeechDynamic stream weight estimation in coupled-HMM-based audio-visual speech recognition using multilayer perceptrons.Ahmed Hussen Abdelaziz, Dorothea Kolossa
2014LRECThe Tutorbot Corpus ― A Corpus for Studying Tutoring Behaviour in Multiparty Face-to-Face Spoken Dialogue.Maria Koutsombogera, Samer Al Moubayed, Bajibabu Bollepalli, Ahmed Hussen Abdelaziz, Martin Johansson, Jos David guas Lopes, Jekaterina Novikova, Catharine Oertel, Kalin Stefanov, Gl Varol
2013ICASSPTwin-HMM-based audio-visual speech enhancement.Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa
2013ICASSPGMM-based significance decoding.Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa, Volker Leutnant, Reinhold Haeb-Umbach
2013InterspeechUsing twin-HMM-based audio-visual speech enhancement as a front-end for robust audio-visual speech recognition.Ahmed Hussen Abdelaziz, Steffen Zeiler, Dorothea Kolossa
2012InterspeechDecoding of Uncertain Features Using the Posterior Distribution of the Clean Data for Robust Speech Recognition.Ahmed Hussen Abdelaziz, Dorothea Kolossa