Skip to content

Gerasimos Potamianos

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

73

Venues

14

Active years

1991–2025

Best venue rank

A*

Where they publish

Papers

73 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPResource-Efficient and Noise-Robust Modality Fusion for Audio-Visual Speech Recognition.Alexandros Koumparoulis, Gerasimos Potamianos
2025ICCVSeeing in 2D, Thinking in 3D: 3D Hand Mesh-Guided Feature Learning for Continuous Fingerspelling.Katerina Papadimitriou, Panayiotis Paraskevas Filntisis, George Retsinas, Gerasimos Potamianos, Petros Maragos
2025ICCVControllable Single-Shot Animation Blending with Temporal Conditioning.Eleni Tselepi, Spyridon Thermos, Gerasimos Potamianos
2025InterspeechA Multi-Stream Framework Utilizing 3D Human Reconstruction for Cued Speech Recognition.Katerina Papadimitriou, Gerasimos Potamianos
2024InterspeechMultimodal Continuous Fingerspelling Recognition via Visual Alignment Learning.Katerina Papadimitriou, Gerasimos Potamianos
2023ICASSPSign Language Recognition via Deformable 3D Convolutions and Modulated Graph Convolutional Networks.Katerina Papadimitriou, Gerasimos Potamianos
2023ICASSPSL-REDU GSL: A Large Greek Sign Language Recognition Corpus.Katerina Papadimitriou, Galini Sapountzaki, Kyriaki Vasilaki, Eleni Efthimiou, Stavroula-Evita Fotinea, Gerasimos Potamianos
2023InterspeechMultimodal Locally Enhanced Transformer for Continuous Sign Language Recognition.Katerina Papadimitriou, Gerasimos Potamianos
2022ICASSPAccurate and Resource-Efficient Lipreading with Efficientnetv2 and Transformers.Alexandros Koumparoulis, Gerasimos Potamianos
2022ICASSPSpatio-Temporal Graph Convolutional Networks for Continuous Sign Language Recognition.Maria Parelli, Katerina Papadimitriou, Gerasimos Potamianos, Georgios Pavlakos, Petros Maragos
2021HCIThe SL-ReDu Environment for Self-monitoring and Objective Learner Assessment in Greek Sign Language.Eleni Efthimiou, Stavroula-Evita Fotinea, Christina Flouda, Theodore Goulas, Gkioulan Ametoglou, Galini Sapountzaki, Katerina Papadimitriou, Gerasimos Potamianos
2021HCIMultimodal Fusion and Sequence Learning for Cued Speech Recognition from Videos.Katerina Papadimitriou, Maria Parelli, Galini Sapountzaki, Georgios Pavlakos, Petros Maragos, Gerasimos Potamianos
2020ECCVEmotion Understanding in Videos Through Body, Context, and Visual-Semantic Embedding Loss.Panagiotis Paraskevas Filntisis, Niki Efthymiou, Gerasimos Potamianos, Petros Maragos
2020ECCVExploiting 3D Hand Pose Estimation in Deep Learning-Based Sign Language Recognition from RGB Videos.Maria Parelli, Katerina Papadimitriou, Gerasimos Potamianos, Georgios Pavlakos, Petros Maragos
2020ICASSPAudio-Assisted Image Inpainting for Talking Faces.Alexandros Koumparoulis, Gerasimos Potamianos, Samuel Thomas, Edmilson da Silva Morais
2020ICASSPA Deep Learning Approach to Object Affordance Segmentation.Spyridon Thermos, Petros Daras, Gerasimos Potamianos
2020InterspeechResource-Adaptive Deep Learning for Visual Speech Recognition.Alexandros Koumparoulis, Gerasimos Potamianos, Samuel Thomas, Edmilson da Silva Morais
2020InterspeechMultimodal Sign Language Recognition via Temporal Deformable Convolutional Sequence Learning.Katerina Papadimitriou, Gerasimos Potamianos
2019InterspeechMobiLipNet: Resource-Efficient Deep Learning Based Lipreading.Alexandros Koumparoulis, Gerasimos Potamianos
2019InterspeechEnd-to-End Convolutional Sequence Learning for ASL Fingerspelling Recognition.Katerina Papadimitriou, Gerasimos Potamianos
2018ICASSPFar-Field Audio-Visual Scene Perception of Multi-Party Human-Robot Interaction for Children and Adults.Antigoni Tsiami, Panagiotis Paraskevas Filntisis, Niki Efthymiou, Petros Koutras, Gerasimos Potamianos, Petros Maragos
2018ICIPMulti- View Fusion for Action Recognition in Child-Robot Interaction.Niki Efthymiou, Petros Koutras, Panagiotis Paraskevas Filntisis, Gerasimos Potamianos, Petros Maragos
2018ICIPAttention-Enhanced Sensorimotor Object Recognition.Spyridon Thermos, Georgios Th. Papadopoulos, Petros Daras, Gerasimos Potamianos
2018IROSObject Assembly Guidance in Child-Robot Interaction using RGB-D based 3D Tracking.Jack Hadfield, Petros Koutras, Niki Efthymiou, Gerasimos Potamianos, Costas S. Tzafestas, Petros Maragos
2018ICRAMulti3: Multi-Sensory Perception System for Multi-Modal Child Interaction with Multiple Robots.Antigoni Tsiami, Petros Koutras, Niki Efthymiou, Panagiotis Paraskevas Filntisis, Gerasimos Potamianos, Petros Maragos
2017CVPRDeep Affordance-Grounded Sensorimotor Object Recognition.Spyridon Thermos, Georgios Th. Papadopoulos, Petros Daras, Gerasimos Potamianos
2015ICASSPMultichannel speech enhancement using MEMS microphones.Z.-I. Skordilis, Antigoni Tsiami, Petros Maragos, Gerasimos Potamianos, Luca Spelgatti, Roberto Sannino
2015InterspeechDetecting audio-visual synchrony using deep neural networks.Etienne Marcheret, Gerasimos Potamianos, Josef Vopicka, Vaibhava Goel
2014ICASSPRobust far-field spoken command recognition for home automation combining adaptation and multichannel processing.Athanasios Katsamanis, Isidoros Rodomagoulakis, Gerasimos Potamianos, Petros Maragos, Antigoni Tsiami
2014InterspeechATHENA: a Greek multi-sensory database for home automation control uthor: isidoros rodomagoulakis (NTUA, Greece).Antigoni Tsiami, Isidoros Rodomagoulakis, Panagiotis Giannoulis, Athanasios Katsamanis, Gerasimos Potamianos, Petros Maragos
2013HCIRobust Multi-Modal Speech Recognition in Two Languages Utilizing Video and Distance Information from the Kinect.Georgios Galatas, Gerasimos Potamianos, Fillia Makedon
2012LRECA hierarchical approach with feature selection for emotion recognition from speech.Panagiotis Giannoulis, Gerasimos Potamianos
2010ICASSPJoint estimation of DOA and speech based on EM beamforming.Lae-Hoon Kim, Mark Hasegawa-Johnson, Gerasimos Potamianos, Vit Libal
2009ASRUAudio-visual automatic speech recognition and related bimodal speech technologies: A review of the state-of-the-art and open problems.Gerasimos Potamianos
2009CVPRAudio-visual speech synchronization detection using a bimodal linear prediction model.Kshitiz Kumar, Jir Navrtil, Etienne Marcheret, Vit Libal, Ganesh N. Ramaswamy, Gerasimos Potamianos
2009ICASSPLong-time span acoustic activity analysis from far-field sensors in smart homes.Jing Huang, Xiaodan Zhuang, Vit Libal, Gerasimos Potamianos
2009ICASSPAcoustic fall detection using Gaussian mixture models and GMM supervectors.Xiaodan Zhuang, Jing Huang, Gerasimos Potamianos, Mark Hasegawa-Johnson
2009InterspeechRobust audio-visual speech synchrony detection by generalized bimodal linear prediction.Kshitiz Kumar, Jir Navrtil, Etienne Marcheret, Vit Libal, Gerasimos Potamianos
2009IWANNMultimodal Classification of Activities of Daily Living Inside Smart Homes.Vit Libal, Bhuvana Ramabhadran, Nadia Mana, Fabio Pianesi, Paul Chippendale, Oswald Lanz, Gerasimos Potamianos
2008ICMIA multi-modal spoken dialog system for interactive TV.Rajesh Balchandran, Mark E. Epstein, Gerasimos Potamianos, Ladislav Serdi
2007CVPRKernel-Based 3D Tracking.Ambrish Tyagi, Mark A. Keck, James W. Davis, Gerasimos Potamianos
2007ICASSPDynamic Stream Weight Modeling for Audio-Visual Speech Recognition.Etienne Marcheret, Vit Libal, Gerasimos Potamianos
2007InterspeechDetection, diarization, and transcription of far-field lecture speech.Jing Huang, Etienne Marcheret, Karthik Visweswariah, Vit Libal, Gerasimos Potamianos
2007InterspeechA unified approach to multi-pose audio-visual ASR.Patrick Lucey, Gerasimos Potamianos, Sridha Sridharan
2007MMSPAn Embedded System for In-Vehicle Visual Speech Activity Detection.Vit Libal, Jonathan Connell, Gerasimos Potamianos, Etienne Marcheret
2006MMSPLipreading Using Profile Versus Frontal Views.Patrick Lucey, Gerasimos Potamianos
2005ICCVA Joint System for Person Tracking and Face Detection.ZhenQiu Zhang, Gerasimos Potamianos, Andrew W. Senior, Stephen M. Chu, Thomas S. Huang
2005InterspeechSpeech activity detection fusing acoustic phonetic and energy features.Etienne Marcheret, Karthik Visweswariah, Gerasimos Potamianos
2004ICASSPImproved face and feature finding for audio-visual speech recognition in visually challenging environments.Jintao Jiang, Gerasimos Potamianos, Harriet J. Nock, Giridharan Iyengar, Chalapathy Neti
2004ICASSPTowards practical deployment of audio-visual speech recognition.Gerasimos Potamianos, Chalapathy Neti, Jing Huang, Jonathan H. Connell, Stephen M. Chu, Vit Libal, Etienne Marcheret, Norman Haas, Jintao Jiang
2004InterspeechEfficient likelihood computation in multi-stream HMM based audio-visual speech recognition.Etienne Marcheret, Stephen M. Chu, Vaibhava Goel, Gerasimos Potamianos
2004InterspeechMutual information based visual feature selection for lipreading.Patricia Scanlon, Gerasimos Potamianos, Vit Libal, Stephen M. Chu
2003ICASSPAudio-visual speaker recognition using time-varying stream reliability prediction.Upendra V. Chaudhari, Ganesh N. Ramaswamy, Gerasimos Potamianos, Chalapathy Neti
2003ICASSPFrame-dependent multi-stream reliability indicators for audio-visual speech recognition.Ashutosh Garg, Gerasimos Potamianos, Chalapathy Neti, Thomas S. Huang
2003InterspeechAudio-visual speech recognition in challenging environments.Gerasimos Potamianos, Chalapathy Neti
2002ICASSPNoisy audio feature enhancement using audio-visual speech data.Roland Goecke, Gerasimos Potamianos, Chalapathy Neti
2002ICASSPMaximum entropy and MCE based HMM stream weight estimation for audio-visual ASR.Guillaume Gravier, Scott Axelrod, Gerasimos Potamianos, Chalapathy Neti
2002InterspeechAudio-visual speech enhancement with AVCDCN (audio-visual codebook dependent cepstral normalization).Sabine Deligne, Gerasimos Potamianos, Chalapathy Neti
2001ICASSPWeighting schemes for audio-visual fusion in speech recognition.Herv Glotin, D. Vergyr, Chalapathy Neti, Gerasimos Potamianos, Juergen Luettin
2001ICASSPAsynchronous stream modeling for large vocabulary audio-visual speech recognition.Juergen Luettin, Gerasimos Potamianos, Chalapathy Neti
2001ICASSPHierarchical discriminant features for audio-visual LVCSR.Gerasimos Potamianos, Juergen Luettin, Chalapathy Neti
2001ICIPImproved ROI and within frame discriminant features for lipreading.Gerasimos Potamianos, Chalapathy Neti
2001InterspeechLarge-vocabulary audio-visual speech recognition by machines and humans.Gerasimos Potamianos, Chalapathy Neti, Giridharan Iyengar, Eric Helmuth
2001MMSPRobust detection of visual ROI for automatic speechreading.Giridharan Iyengar, Gerasimos Potamianos, Chalapathy Neti, Tanveer A. Faruquie, Ashish Verma
2001MMSPLarge-vocabulary audio-visual speech recognition: a summary of the Johns Hopkins Summer 2000 Workshop.Chalapathy Neti, Gerasimos Potamianos, Juergen Luettin, Iain A. Matthews, Herv Glotin, Dimitra Vergyri
2000InterspeechPerceptual interfaces for information interaction: joint processing of audio and visual information for human-computer interaction.Chalapathy Neti, Giridharan Iyengar, Gerasimos Potamianos, Andrew W. Senior, Benot Maison
2000InterspeechStream confidence estimation for audio-visual speech recognition.Gerasimos Potamianos, Chalapathy Neti
1999InterspeechSpeaker adaptation for audio-visual speech recognition.Gerasimos Potamianos, Alexandros Potamianos
1998ICASSPDiscriminative training of HMM stream exponents for audio-visual speech recognition.Gerasimos Potamianos, Hans Peter Graf
1998ICIPAn Image Transform Approach for HMM based Automatic Lipreading.Gerasimos Potamianos, Hans Peter Graf, Eric Cosatto
1998MMSPLinear discriminant analysis for speechreading.Gerasimos Potamianos, Hans Peter Graf
1993ICASSPAn analysis of Monte Carlo methods for likelihood estimation of Gibbsian images.Gerasimos Potamianos, John Goutsias
1991ICASSPA novel method for computing the partition function of Markov random field images using Monte Carlo simulations.Gerasimos Potamianos, John Goutsias