Skip to content

Tuomas Virtanen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

77

Venues

8

Active years

2000–2025

Best venue rank

Multiconference

Where they publish

Papers

77 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPGen-A: Generalizing Ambisonics Neural Encoding to Unseen Microphone Arrays.Mikko Heikkinen, Archontis Politis, Konstantinos Drossos, Tuomas Virtanen
2025ICASSPA decade of DCASE: Achievements, practices, evaluations and future challenges.Annamaria Mesaros, Romain Serizel, Toni Heittola, Tuomas Virtanen, Mark D. Plumbley
2025InterspeechInter-Speaker Relative Cues for Text-Guided Target Speech Extraction.Wang Dai, Archontis Politis, Tuomas Virtanen
2025InterspeechAttractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers.Yuzhu Wang, Archontis Politis, Konstantinos Drossos, Tuomas Virtanen
2024ICASSPNeural Ambisonics Encoding For Compact Irregular Microphone Arrays.Mikko Heikkinen, Archontis Politis, Tuomas Virtanen
2024ICASSPAttention-Driven Multichannel Speech Enhancement in Moving Sound Source Scenarios.Yuzhu Wang, Archontis Politis, Tuomas Virtanen
2023ICASSPOn Negative Sampling for Contrastive Audio-Text Retrieval.Huang Xie, Okko Rsnen, Tuomas Virtanen
2023InterspeechFew-shot Class-incremental Audio Classification Using Adaptively-refined Prototypes.Wei Xie, Yanxiong Li, Qianhua He, Wenchang Cao, Tuomas Virtanen
2022ICASSPUnsupervised Audio-Caption Aligning Learns Correspondences Between Individual Sound Events and Textual Phrases.Huang Xie, Okko Rsnen, Konstantinos Drossos, Tuomas Virtanen
2022MMSPDomestic Activity Clustering from Audio via Depthwise Separable Convolutional Autoencoder Network.Yanxiong Li, Wenchang Cao, Konstantinos Drossos, Tuomas Virtanen
2022MMSPSubjective Evaluation of Deep Neural Network Based Speech Enhancement Systems in Real-World Conditions.Gaurav Naithani, Kirsi Pietil, Riitta Niemist, Erkki Paajanen, Tero Takala, Tuomas Virtanen
2021ICASSPLearning Contextual Tag Embeddings for Cross-Modal Alignment of Audio and Tags.Xavier Favory, Konstantinos Drossos, Tuomas Virtanen, Xavier Serra
2021ICASSPA Curated Dataset of Urban Scenes for Audio-Visual Scene Analysis.Shanshan Wang, Annamaria Mesaros, Toni Heittola, Tuomas Virtanen
2021ICASSPZero-Shot Audio Classification with Factored Linear and Nonlinear Acoustic-Semantic Projections.Huang Xie, Okko Rsnen, Tuomas Virtanen
2021ICMITowards Sonification in Multimodal and User-friendlyExplainable Artificial Intelligence.Bjrn W. Schuller, Tuomas Virtanen, Maria Riveiro, Georgios Rizos, Jing Han, Annamaria Mesaros, Konstantinos Drossos
2020ICASSPClotho: an Audio Captioning Dataset.Konstantinos Drossos, Samuel Lipping, Tuomas Virtanen
2020ICASSPSound Event Detection Via Dilated Convolutional Recurrent Neural Networks.Yanxiong Li, Mingle Liu, Konstantinos Drossos, Tuomas Virtanen
2020IJCNNSound Event Detection with Depthwise Separable and Dilated Convolutions.Konstantinos Drossos, Stylianos I. Mimilakis, Shayan Gharib, Yanxiong Li, Tuomas Virtanen
2020MMSPDepthwise Separable Convolutions Versus Recurrent Neural Networks for Monaural Singing Voice Separation.Pyry Pyykknen, Stylianos I. Mimilakis, Konstantinos Drossos, Tuomas Virtanen
2019ICASSPSound Event Envelope Estimation in Polyphonic Mixtures.Irene Martn-Morat, Annamaria Mesaros, Toni Heittola, Tuomas Virtanen, Maximo Cobos, Francesc J. Ferri
2019ICASSPLow-latency Deep Clustering for Speech Separation.Shanshan Wang, Gaurav Naithani, Tuomas Virtanen
2019IJCNNDetection of Typical Pronunciation Errors in Non-native English Speech Using Convolutional Recurrent Neural Networks.Aleksandr Diment, Eemi Fagerlund, Adrian Benfield, Tuomas Virtanen
2018ICASSPBayesian Anisotropic Gaussian Model for Audio Source Separation.Paul Magron, Tuomas Virtanen
2018ICASSPMonaural Singing Voice Separation with Skip-Filtering Connections and Recurrent Inference of Time-Frequency Mask.Stylianos Ioannis Mimilakis, Konstantinos Drossos, Joo Felipe Santos, Gerald Schuller, Tuomas Virtanen, Yoshua Bengio
2018ICASSPEstimation of Time-Varying Room Impulse Responses of Multiple Sound Sources from Observed Mixture and Isolated Source Signals.Joonas Nikunen, Tuomas Virtanen
2018IJCNNMultichannel Sound Event Detection Using 3D Convolutional Neural Networks for Learning Inter-channel Features.Sharath Adavanne, Archontis Politis, Tuomas Virtanen
2018IJCNNEnd-to-End Polyphonic Sound Event Detection Using Convolutional Recurrent Neural Networks with Learned Time-Frequency Representation Input.Emre Cakir, Tuomas Virtanen
2018IJCNNMaD TwinNet: Masker-Denoiser Architecture with Twin Networks for Monaural Sound Source Separation.Konstantinos Drossos, Stylianos Ioannis Mimilakis, Dmitriy Serdyuk, Gerald Schuller, Tuomas Virtanen, Yoshua Bengio
2018InterspeechReducing Interference with Phase Recovery in DNN-based Monaural Singing Voice Separation.Paul Magron, Konstantinos Drossos, Stylianos Ioannis Mimilakis, Tuomas Virtanen
2018InterspeechExpectation-Maximization Algorithms for Itakura-Saito Nonnegative Matrix Factorization.Paul Magron, Tuomas Virtanen
2017ICASSPSound event detection using spatial features and convolutional recurrent neural network.Sharath Adavanne, Pasi Pertil, Tuomas Virtanen
2017ICASSPActive learning for sound event classification by clustering unlabeled data.Shuyang Zhao, Toni Heittola, Tuomas Virtanen
2017IJCNNA convolutional neural network approach for acoustic scene classification.Michele Valenti, Stefano Squartini, Aleksandr Diment, Giambattista Parascandolo, Tuomas Virtanen
2016ICASSPRecurrent neural networks for polyphonic sound event detection in real life recordings.Giambattista Parascandolo, Heikki Huttunen, Tuomas Virtanen
2016IJCNNFilterbank learning for deep neural network based polyphonic sound event detection.Emre Cakir, Ezgi Can Ozan, Tuomas Virtanen
2015ICASSPExemplar-based speech enhancement for deep neural network based automatic speech recognition.Deepak Baby, Jort F. Gemmeke, Tuomas Virtanen, Hugo Van hamme
2015ICASSPLow-latency sound-source-separation using non-negative matrix factorisation with coupled analysis and synthesis dictionaries.Tom Barker, Tuomas Virtanen, Niels Henrik Pontoppidan
2015ICASSPSimilarity induced group sparsity for non-negative matrix factorisation.Antti Hurmalainen, Rahim Saeidi, Tuomas Virtanen
2015ICASSPSound event detection in real life recordings using coupled matrix factorization of spectral representations and class activity annotations.Annamaria Mesaros, Toni Heittola, Onur Dikmen, Tuomas Virtanen
2015IJCNNPolyphonic sound event detection using multi label deep neural networks.Emre Cakir, Toni Heittola, Heikki Huttunen, Tuomas Virtanen
2015InterspeechNoise robust speaker recognition with convolutive sparse coding.Antti Hurmalainen, Rahim Saeidi, Tuomas Virtanen
2014ACCVLifelog Scene Change Detection Using Cascades of Audio and Video Detectors.Katariina Mahkonen, Joni-Kristian Kmrinen, Tuomas Virtanen
2014ICASSPCoupled dictionary training for exemplar-based speech enhancement.Deepak Baby, Tuomas Virtanen, Tom Barker, Hugo Van hamme
2014ICASSPUltrasound-coupled semi-supervised nonnegative matrix factorisation for speech enhancement.Tom Barker, Tuomas Virtanen, Olivier Delhomme
2014ICASSPMultichannel audio separation by direction of arrival based spatial covariance model and non-negative matrix factorization.Joonas Nikunen, Tuomas Virtanen
2014ICASSPActive-set newton algorithm for non-negative sparse coding of audio.Tuomas Virtanen, Bhiksha Raj, Jort F. Gemmeke, Hugo Van hamme
2014IJCNNSemi-supervised non-negative tensor factorisation of modulation spectrograms for monaural speech separation.Tom Barker, Tuomas Virtanen
2014InterspeechModelling primitive streaming of simple tone sequences through factorisation of modulation pattern tensors.Tom Barker, Hugo Van hamme, Tuomas Virtanen
2013ASRULearning state labels for sparse classification of speech with matrix deconvolution.Antti Hurmalainen, Tuomas Virtanen
2013ICASSPExemplar-based joint channel and noise compensation.Jort F. Gemmeke, Tuomas Virtanen, Kris Demuynck
2013ICASSPSupervised model training for overlapping sound events based on unsupervised source separation.Toni Heittola, Annamaria Mesaros, Tuomas Virtanen, Moncef Gabbouj
2013InterspeechNon-negative tensor factorisation of modulation spectrograms for monaural sound source separation.Tom Barker, Tuomas Virtanen
2013InterspeechExemplar-based unit selection for voice conversion utilizing temporal information.Zhizheng Wu, Tuomas Virtanen, Tomi Kinnunen, Engsiong Chng, Haizhou Li
2012ICASSPModelling spectro-temporal dynamics in factorisation-based noise-robust automatic speech recognition.Antti Hurmalainen, Tuomas Virtanen
2012ICASSPNon-negative matrix factorization for highly noise-robust ASR: To enhance or to recognize?Felix Weninger, Martin Wllmer, Jrgen T. Geiger, Bjrn W. Schuller, Jort F. Gemmeke, Antti Hurmalainen, Tuomas Virtanen, Gerhard Rigoll
2012InterspeechGroup Sparsity for Speaker Identity Discrimination in Factorisation-based Speech Recognition.Antti Hurmalainen, Rahim Saeidi, Tuomas Virtanen
2012InterspeechHuman sound perception - what can we learn from it when developing audio analysis algorithms?Tuomas Virtanen
2011ICASSPNon-negative matrix deconvolution in noise robust speech recognition.Antti Hurmalainen, Jort F. Gemmeke, Tuomas Virtanen
2011InterspeechUncertainty Measures for Improving Exemplar-Based Source Separation.Heikki Kallasjoki, Ulpu Remes, Jort F. Gemmeke, Tuomas Virtanen, Kalle J. Palomki
2011InterspeechMapping Sparse Representation to State Likelihoods in Noise-Robust Automatic Speech Recognition.Katariina Mahkonen, Antti Hurmalainen, Tuomas Virtanen, Jort F. Gemmeke
2011InterspeechPhoneme-Dependent NMF for Speech Enhancement in Monaural Mixtures.Bhiksha Raj, Rita Singh, Tuomas Virtanen
2010ICASSPNoise robust exemplar-based connected digit recognition.Jort F. Gemmeke, Tuomas Virtanen
2010ICASSPSound source separation in monaural music signals using excitation-filter model and em algorithm.Anssi Klapuri, Tuomas Virtanen, Toni Heittola
2010ICASSPRecognition of phonemes and words in singing.Annamaria Mesaros, Tuomas Virtanen
2010ICASSPNoise-to-mask ratio minimization by weighted non-negative matrix factorization.Joonas Nikunen, Tuomas Virtanen
2010InterspeechArtificial and online acquired noise dictionaries for noise robust ASR.Jort F. Gemmeke, Tuomas Virtanen
2010InterspeechNon-negative matrix factorization based compensation of music for automatic speech recognition.Bhiksha Raj, Tuomas Virtanen, Sourish Chaudhuri, Rita Singh
2010InterspeechState-based labelling for a sparse representation of speech and its application to robust speech recognition.Tuomas Virtanen, Jort F. Gemmeke, Antti Hurmalainen
2009ICASSPInterpolating hidden Markov model and its application to automatic instrument recognition.Tuomas Virtanen, Toni Heittola
2009IDAMixtures of Gamma Priors for Non-negative Matrix Factorization Based Speech Separation.Tuomas Virtanen, Ali Taylan Cemgil
2008ICASSPBayesian extensions to non-negative matrix factorisation for audio signal modelling.Tuomas Virtanen, Ali Taylan Cemgil, Simon J. Godsill
2008InterspeechCombining pitch-based inference and non-negative spectrogram factorization in separating vocals from polyphonic music.Tuomas Virtanen, Annamaria Mesaros, Matti Ryynnen
2007ICASSPQuery by Example of Audio Signals using Euclidean Distance Between Gaussian Mixture Models.Marko Leonard Heln, Tuomas Virtanen
2006InterspeechSpeech recognition using factorial hidden Markov models for separation in the feature space.Tuomas Virtanen
2004InterspeechSeparation of sound sources by convolutive sparse coding.Tuomas Virtanen
2002ICASSPSeparation of harmonic sounds using linear models for the overtone series.Tuomas Virtanen, Anssi Klapuri
2000ICASSPSeparation of harmonic sound sources using sinusoidal modeling.Tuomas Virtanen, Anssi Klapuri