Skip to content

Florian Metze

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

163

Venues

17

Active years

2000–2026

Best venue rank

A*

Where they publish

Papers

163 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLAligning Paralinguistic Understanding and Generation in Speech LLMs via Multi-Task Reinforcement Learning.Minseok Kim, Jingxiang Chen, Seong-Gyun Leem, Yin Huang, Rashi Rungta, Zhicheng Ouyang, Haibin Wu, Surya Teja Appini, Ankur Bansal, Yang Bai, Yue Liu, Florian Metze, Ahmed Aly, Anuj Kumar, Ariya Rastrow, Zhaojiang Lin
2025ASRULong-Form Fuzzy Speech-to-Text Alignment for 1000+ Languages.Ruizhe Huang, Xiaohui Zhang, Zhaoheng Ni, Moto Hira, Jeff Hwang, Vineel Pratap, Ju Lin, Ming Sun, Florian Metze
2025ASRUMMW: Side Talk Rejection Multi-Microphone Whisper On Smart Glasses.Yang Liu, Li Wan, Yiteng Huang, Yong Xu, Yangyang Shi, Saurabh Adya, Ming Sun, Florian Metze
2025InterspeechDirectional Speech Recognition with Full-Duplex Capability.Ju Lin, Yiteng Huang, Ming Sun, Frank Seide, Florian Metze
2025InterspeechMASV: Speaker Verification with Global and Local Context Mamba.Yang Liu, Li Wan, Yiteng Huang, Ming Sun, Xinhao Mei, Xubo Liu, Yangyang Shi, Florian Metze
2025InterspeechThinking in Directivity: Speech Large Language Model for Multi-Talker Directional Speech Recognition.Jiamin Xie, Ju Lin, Yiteng Huang, Tyler Vuong, Zhaojiang Lin, Zhaojun Yang, Peng Su, Prashant Rawat, Sangeeta Srivastava, Ming Sun, Florian Metze
2024ICASSPAudio-Journey: Open Domain Latent Diffusion Based Text-To-Audio Generation.Jackson Michaels, Juncheng B. Li, Laura Yao, Lijun Yu, Zach Wood-Doughty, Florian Metze
2023EACLCTC Alignments Improve Autoregressive Translation.Brian Yan, Siddharth Dalmia, Yosuke Higuchi, Graham Neubig, Florian Metze, Alan W. Black, Shinji Watanabe
2022ACLZero-shot Learning for Grapheme to Phoneme Conversion with Language Ensemble.Xinjian Li, Florian Metze, David R. Mortensen, Shinji Watanabe, Alan W. Black
2022CVPRSelf-supervised object detection from audio-visual correspondence.Triantafyllos Afouras, Yuki M. Asano, Francois Fagan, Andrea Vedaldi, Florian Metze
2022EMNLPToken-level Sequence Labeling for Spoken Language Understanding using Compositional End-to-End Models.Siddhant Arora, Siddharth Dalmia, Brian Yan, Florian Metze, Alan W. Black, Shinji Watanabe
2022EMNLPOn Advances in Text Generation from Images Beyond Captioning: A Case Study in Self-Rationalization.Shruti Palaskar, Akshita Bhagia, Yonatan Bisk, Florian Metze, Alan W. Black, Ana Marasovic
2022EMNLPNormalized Contrastive Learning for Text-Video Retrieval.Yookoon Park, Mahmoud Azab, Seungwhan Moon, Bo Xiong, Florian Metze, Gourab Kundu, Ahmed Kirmani
2022ICASSPOn Adversarial Robustness Of Large-Scale Audio Visual Learning.Juncheng B. Li, Shuhui Qu, Xinjian Li, Bernie Po-Yao Huang, Florian Metze
2022ICASSPEnd-to-End Speech Summarization Using Restricted Self-Attention.Roshan Sharma, Shruti Palaskar, Alan W. Black, Florian Metze
2022InterspeechAudioTagging Done Right: 2nd comparison of deep learning methods for environmental sound classification.Juncheng Li, Shuhui Qu, Po-Yao Huang, Florian Metze
2022InterspeechASR2K: Speech Recognition for Around 2000 Languages without Audio.Xinjian Li, Florian Metze, David R. Mortensen, Alan W. Black, Shinji Watanabe
2022LRECPhone Inventories and Recognition for Every Language.Xinjian Li, Florian Metze, David R. Mortensen, Alan W. Black, Shinji Watanabe
2021ACLVLM: Task-agnostic Video-Language Model Pre-training for Video Understanding.Hu Xu, Gargi Ghosh, Po-Yao Huang, Prahal Arora, Masoumeh Aminzadeh, Christoph Feichtenhofer, Florian Metze, Luke Zettlemoyer
2021CVPRHow2Sign: A Large-Scale Multimodal Dataset for Continuous American Sign Language.Amanda Cardoso Duarte, Shruti Palaskar, Lucas Ventura, Deepti Ghadiyaram, Kenneth DeHaan, Florian Metze, Jordi Torres, Xavier Gir-i-Nieto
2021EACLNoiseQA: Challenge Set Evaluation for User-Centric Question Answering.Abhilasha Ravichander, Siddharth Dalmia, Maria Ryskina, Florian Metze, Eduard H. Hovy, Alan W. Black
2021EMNLPVideoCLIP: Contrastive Pre-training for Zero-shot Video-Text Understanding.Hu Xu, Gargi Ghosh, Po-Yao Huang, Dmytro Okhonko, Armen Aghajanyan, Florian Metze, Luke Zettlemoyer, Christoph Feichtenhofer
2021ICASSPPhone Distribution Estimation for Low Resource Languages.Xinjian Li, Juncheng Li, Jiali Yao, Alan W. Black, Florian Metze
2021ICASSPMultilingual Phonetic Dataset for Low Resource Speech Recognition.Xinjian Li, David R. Mortensen, Florian Metze, Alan W. Black
2021ICASSPAudio-Visual Event Recognition Through the Lens of Adversary.Juncheng B. Li, Kaixin Ma, Shuhui Qu, Po-Yao Huang, Florian Metze
2021ICCVSpace-Time Crop & Attend: Improving Cross-modal Video Representation Learning.Mandela Patrick, Po-Yao Huang, Ishan Misra, Florian Metze, Andrea Vedaldi, Yuki M. Asano, Joo F. Henriques
2021ICLRSupport-set bottlenecks for video-text representation learning.Mandela Patrick, Po-Yao Huang, Yuki Markus Asano, Florian Metze, Alexander G. Hauptmann, Joo F. Henriques, Andrea Vedaldi
2021InterspeechRethinking End-to-End Evaluation of Decomposable Tasks: A Case Study on Spoken Language Understanding.Siddhant Arora, Alissa Ostapenko, Vijay Viswanathan, Siddharth Dalmia, Florian Metze, Shinji Watanabe, Alan W. Black
2021InterspeechHierarchical Phone Recognition with Compositional Phonetics.Xinjian Li, Juncheng Li, Florian Metze, Alan W. Black
2021InterspeechMultimodal Speech Summarization Through Semantic Concept Learning.Shruti Palaskar, Ruslan Salakhutdinov, Alan W. Black, Florian Metze
2021InterspeechDifferentiable Allophone Graphs for Language-Universal Speech Recognition.Brian Yan, Siddharth Dalmia, David R. Mortensen, Florian Metze, Shinji Watanabe
2021NAACLSearchable Hidden Intermediates for End-to-End Models of Decomposable Sequence Tasks.Siddharth Dalmia, Brian Yan, Vikas Raunak, Florian Metze, Shinji Watanabe
2021NAACLMultilingual Multimodal Pre-training for Zero-Shot Cross-Lingual Transfer of Vision-Language Models.Poyao Huang, Mandela Patrick, Junjie Hu, Graham Neubig, Florian Metze, Alex Hauptmann
2020AAAITowards Zero-Shot Learning for Automatic Phonemic Transcription.Xinjian Li, Siddharth Dalmia, David R. Mortensen, Juncheng Li, Alan W. Black, Florian Metze
2020EMNLPOn Long-Tailed Phenomena in Neural Machine Translation.Vikas Raunak, Siddharth Dalmia, Vivek Gupta, Florian Metze
2020EMNLPFine-Grained Grounding for Multimodal Speech Recognition.Tejas Srinivasan, Ramon Sanabria, Florian Metze, Desmond Elliott
2020ICASSPUniversal Phone Recognition with a Multilingual Allophone System.Xinjian Li, Siddharth Dalmia, Juncheng Li, Matthew Lee, Patrick Littell, Jiali Yao, Antonios Anastasopoulos, David R. Mortensen, Graham Neubig, Alan W. Black, Florian Metze
2020ICASSPASR Error Correction and Domain Adaptation Using Machine Translation.Anirudh Mani, Shruti Palaskar, Nimshi Venkat Meripo, Sandeep Konam, Florian Metze
2020ICASSPLooking Enhances Listening: Recovering Missing Speech Using Images.Tejas Srinivasan, Ramon Sanabria, Florian Metze
2020InterspeechContextual RNN-T for Open Domain ASR.Mahaveer Jain, Gil Keren, Jay Mahadeokar, Geoffrey Zweig, Florian Metze, Yatharth Saraf
2020InterspeechTowards Context-Aware End-to-End Code-Switching Speech Recognition.Zimeng Qiu, Yiyuan Li, Xinjian Li, Florian Metze, William M. Campbell
2020LRECAlloVera: A Multilingual Allophone Database.David R. Mortensen, Xinjian Li, Patrick Littell, Alexis Michaud, Shruti Rijhwani, Antonios Anastasopoulos, Alan W. Black, Florian Metze, Graham Neubig
2019ACLGated Embeddings in End-to-End Speech Recognition for Conversational-Context Fusion.Suyoun Kim, Siddharth Dalmia, Florian Metze
2019ACLMultimodal Abstractive Summarization for How2 Videos.Shruti Palaskar, Jindrich Libovick, Spandana Gella, Florian Metze
2019ICASSPA Comparison of Five Multiple Instance Learning Pooling Functions for Sound Event Detection with Weak Labeling.Yun Wang, Juncheng Li, Florian Metze
2019ICASSPConnectionist Temporal Localization for Sound Event Detection with Sequential Labeling.Yun Wang, Florian Metze
2019ICASSPMultimodal Grounding for Sequence-to-sequence Speech Recognition.Ozan Caglayan, Ramon Sanabria, Shruti Palaskar, Loc Barrault, Florian Metze
2019ICASSPPhoneme Level Language Models for Sequence Based Low Resource ASR.Siddharth Dalmia, Xinjian Li, Alan W. Black, Florian Metze
2019ICASSPLearning from Multiview Correlations in Open-domain Videos.Nils Holzenberger, Shruti Palaskar, Pranava Madhyastha, Florian Metze, Raman Arora
2019ICASSPLearned in Speech Recognition: Contextual Acoustic Word Embeddings.Shruti Palaskar, Vikas Raunak, Florian Metze
2019INLGOn Leveraging the Visual Modality for Neural Machine Translation.Vikas Raunak, Sang Keun Choe, Quanyang Lu, Yi Xu, Florian Metze
2019InterspeechCross-Attention End-to-End ASR for Two-Party Conversations.Suyoun Kim, Siddharth Dalmia, Florian Metze
2019InterspeechMultilingual Speech Recognition with Corpus Relatedness Sampling.Xinjian Li, Siddharth Dalmia, Alan W. Black, Florian Metze
2019InterspeechSANTLR: Speech Annotation Toolkit for Low Resource Languages.Xinjian Li, Zhong Zhou, Siddharth Dalmia, Alan W. Black, Florian Metze
2019InterspeechSurvey Talk: Multimodal Processing of Speech and Language.Florian Metze
2019NAACLAcoustic-to-Word Models with Conversational Context Information.Suyoun Kim, Florian Metze
2018ICASSPSequence-Based Multi-Lingual Low Resource Speech Recognition.Siddharth Dalmia, Ramon Sanabria, Florian Metze, Alan W. Black
2018ICASSPA Light-Weight Multimodal Framework for Improved Environmental Audio Tagging.Juncheng Li, Yun Wang, Joseph Szurley, Florian Metze, Samarjit Das
2018ICASSPEnd-to-end Multimodal Speech Recognition.Shruti Palaskar, Ramon Sanabria, Florian Metze
2018ICASSPEnhancement and Analysis of Conversational Speech: JSALT 2017.Neville Ryant, Elika Bergelson, Kenneth Church, Alejandrina Cristi, Jun Du, Sriram Ganapathy, Sanjeev Khudanpur, Diana Kowalski, Mahesh Krishnamoorthy, Rajat Kulshreshta, Mark Y. Liberman, Yu-Ding Lu, Matthew Maciejewski, Florian Metze, Jn Profant, Lei Sun, Yu Tsao, Zhou Yu
2018ICASSPLinguistic Unit Discovery from Multi-Modal Inputs in Unwritten Languages: Summary of the "Speaking Rosetta" JSALT 2017 Workshop.Odette Scharenborg, Laurent Besacier, Alan W. Black, Mark Hasegawa-Johnson, Florian Metze, Graham Neubig, Sebastian Stker, Pierre Godard, Markus Mller, Lucas Ondel, Shruti Palaskar, Philip Arthur, Francesco Ciannella, Mingxing Du, Elin Larsen, Danny Merkx, Rachid Riad, Liming Wang, Emmanuel Dupoux
2018InterspeechThe ACLEW DiViMe: An Easy-to-use Diarization Tool.Adrien Le Franc, Eric Riebling, Julien Karadayi, Yun Wang, Camila Scaff, Florian Metze, Alejandrina Cristi
2018InterspeechMultiple Instance Deep Learning for Weakly Supervised Small-Footprint Audio Event Detection.Shao-Yen Tseng, Juncheng Li, Yun Wang, Florian Metze, Joseph Szurley, Samarjit Das
2018InterspeechComparing the Max and Noisy-Or Pooling Functions in Multiple Instance Learning for Weakly Supervised Sequence Learning Tasks.Yun Wang, Juncheng Li, Florian Metze
2018InterspeechSubword and Crossword Units for CTC Acoustic Models.Thomas Zenkel, Ramon Sanabria, Florian Metze, Alex Waibel
2018LRECAnnotating High-Level Structures of Short Stories and Personal Anecdotes.Boyang Li, Beth Cardier, Tong Wang, Florian Metze
2017ICASSPVisual features for context-aware speech recognition.Abhinav Gupta, Yajie Miao, Leonardo Neves, Florian Metze
2017ICASSPA comparison of Deep Learning methods for environmental sound detection.Juncheng Li, Wei Dai, Florian Metze, Shuhui Qu, Samarjit Das
2017ICASSPA first attempt at polyphonic sound event detection using connectionist temporal classification.Yun Wang, Florian Metze
2017InterspeechA Transfer Learning Based Feature Extractor for Polyphonic Sound Event Detection Using Connectionist Temporal Classification.Yun Wang, Florian Metze
2017InterspeechComparison of Decoding Strategies for CTC Acoustic Models.Thomas Zenkel, Ramon Sanabria, Florian Metze, Jan Niehues, Matthias Sperber, Sebastian Stker, Alex Waibel
2016ICASSPAn empirical exploration of CTC acoustic models.Yajie Miao, Mohammad Gowayyed, Xingyu Na, Tom Ko, Florian Metze, Alexander Waibel
2016ICASSPAudio-based multimedia event detection using deep recurrent neural networks.Yun Wang, Leonardo Neves, Florian Metze
2016InterspeechExperiences with Shared Resources for Research and Education in Speech and Language Processing.Rebecca Bates, Eric Fosler-Lussier, Florian Metze, Martha A. Larson, Gina-Anne Levow, Emily Mower Provost
2016InterspeechManipulating Word Lattices to Incorporate Human Corrections.Yashesh Gaur, Florian Metze, Jeffrey P. Bigham
2016InterspeechVirtual Machines and Containers as a Platform for Experimentation.Florian Metze, Eric Riebling, Anne S. Warlaumont, Elika Bergelson
2016InterspeechOpen-Domain Audio-Visual Speech Recognition: A Deep Learning Approach.Yajie Miao, Florian Metze
2015ASRUEESEN: End-to-end speech recognition using deep RNN models and WFST-based decoding.Yajie Miao, Mohammad Gowayyed, Florian Metze
2015ICASSPQUESST2014: Evaluating Query-by-Example Speech Search in a zero-resource setting with real-life queries.Xavier Anguera, Luis Javier Rodrguez-Fuentes, Andi Buzo, Florian Metze, Igor Szke, Mikel Peagarikano
2015ICASSPSemi-supervised training in low-resource ASR and KWS.Florian Metze, Ankur Gandhe, Yajie Miao, Zaid Sheikh, Yun Wang, Di Xu, Hao Zhang, Jungsuk Kim, Ian R. Lane, Wonkyum Lee, Sebastian Stker, Markus Mller
2015ICASSPRegularizing DNN acoustic models with Gaussian stochastic neurons.Hao Zhang, Yajie Miao, Florian Metze
2015InterspeechUsing keyword spotting to help humans correct captioning faster.Yashesh Gaur, Florian Metze, Yajie Miao, Jeffrey P. Bigham
2015InterspeechThe speech recognition virtual kitchen turns one.Florian Metze, Eric Riebling, Eric Fosler-Lussier, Andrew R. Plummer, Rebecca Bates
2015InterspeechDistance-aware DNNs for robust speech recognition.Yajie Miao, Florian Metze
2015InterspeechOn speaker adaptation of long short-term memory recurrent neural networks.Yajie Miao, Florian Metze
2014ACLSemantics for Large-Scale Multimedia: New Challenges for NLP.Florian Metze, Koichi Shinoda
2014EACLAugmenting Translation Models with Simulated Acoustic Confusions for Improved Spoken Language Translation.Yulia Tsvetkov, Florian Metze, Chris Dyer
2014ICASSPOptimization of Neural Network Language Models for keyword search.Ankur Gandhe, Florian Metze, Alex Waibel, Ian R. Lane
2014ICASSPExploring audio semantic concepts for event-based video retrieval.Yipei Wang, Shourabh Rawat, Florian Metze
2014ICASSPSemi-automatic audio semantic concept discovery for multimedia retrieval.Yipei Wang, Shourabh Rawat, Florian Metze
2014InterspeechQuery-by-example spoken term detection on multilingual unconstrained speech.Xavier Anguera, Luis Javier Rodrguez-Fuentes, Igor Szke, Andi Buzo, Florian Metze, Mikel Peagarikano
2014InterspeechNeural network language models for low resource languages.Ankur Gandhe, Florian Metze, Ian R. Lane
2014InterspeechImproving language-universal feature extraction with deep maxout and convolutional neural networks.Yajie Miao, Florian Metze
2014InterspeechDistributed learning of multilingual DNN feature extractors using GPUs.Yajie Miao, Hao Zhang, Florian Metze
2014InterspeechTowards speaker adaptive training of deep neural network acoustic models.Yajie Miao, Hao Zhang, Florian Metze
2014InterspeechThe speech recognition virtual kitchen: launch party.Andrew R. Plummer, Eric Riebling, Anuj Kumar, Florian Metze, Eric Fosler-Lussier, Rebecca Bates
2014InterspeechAn in-depth comparison of keyword specific thresholding and sum-to-one score normalization.Yun Wang, Florian Metze
2014InterspeechWord-based probabilistic phonetic retrieval for low-resource spoken term detection.Di Xu, Florian Metze
2013ASRUUsing web text to improve keyword spotting in speech.Ankur Gandhe, Long Qin, Florian Metze, Alexander I. Rudnicky, Ian R. Lane, Matthias Eck
2013ASRUDNN acoustic modeling with modular multi-lingual feature extraction networks.Jonas Gehring, Quoc Bao Nguyen, Florian Metze, Alex Waibel
2013ASRUModels of tone for tonal and non-tonal languages.Florian Metze, Zaid Sheikh, Alex Waibel, Jonas Gehring, Kevin Kilgour, Quoc Bao Nguyen, Van Huy Nguyen
2013ASRUDeep maxout networks for low-resource speech recognition.Yajie Miao, Florian Metze, Shourabh Rawat
2013ASRUNeighbour selection and adaptation for rapid speaker-dependent ASR.Udhyakumar Nallasamy, Mark C. Fuhs, Monika Woszczyna, Florian Metze, Tanja Schultz
2013ICASSPExtracting deep bottleneck features using stacked auto-encoders.Jonas Gehring, Yajie Miao, Florian Metze, Alex Waibel
2013ICASSPA summary of the 2012 JHU CLSP workshop on zero resource speech technologies and models of early language acquisition.Aren Jansen, Emmanuel Dupoux, Sharon Goldwater, Mark Johnson, Sanjeev Khudanpur, Kenneth Church, Naomi Feldman, Hynek Hermansky, Florian Metze, Richard C. Rose, Mike Seltzer, Pascal Clark, Ian McGraw, Balakrishnan Varadarajan, Erin Bennett, Benjamin Brschinger, Justin T. Chiu, Ewan Dunbar, Abdellah Fourtassi, David Harwath, Chia-ying Lee, Keith D. Levin, Atta Norouzian, Vijayaditya Peddinti, Rachael Richardson, Thomas Schatz, Samuel Thomas
2013ICASSPThe spoken web search task at MediaEval 2012.Florian Metze, Xavier Anguera, Etienne Barnard, Marelie H. Davel, Guillaume Gravier
2013ICASSPSubspace mixture model for low-resource speech recognition in cross-lingual settings.Yajie Miao, Florian Metze, Alex Waibel
2013ICASSPLearning discriminative basis coefficients for eigenspace MLLR unsupervised adaptation.Yajie Miao, Florian Metze, Alex Waibel
2013ICASSPIdentification and modeling of word fragments in spontaneous speech.Yulia Tsvetkov, Zaid Sheikh, Florian Metze
2013IJCNLPProsody-Based Unsupervised Speech Summarization with Two-Layer Mutually Reinforced Random Walk.Sujay Kumar Jauhar, Yun-Nung Chen, Florian Metze
2013InterspeechMulti-layer mutually reinforced random walk with hidden parameters for improved multi-party meeting summarization.Yun-Nung Chen, Florian Metze
2013InterspeechFormalizing expert knowledge for developing accurate speech recognizers.Anuj Kumar, Florian Metze, Wenyi Wang, Matthew Kam
2013InterspeechThe speech recognition virtual kitchen.Florian Metze, Eric Fosler-Lussier, Rebecca Bates
2013InterspeechImproving low-resource CD-DNN-HMM using dropout and multilingual DNN training.Yajie Miao, Florian Metze
2013InterspeechRobust audio-codebooks for large-scale event detection in consumer videos.Shourabh Rawat, Peter F. Schulam, Susanne Burger, Duo Ding, Yipei Wang, Florian Metze
2012ICASSPArticulatory features for expressive speech synthesis.Alan W. Black, H. Timothy Bunnell, Ying Dou, Prasanna Kumar Muthukumar, Florian Metze, Daniel Perry, Tim Polzehl, Kishore Prahallad, Stefan Steidl, Callie Vaughn
2012ICASSPThe Spoken Web Search Task at MediaEval 2011.Florian Metze, Nitendra Rajput, Xavier Anguera, Marelie H. Davel, Guillaume Gravier, Charl Johannes van Heerden, Gautam Varma Mantena, Armando Muscariello, Kishore Prahallad, Igor Szke, Javier Tejedor
2012INLGGenerating Natural Language Summaries for Multimedia.Duo Ding, Florian Metze, Shourabh Rawat, Peter Franz Schulam, Susanne Burger
2012InterspeechIntegrating Intra-Speaker Topic Modeling and Temporal-Based Inter-Speaker Topic Modeling in Random Walk for Improved Multi-Party Meeting Summarization.Yun-Nung Chen, Florian Metze
2012InterspeechEvent-based Video Retrieval Using Audio.Qin Jin, Peter Franz Schulam, Shourabh Rawat, Susanne Burger, Duo Ding, Florian Metze
2012InterspeechThe Speech Recognition Virtual Kitchen: An Initial Prototype.Florian Metze, Eric Fosler-Lussier
2012InterspeechEnhanced Polyphone Decision Tree Adaptation for Accented Speech Recognition.Udhyakumar Nallasamy, Florian Metze, Tanja Schultz
2012InterspeechOn Speaker-Independent Personality Perception and Prediction from Speech.Tim Polzehl, Katrin Schoenenberg, Sebastian Mller, Florian Metze, Gelareh Mohammadi, Alessandro Vinciarelli
2012InterspeechInitialization Schemes for Multilayer Perceptron Training and their Impact on ASR Performance using Multilingual Data.Ngoc Thang Vu, Wojtek Breiter, Florian Metze, Tanja Schultz
2012NAACLIntra-Speaker Topic Modeling for Improved Multi-Party Meeting Summarization with Integrated Random Walk.Yun-Nung Chen, Florian Metze
2011HCIA Review of Personality in Voice-Based Man Machine Interaction.Florian Metze, Alan W. Black, Tim Polzehl
2011InterspeechAnalysis of Dialectal Influence in Pan-Arabic ASR.Udhyakumar Nallasamy, Michael Garbus, Florian Metze, Qin Jin, Thomas Schaaf, Tanja Schultz
2011InterspeechModeling Speaker Personality Using Voice.Tim Polzehl, Sebastian Mller, Florian Metze
2010ICASSPLate fusion of individual engines for improved recognition of negative emotion in speech - learning vs. democratic vote.Bjrn W. Schuller, Florian Metze, Stefan Steidl, Anton Batliner, Florian Eyben, Tim Polzehl
2010InterspeechImprovements to generalized discriminative feature transformation for speech recognition.Roger Hsiao, Florian Metze, Tanja Schultz
2010InterspeechEmotion recognition using imperfect speech recognition.Florian Metze, Anton Batliner, Florian Eyben, Tim Polzehl, Bjrn W. Schuller, Stefan Steidl
2010InterspeechThe 2010 CMU GALE speech-to-text system.Florian Metze, Roger Hsiao, Qin Jin, Udhyakumar Nallasamy, Tanja Schultz
2010InterspeechAnalysis of gender normalization using MLP and VTLN features.Thomas Schaaf, Florian Metze
2009HCIReliable Evaluation of Multimodal Dialogue Systems.Florian Metze, Ina Wechsung, Stefan Schaffer, Julia Seebode, Sebastian Mller
2009HCIUsability Evaluation of Multimodal Interfaces: Is the Whole the Sum of Its Parts?Ina Wechsung, Klaus-Peter Engelbrecht, Stefan Schaffer, Julia Seebode, Florian Metze, Sebastian Mller
2009ICASSPDetecting real life anger.Felix Burkhardt, Tim Polzehl, Joachim Stegmann, Florian Metze, Richard Huber
2009InterspeechEmotion classification in children's speech using fusion of acoustic and linguistic features.Tim Polzehl, Shiva Sundaram, Hamed Ketabdar, Michael Wagner, Florian Metze
2009InterspeechInfluence of training on direct and indirect measures for the evaluation of multimodal systems.Julia Seebode, Stefan Schaffer, Ina Wechsung, Florian Metze
2009InterspeechPredicting the quality of multimodal systems based on judgments of single modalities.Ina Wechsung, Klaus-Peter Engelbrecht, Anja B. Naumann, Stefan Schaffer, Julia Seebode, Florian Metze, Sebastian Mller
2008ICPRDetecting trends in social bookmarking systems using a probabilistic generative model and smoothing.Robert Wetzker, Till Plumbaum, Alexander Korth, Christian Bauckhage, Tansu Alpcan, Florian Metze
2008InterspeechUser perception of multi-modal interfaces for mobile applications.Florian Metze, Roman Englert, Udo Bub, Ingmar Kliche, Thomas Scheerbarth
2007ICASSPSpotting using Durational Entropy.Jitendra Ajmera, Florian Metze
2007ICASSPComparison of Four Approaches to Age and Gender Recognition for Telephone Applications.Florian Metze, Jitendra Ajmera, Roman Englert, Udo Bub, Felix Burkhardt, Joachim Stegmann, Christian A. Mller, Richard Huber, Bernt Andrassy, Josef G. Bauer, Bernhard Littel
2007NAACLOn using Articulatory Features for Discriminative Speaker Adaptation.Florian Metze
2007SMCAn intelligent knowledge sharing system for web communities.Christian Bauckhage, Tansu Alpcan, Sachin Agarwal, Florian Metze, Robert Wetzker, Milena Ilic, Sahin Albayrak
2006InterspeechArticulatory features for "meeting" speech recognition.Florian Metze
2005ICASSPAutomatically Transcribing Meetings using Distant Microphones.Florian Metze, Christian Fgen, Yue Pan, Alex Waibel
2004ICASSPThe 2003 ISL rich transcription system for conversational telephony speech.Hagen Soltau, Hua Yu, Florian Metze, Christian Fgen, Qin Jin, Szu-Chen Stan Jou
2004InterspeechIssues in meeting transcription - the ISL meeting transcription system.Tanja Schultz, Qin Jin, Kornel Laskowski, Yue Pan, Florian Metze, Christian Fgen
2003ICASSPMultilingual articulatory features.Sebastian Stker, Tanja Schultz, Florian Metze, Alex Waibel
2003InterspeechThe NESPOLE! voIP multilingual corpora in tourism and medical domains.Nadia Mana, Susanne Burger, Roldano Cattoni, Laurent Besacier, Victoria MacLaren, John W. McDonough, Florian Metze
2003InterspeechIntegrating multilingual articulatory features into speech recognition.Sebastian Stker, Florian Metze, Tanja Schultz, Alex Waibel
2002ACLA Multi-Perspective Evaluation of the NESPOLE! Speech-to-Speech Translation System.Alon Lavie, Florian Metze, Roldano Cattoni, Erica Costantini
2002ICASSPEfficient language model lookahead through polymorphic linguistic context assignment.Hagen Soltau, Florian Metze, Christian Fgen, Alex Waibel
2002InterspeechA flexible stream architecture for ASR using articulatory features.Florian Metze, Alex Waibel
2002InterspeechCompensating for hyperarticulation by modeling articulatory properties.Hagen Soltau, Florian Metze, Alex Waibel
2001ICASSPSpeaker compensation with sine-log all-pass transforms.John W. McDonough, Florian Metze, Hagen Soltau, Alex Waibel
2001ICASSPThe ISL evaluation system for Verbmobil-II.Hagen Soltau, Thomas Schaaf, Florian Metze, Alex Waibel
2001ICASSPAdvances in automatic meeting record creation and access.Alex Waibel, Michael Bett, Florian Metze, Klaus Ries, Thomas Schaaf, Tanja Schultz, Hagen Soltau, Hua Yu, Klaus Zechner
2001InterspeechThe nespole! voIP dialogue database.Susanne Burger, Laurent Besacier, Paolo Coletti, Florian Metze, Cline Morel
2001InterspeechSpeech recognition over netmeeting connections.Florian Metze, John W. McDonough, Hagen Soltau
2001NAACLAdvances in meeting recognition.Alex Waibel, Hua Yu, Tanja Schultz, Yue Pan, Michael Bett, Martin Westphal, Hagen Soltau, Thomas Schaaf, Florian Metze
2000ICASSPConfidence measure based language identification.Florian Metze, Thomas Kemp, Thomas Schaaf, Tanja Schultz, Hagen Soltau