Erik Marchi
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
39
Venues
8
Active years
2011–2025
Best venue rank
A*
Where they publish
Papers
39 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | SELMA: A Speech-Enabled Language Model for Virtual Assistant Interactions. | Dominik Wagner, Alexander W. Churchill, Siddharth Sigtia, Erik Marchi |
| 2024 | ICASSP | A Multimodal Approach to Device-Directed Speech Detection with Large Language Models. | Dominik Wagner, Alexander W. Churchill, Siddharth Sigtia, Panayiotis G. Georgiou, Matt Mirsamadi, Aarshee Mishra, Erik Marchi |
| 2023 | ICASSP | Audio-to-Intent Using Acoustic-Textual Subword Representations from End-to-End ASR. | Pranay Dighe, Prateeth Nayak, Oggi Rudovic, Erik Marchi, Xiaochuan Niu, Ahmed H. Tewfik |
| 2023 | ICASSP | Less Is More: A Unified Architecture for Device-Directed Speech Detection with Multiple Invocation Types. | Oggi Rudovic, Wonil Chang, Vineet Garg, Pranay Dighe, Pramod Simha, Jack Berkowitz, Ahmed Hussen Abdelaziz, Sachin Kajarekar, Erik Marchi, Saurabh Adya |
| 2022 | Interspeech | Device-Directed Speech Detection: Regularization via Distillation for Weakly-Supervised Models. | Vineet Garg, Ognjen Rudovic, Pranay Dighe, Ahmed Hussen Abdelaziz, Erik Marchi, Saurabh Adya, Chandra Dhir, Ahmed H. Tewfik |
| 2022 | Interspeech | Improving Voice Trigger Detection with Metric Learning. | Prateeth Nayak, Takuya Higuchi, Anmol Gupta, Shivesh Ranjan, Stephen Shum, Siddharth Sigtia, Erik Marchi, Varun Lakshminarasimhan, Minsik Cho, Saurabh Adya, Chandra Dhir, Ahmed H. Tewfik |
| 2021 | ICASSP | On The Role of Visual Cues in Audiovisual Speech Enhancement. | Zakaria Aldeneh, Anushree Prasanna Kumar, Barry-John Theobald, Erik Marchi, Sachin Kajarekar, Devang Naik, Ahmed Hussen Abdelaziz |
| 2021 | ICASSP | Knowledge Transfer for Efficient on-Device False Trigger Mitigation. | Pranay Dighe, Erik Marchi, Srikanth Vishnubhotla, Sachin Kajarekar, Devang Naik |
| 2021 | ICASSP | Progressive Voice Trigger Detection: Accuracy vs Latency. | Siddharth Sigtia, John Bridle, Hywel Richards, Pascal Clark, Erik Marchi, Vineet Garg |
| 2020 | ICASSP | Detecting Emotion Primitives from Speech and Their Use in Discerning Categorical Emotions. | Vasudha Kowtha, Vikramjit Mitra, Chris Bartels, Erik Marchi, Sue Booker, William Caruso, Sachin Kajarekar, Devang Naik |
| 2020 | ICASSP | Generating Multilingual Voices Using Speaker Space Translation Based on Bilingual Speaker Data. | Soumi Maiti, Erik Marchi, Alistair Conkie |
| 2020 | ICASSP | Multi-Task Learning for Speaker Verification and Voice Trigger Detection. | Siddharth Sigtia, Erik Marchi, Sachin Kajarekar, Devang Naik, John Bridle |
| 2019 | Interspeech | Leveraging Acoustic Cues and Paralinguistic Embeddings to Detect Expression from Voice. | Vikramjit Mitra, Sue Booker, Erik Marchi, David Scott Farrar, Ute Dorothea Peitz, Bridget Cheng, Ermine Teves, Anuj Mehta, Devang Naik |
| 2018 | ICASSP | Generalised Discriminative Transform via Curriculum Learning for Speaker Recognition. | Erik Marchi, Stephen Shum, Kvuveon Hwang, Sachin Kajarekar, Siddharth Sigtia, Hywel Richards, Rob Haynes, Yoon Kim, John Bridle |
| 2018 | Interspeech | Efficient Voice Trigger Detection for Low Resource Hardware. | Siddharth Sigtia, Rob Haynes, Hywel Richards, Erik Marchi, John Bridle |
| 2016 | ICASSP | Adieu features? End-to-end speech emotion recognition using a deep convolutional recurrent network. | George Trigeorgis, Fabien Ringeval, Raymond Brueckner, Erik Marchi, Mihalis A. Nicolaou, Bjrn W. Schuller, Stefanos Zafeiriou |
| 2016 | ICASSP | Enhanced semi-supervised learning for multimodal emotion recognition. | Zixing Zhang, Fabien Ringeval, Bin Dong, Eduardo Coutinho, Erik Marchi, Bjrn W. Schuller |
| 2016 | ICPR | Detecting road surface wetness from audio: A deep learning approach. | Irman Abdic, Lex Fridman, Daniel E. Brown, William Angell, Bryan Reimer, Erik Marchi, Bjrn W. Schuller |
| 2016 | IJCAI | Driver Frustration Detection from Audio and Video in the Wild. | Irman Abdic, Lex Fridman, Daniel McDuff, Erik Marchi, Bryan Reimer, Bjrn W. Schuller |
| 2016 | IJCAI | Discriminatively Trained Recurrent Neural Networks for Continuous Dimensional Emotion Recognition from Audio. | Felix Weninger, Fabien Ringeval, Erik Marchi, Bjrn W. Schuller |
| 2016 | Interspeech | Is Deception Emotional? An Emotion-Driven Predictive Approach. | Shahin Amiriparian, Jouni Pohjalainen, Erik Marchi, Sergey Pugachevskiy, Bjrn W. Schuller |
| 2016 | Interspeech | Real-Time Tracking of Speakers' Emotions, States, and Traits on Mobile Platforms. | Erik Marchi, Florian Eyben, Gerhard Hagerer, Bjrn W. Schuller |
| 2016 | Interspeech | Automatic Analysis of Typical and Atypical Encoding of Spontaneous Emotion in the Voice of Children. | Fabien Ringeval, Erik Marchi, Charline Grossard, Jean Xavier, Mohamed Chetouani, David Cohen, Bjrn W. Schuller |
| 2016 | Interspeech | Enhancing Multilingual Recognition of Emotion in Speech by Language Identification. | Hesam Sagha, Pavel Matejka, Maryna Gavryukova, Filip Povoln, Erik Marchi, Bjrn W. Schuller |
| 2016 | Interspeech | Facing Realism in Spontaneous Emotion Recognition from Speech: Feature Enhancement by Autoencoder with LSTM Neural Networks. | Zixing Zhang, Fabien Ringeval, Jing Han, Jun Deng, Erik Marchi, Bjrn W. Schuller |
| 2016 | LREC | Introducing the Weighted Trustability Evaluator for Crowdsourcing Exemplified by Speaker Likability Classification. | Simone Hantke, Erik Marchi, Bjrn W. Schuller |
| 2015 | ACII | Real-time robust recognition of speakers' emotions and characteristics on mobile platforms. | Florian Eyben, Bernd Huber, Erik Marchi, Dagmar Schuller, Bjrn W. Schuller |
| 2015 | ICASSP | A novel approach for automatic acoustic novelty detection using a denoising autoencoder with bidirectional LSTM neural networks. | Erik Marchi, Fabio Vesperini, Florian Eyben, Stefano Squartini, Bjrn W. Schuller |
| 2015 | IJCNN | Non-linear prediction with LSTM recurrent neural networks for acoustic novelty detection. | Erik Marchi, Fabio Vesperini, Felix Weninger, Florian Eyben, Stefano Squartini, Bjrn W. Schuller |
| 2015 | Interspeech | Typicality and emotion in the voice of children with autism spectrum condition: evidence across three languages. | Erik Marchi, Bjrn W. Schuller, Simon Baron-Cohen, Ofer Golan, Sven Blte, Prerna Arora, Reinhold Hb-Umbach |
| 2015 | Interspeech | Face reading from speech - predicting facial action units from audio cues. | Fabien Ringeval, Erik Marchi, Marc Mehu, Klaus R. Scherer, Bjrn W. Schuller |
| 2014 | ICASSP | Multi-resolution linear prediction based features for audio onset detection with bidirectional LSTM neural networks. | Erik Marchi, Giacomo Ferroni, Florian Eyben, Leonardo Gabrielli, Stefano Squartini, Bjrn W. Schuller |
| 2014 | IJCNN | Audio onset detection: A wavelet packet based approach with recurrent neural networks. | Erik Marchi, Giacomo Ferroni, Florian Eyben, Stefano Squartini, Bjrn W. Schuller |
| 2014 | Interspeech | The INTERSPEECH 2014 computational paralinguistics challenge: cognitive & physical load. | Bjrn W. Schuller, Stefan Steidl, Anton Batliner, Julien Epps, Florian Eyben, Fabien Ringeval, Erik Marchi, Yue Zhang |
| 2013 | ACII | Sparse Autoencoder-Based Feature Transfer Learning for Speech Emotion Recognition. | Jun Deng, Zixing Zhang, Erik Marchi, Bjrn W. Schuller |
| 2013 | Interspeech | The INTERSPEECH 2013 computational paralinguistics challenge: social signals, conflict, emotion, autism. | Bjrn W. Schuller, Stefan Steidl, Anton Batliner, Alessandro Vinciarelli, Klaus R. Scherer, Fabien Ringeval, Mohamed Chetouani, Felix Weninger, Florian Eyben, Erik Marchi, Marcello Mortillaro, Hugues Salamin, Anna Polychroniou, Fabio Valente, Samuel Kim |
| 2013 | Interspeech | Active learning by label uncertainty for acoustic emotion recognition. | Zixing Zhang, Jun Deng, Erik Marchi, Bjrn W. Schuller |
| 2012 | Interspeech | Improving Recognition of Speaker States and Traits by Cumulative Evidence: Intoxication, Sleepiness, Age and Gender. | Felix Weninger, Erik Marchi, Bjrn W. Schuller |
| 2011 | ISNN | Robust Multi-stream Keyword and Non-linguistic Vocalization Detection for Computationally Intelligent Virtual Agents. | Martin Wllmer, Erik Marchi, Stefano Squartini, Bjrn W. Schuller |