Skip to content

Jean-Marc Valin

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

51

Venues

13

Active years

1999–2024

Best venue rank

A*

Where they publish

Papers

51 indexed papers, newest first.

YearVenueTitleAuthors
2024ICASSPNOLACE: Improving Low-Complexity Speech Codec Enhancement Through Adaptive Temporal Shaping.Jan Bthe, Ahmed Mustafa, Jean-Marc Valin, Karim Helwani, Michael M. Goodwin
2024ICASSPNoise-Robust DSP-Assisted Neural Pitch Estimation With Very Low Complexity.Krishna Subramani, Jean-Marc Valin, Jan Bthe, Paris Smaragdis, Mike Goodwin
2024ICASSPReal-Time Stereo Speech Enhancement with Spatial-Cue Preservation Based on Dual-Path Structure.Masahito Togami, Jean-Marc Valin, Karim Helwani, Ritwik Giri, Umut Isik, Michael M. Goodwin
2023ICASSPFramewise Wavegan: High Speed Adversarial Vocoder In Time Domain With Very Low Computational Complexity.Ahmed Mustafa, Jean-Marc Valin, Jan Bthe, Paris Smaragdis, Mike Goodwin
2023ICASSPLow-Bitrate Redundancy Coding of Speech Using A Rate-Distortion-Optimized Variational Autoencoder.Jean-Marc Valin, Jan Bthe, Ahmed Mustafa
2023ICASSPA Framework for Unified Real-Time Personalized and Non-Personalized Speech Enhancement.Zhepei Wang, Ritwik Giri, Devansh Shah, Jean-Marc Valin, Michael M. Goodwin, Paris Smaragdis
2022ICASSPNeural Speech Synthesis on a Shoestring: Improving the Efficiency of Lpcnet.Jean-Marc Valin, Umut Isik, Paris Smaragdis, Arvindh Krishnaswamy
2022ICASSPImproved Singing Voice Separation with Chromagram-Based Pitch-Aware Remixing.Siyuan Yuan, Zhepei Wang, Umut Isik, Ritwik Giri, Jean-Marc Valin, Michael M. Goodwin, Arvindh Krishnaswamy
2022InterspeechEnd-to-end LPCNet: A Neural Vocoder With Fully-Differentiable LPC Estimation.Krishna Subramani, Jean-Marc Valin, Umut Isik, Paris Smaragdis, Arvindh Krishnaswamy
2022InterspeechReal-Time Packet Loss Concealment With Mixed Generative and Predictive Model.Jean-Marc Valin, Ahmed Mustafa, Christopher Montgomery, Timothy B. Terriberry, Michael Klingbeil, Paris Smaragdis, Arvindh Krishnaswamy
2021ICASSPEnhancing into the Codec: Noise Robust Speech Coding with Vector-Quantized Autoencoders.Jonah Casebeer, Vinjai Vale, Umut Isik, Jean-Marc Valin, Ritwik Giri, Arvindh Krishnaswamy
2021ICASSPLow-Complexity, Real-Time Joint Neural Echo Control and Speech Enhancement Based On Percepnet.Jean-Marc Valin, Srikanth V. Tenneti, Karim Helwani, Umut Isik, Arvindh Krishnaswamy
2021ICASSPSemi-Supervised Singing Voice Separation With Noisy Self-Training.Zhepei Wang, Ritwik Giri, Umut Isik, Jean-Marc Valin, Arvindh Krishnaswamy
2021InterspeechMulti-Channel Opus Compression for Far-Field Automatic Speech Recognition with a Fixed Bitrate Budget.Lukas Drude, Jahn Heymann, Andreas Schwarz, Jean-Marc Valin
2021InterspeechPersonalized PercepNet: Real-Time, Low-Complexity Target Voice Separation and Enhancement.Ritwik Giri, Shrikant Venkataramani, Jean-Marc Valin, Umut Isik, Arvindh Krishnaswamy
2020InterspeechPoCoNet: Better Speech Enhancement with Frequency-Positional Embeddings, Semi-Supervised Conversational Data, and Biased Loss.Umut Isik, Ritwik Giri, Neerad Phansalkar, Jean-Marc Valin, Karim Helwani, Arvindh Krishnaswamy
2020InterspeechImproving Opus Low Bit Rate Quality with Neural Speech Synthesis.Jan Skoglund, Jean-Marc Valin
2020InterspeechA Perceptually-Motivated Approach for Low-Complexity, Real-Time Enhancement of Fullband Speech.Jean-Marc Valin, Umut Isik, Neerad Phansalkar, Ritwik Giri, Karim Helwani, Arvindh Krishnaswamy
2019ICASSPLPCNET: Improving Neural Speech Synthesis through Linear Prediction.Jean-Marc Valin, Jan Skoglund
2019InterspeechA Real-Time Wideband Neural Vocoder at 1.6kb/s Using LPCNet.Jean-Marc Valin, Jan Skoglund
2018ICASSPThe Av1 Constrained Directional Enhancement Filter (Cdef).Steinar Midtskogen, Jean-Marc Valin
2018MMSPA Hybrid DSP/Deep Learning Approach to Real-Time Full-Band Speech Enhancement.Jean-Marc Valin
2018PCSAn Overview of Core Coding Tools in the AV1 Video Codec.Yue Chen, Debargha Mukherjee, Jingning Han, Adrian Grange, Yaowu Xu, Zoe Liu, Sarah Parker, Cheng Chen, Hui Su, Urvang Joshi, Ching-Han Chiang, Yunqing Wang, Paul Wilkins, Jim Bankoski, Luc N. Trudeau, Nathan E. Egge, Jean-Marc Valin, Thomas Davies, Steinar Midtskogen, Andrey Norkin, Peter De Rivaz
2016ICIPDaala: A perceptually-driven still picture codec.Jean-Marc Valin, Nathan E. Egge, Thomas J. Daede, Timothy B. Terriberry, Christopher Montgomery
2016MMSPDaala: Building a next-generation video codec from unconventional technology.Jean-Marc Valin, Timothy B. Terriberry, Nathan E. Egge, Thomas J. Daede, Yushin Cho, Christopher Montgomery, Michael Bebenita
2012IROSIntegration of sound source localization and separation to improve Dialogue Management on a robot.Maxime Frchette, Dominic Ltourneau, Jean-Marc Valin, Franois Michaud
2009GLOBECOMPriority Based Dynamic Rate Control for VoIP Traffic.Fariza Sabrina, Jean-Marc Valin
2009IROSEvaluating real-time audio localization algorithms for artificial audition in robotics.Anthony P. Badali, Jean-Marc Valin, Franois Michaud, Parham Aarabi
2008GLOBECOMAdaptive Rate Control for Aggregated VoIP Traffic.Fariza Sabrina, Jean-Marc Valin
2008ICRAEmbedded auditory system for small mobile robots.Simon Brire, Jean-Marc Valin, Franois Michaud, Dominic Ltourneau
2007ASRUDesign and implementation of a robot audition system for automatic speech recognition of simultaneous speech.Shun'ichi Yamamoto, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2007ICASSPA New Robust Frequency Domain Echo Canceller with Closed-Loop Learning Rate Adaptation.Jean-Marc Valin, Iain B. Collings
2006ICASSPRobust 3D Localization and Tracking of Sound Sources Using Beamforming and Particle Filtering.Jean-Marc Valin, Franois Michaud, Jean Rouat
2006InterspeechLeak energy based missing feature mask generation for ICA and GSS and its evaluation with simultaneous speech recognition.Shun'ichi Yamamoto, Ryu Takeda, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2006IROSReal-Time Robot Audition System That Recognizes Simultaneous Speech in The Real World.Shun'ichi Yamamoto, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2006PRICAIRecognition of Simultaneous Speech by Estimating Reliability of Separated Signals for Robot Audition.Shun'ichi Yamamoto, Ryu Takeda, Kazuhiro Nakadai, Mikio Nakano, Hiroshi Tsujino, Jean-Marc Valin, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2005AAAIA Brochette of Socially Interactive Robots.Franois Michaud, Dominic Ltourneau, Pierre Lepage, Yan Morin, Frdric Gagnon, Patrick Gigure, Eric Beaudry, Yannick Brosseau, Carle Ct, Audrey Duquette, Jean-Franois Laplante, Marc-Antoine Legault, Pierre Moisan, Arnaud Ponchon, Clment Raevsky, Marc-Andr Roux, Tamie Salter, Jean-Marc Valin, Serge Caron, Patrice Masson, Froduald Kabanza, Michel Lauria
2005InterspeechMultiple moving speaker tracking by microphone array on mobile robot.Masamitsu Murase, Shun'ichi Yamamoto, Jean-Marc Valin, Kazuhiro Nakadai, Kentaro Yamada, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2005IROSMaking a robot recognize three simultaneous sentences in real-time.Shun'ichi Yamamoto, Kazuhiro Nakadai, Jean-Marc Valin, Jean Rouat, Franois Michaud, Kazunori Komatani, Tetsuya Ogata, Hiroshi G. Okuno
2005ICRAEnhanced Robot Speech Recognition Based on Microphone Array Source Separation and Missing Feature Theory.Shun'ichi Yamamoto, Jean-Marc Valin, Kazuhiro Nakadai, Jean Rouat, Franois Michaud, Tetsuya Ogata, Hiroshi G. Okuno
2005RO-MANModularity and integration in the design of a socially interactive robot.Franois Michaud, Yannick Brosseau, Carle Ct, Dominic Ltourneau, Pierre Moisan, Arnaud Ponchon, Clment Raevsky, Jean-Marc Valin, Eric Beaudry, Froduald Kabanza
2004ICASSPMicrophone array post-filter for separation of simultaneous non-stationary sources.Jean-Marc Valin, Jean Rouat, Franois Michaud
2004ICRAAutonomous Initialization of Robot Formations.Mathieu Lemay, Franois Michaud, Dominic Ltourneau, Jean-Marc Valin
2004IROSCode reusability tools for programming mobile robots.Carle Ct, Dominic Ltourneau, Franois Michaud, Jean-Marc Valin, Yannick Brosseau, Clment Raevsky, Mathieu Lemay, Wctor Tran
2004IROSEnhanced robot audition based on microphone array source separation with post-filter.Jean-Marc Valin, Jean Rouat, Franois Michaud
2004ICRALocalization of Simultaneous Moving Sound Sources for Mobile Robot Using a Frequency- Domain Steered Beamformer Approach.Jean-Marc Valin, Franois Michaud, Brahim Hadjou, Jean Rouat
2003IROSTextual message read by a mobile robot.Dominic Ltourneau, Franois Michaud, Jean-Marc Valin, Catherine Proulx
2003IROSRobust sound source localization using a microphone array on a mobile robot.Jean-Marc Valin, Franois Michaud, Jean Rouat, Dominic Ltourneau
2003SMCMaking a mobile robot read textual messages.Dominic Ltourneau, Franois Michaud, Jean-Marc Valin, Catherine Proulx
2002IROSDynamic robot formations using directional visual perception.Franois Michaud, Dominic Ltourneau, Matthieu Guilbert, Jean-Marc Valin
1999ICASSPOn the limits of speech recognition in noise.Stephen D. Peters, Peter Stubley, Jean-Marc Valin