Skip to content

Edresson Casanova

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

9

Active years

2020–2025

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUOpen Full-duplex Voice Agent with Speech-to-Speech Language Model.Edresson Casanova, Chen Chen, Kevin Hu, Ankita Pasad, Elena Rastorgueva, Seelan Lakshmi Narasimhan, Slyne Deng, Ehsan Hosseini-Asl, Piotr Zelasko, Valentin Mendelev, Subhankar Ghosh, Yifan Peng, Zhehuai Chen, Jason Li, Jagadeesh Balam, Vitaly Lavrukhin, Boris Ginsburg
2025COLINGMuPe Life Stories Dataset: Spontaneous Speech in Brazilian Portuguese with a Case Study Evaluation on ASR Bias against Speakers Groups and Topic Modeling.Sidney Evaldo Leal, Arnaldo Cndido Jnior, Ricardo M. Marcacini, Edresson Casanova, Odilon Gonalves, Anderson da Silva Soares, Rodrigo Lima, Lucas Rafael Stefanel Gris, Sandra M. Alusio
2025EMNLPKoel-TTS: Enhancing LLM based Speech Generation with Preference Alignment and Classifier Free Guidance.Shehzeen Samarah Hussain, Paarth Neekhara, Xuesong Yang, Edresson Casanova, Subhankar Ghosh, Roy Fejgin, Mikyas T. Desta, Rafael Valle, Jason Li
2025ICASSPLow Frame-rate Speech Codec: a Codec Designed for Fast High-quality Speech LLM Training and Inference.Edresson Casanova, Ryan Langman, Paarth Neekhara, Shehzeen Hussain, Jason Li, Subhankar Ghosh, Ante Jukic, Sang-gil Lee
2025ICASSPFreeSVC: Towards Zero-shot Multilingual Singing Voice Conversion.Alef Iury Siqueira Ferreira, Lucas Rafael Stefanel Gris, Augusto Seben da Rosa, Frederico Santos de Oliveira, Edresson Casanova, Rafael Teixeira Sousa, Arnaldo Cndido Jr., Anderson da Silva Soares, Arlindo R. Galvo Filho
2025InterspeechNanoCodec: Towards High-Quality Ultra Fast Speech LLM Inference.Edresson Casanova, Paarth Neekhara, Ryan Langman, Shehzeen Hussain, Subhankar Ghosh, Xuesong Yang, Ante Jukic, Jason Li, Boris Ginsburg
2025InterspeechEfficient and Direct Duplex Modeling for Speech-to-Speech Language Model.Ke Hu, Ehsan Hosseini-Asl, Chen Chen, Edresson Casanova, Subhankar Ghosh, Piotr Zelasko, Zhehuai Chen, Jason Li, Jagadeesh Balam, Boris Ginsburg
2025InterspeechHiFiTTS-2: A Large-Scale High Bandwidth Speech Dataset.Ryan Langman, Xuesong Yang, Paarth Neekhara, Shehzeen Hussain, Edresson Casanova, Evelina Bakhturina, Jason Li
2024IJCNNMLAAD: The Multi-Language Audio Anti-Spoofing Dataset.Nicolas M. Mller, Piotr Kawa, Wei Herng Choong, Edresson Casanova, Eren Glge, Thorsten Mller, Piotr Syga, Philip Sperl, Konstantin Bttinger
2024InterspeechXTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model.Edresson Casanova, Kelly Davis, Eren Glge, Grkem Gknar, Iulian Gulea, Logan Hart, Aya Aljafari, Joshua Meyer, Reuben Morais, Samuel Olayemi, Julian Weber
2023InterspeechASR data augmentation in low-resource settings using cross-lingual multi-speaker TTS and cross-lingual voice conversion.Edresson Casanova, Christopher Shulby, Alexander Korolev, Arnaldo Cndido Jnior, Anderson da Silva Soares, Sandra M. Alusio, Moacir Antonelli Ponti
2022ICMLYourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for Everyone.Edresson Casanova, Julian Weber, Christopher Dane Shulby, Arnaldo Cndido Jnior, Eren Glge, Moacir A. Ponti
2022InterspeechBibleTTS: a large, high-fidelity, multilingual, and uniquely African speech corpus.Josh Meyer, David Ifeoluwa Adelani, Edresson Casanova, Alp ktem, Daniel Whitenack, Julian Weber, Salomon Kabongo, Elizabeth Salesky, Iroro Orife, Colin Leong, Perez Ogayo, Chris Chinenye Emezue, Jonathan Mukiibi, Salomey Osei, Apelete Agbolo, Victor Akinode, Bernard Opoku, Samuel Olanrewaju, Jesujoba O. Alabi, Shamsuddeen Hassan Muhammad
2021ACLDeep Learning against COVID-19: Respiratory Insufficiency Detection in Brazilian Portuguese Speech.Edresson Casanova, Lucas Gris, Augusto Camargo Neto, Daniel Peixoto Pinto da Silva, Murilo Gazzola, Ester C. Sabino, Anna Levin, Arnaldo Cndido Jr., Sandra M. Alusio, Marcelo Finger
2021InterspeechTransfer Learning and Data Augmentation Techniques to the COVID-19 Identification Tasks in ComParE 2021.Edresson Casanova, Arnaldo Cndido Jr., Ricardo Corso Fernandes Junior, Marcelo Finger, Lucas Rafael Stefanel Gris, Moacir Antonelli Ponti, Daniel Peixoto Pinto da Silva
2021InterspeechSC-GlowTTS: An Efficient Zero-Shot Multi-Speaker Text-To-Speech Model.Edresson Casanova, Christopher Shulby, Eren Glge, Nicolas Michael Mller, Frederico Santos de Oliveira, Arnaldo Cndido Jr., Anderson da Silva Soares, Sandra Maria Alusio, Moacir Antonelli Ponti
2020LRECEvaluating Sentence Segmentation in Different Datasets of Neuropsychological Language Tests in Brazilian Portuguese.Edresson Casanova, Marcos V. Treviso, Lilian Hbner, Sandra M. Alusio