Skip to content

Andros Tjandra

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

7

Active years

2015–2025

Best venue rank

A*

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUThe AudioMOS Challenge 2025.Wen-Chin Huang, Hui Wang, Cheng Liu, Yi-Chiao Wu, Andros Tjandra, Wei-Ning Hsu, Erica Cooper, Yong Qin, Tomoki Toda
2025ASRUMeta Audiobox Aesthetics: Unified Automatic Assessment for Speech, Music and Sound.Andros Tjandra, Yi-Chiao Wu, Baishan Guo, John Hoffman, Brian Ellis, Apoorv Vyas, Bowen Shi, Sanyuan Chen, Matt Le, Nick Zacharov, Carleigh Wood, Ann Lee, Wei-Ning Hsu
2025InterspeechAudiobox TTA-RAG: Improving Zero-Shot and Few-Shot Text-To-Audio with Retrieval-Augmented Generation.Mu Yang, Bowen Shi, Matthew Le, Wei-Ning Hsu, Andros Tjandra
2024ICASSPDynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of a Multilingual ASR Model.Jiamin Xie, Ke Li, Jinxi Guo, Andros Tjandra, Yuan Shangguan, Leda Sari, Chunyang Wu, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli
2024ICLRGenerative Pre-training for Speech with Flow Matching.Alexander H. Liu, Matthew Le, Apoorv Vyas, Bowen Shi, Andros Tjandra, Wei-Ning Hsu
2024ICMLMusicFlow: Cascaded Flow Matching for Text Guided Music Generation.K. R. Prajwal, Bowen Shi, Matthew Le, Apoorv Vyas, Andros Tjandra, Mahi Luthra, Baishan Guo, Huiyu Wang, Triantafyllos Afouras, David Kant, Wei-Ning Hsu
2024InterspeechLearning Fine-Grained Controllability on Speech Generation via Efficient Fine-Tuning.Chung-Ming Chien, Andros Tjandra, Apoorv Vyas, Matt Le, Bowen Shi, Wei-Ning Hsu
2023ICASSPVoice-Preserving Zero-Shot Multiple Accent Conversion.Mumin Jin, Prashant Serai, Jilong Wu, Andros Tjandra, Vimal Manohar, Qing He
2023ICASSPMassively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities.Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer
2023ICASSPLearning ASR Pathways: A Sparse Multilingual ASR Model.Mu Yang, Andros Tjandra, Chunxi Liu, David Zhang, Duc Le, Ozlem Kalinli
2022ICASSPConformer-Based Self-Supervised Learning For Non-Speech Audio Tasks.Sangeeta Srivastava, Yun Wang, Andros Tjandra, Anurag Kumar, Chunxi Liu, Kritika Singh, Yatharth Saraf
2022ICASSPImproved Language Identification Through Cross-Lingual Self-Supervised Learning.Andros Tjandra, Diptanu Gon Choudhury, Frank Zhang, Kritika Singh, Alexis Conneau, Alexei Baevski, Assaf Sela, Yatharth Saraf, Michael Auli
2022InterspeechXLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale.Arun Babu, Changhan Wang, Andros Tjandra, Kushal Lakhotia, Qiantong Xu, Naman Goyal, Kritika Singh, Patrick von Platen, Yatharth Saraf, Juan Pino, Alexei Baevski, Alexis Conneau, Michael Auli
2021InterspeechUnsupervised Learning of Disentangled Speech Content and Style Representation.Andros Tjandra, Ruoming Pang, Yu Zhang, Shigeki Karita
2020ICASSPDEJA-VU: Double Feature Presentation and Iterated Loss in Deep Transformer Networks.Andros Tjandra, Chunxi Liu, Frank Zhang, Xiaohui Zhang, Yongqiang Wang, Gabriel Synnaeve, Satoshi Nakamura, Geoffrey Zweig
2020ICASSPTransformer-Based Acoustic Modeling for Hybrid Speech Recognition.Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer
2020InterspeechAugmenting Images for ASR and TTS Through Single-Loop and Dual-Loop Multimodal Chain Framework.Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2020InterspeechIncremental Machine Speech Chain Towards Enabling Listening While Speaking in Real-Time.Sashi Novitasari, Andros Tjandra, Tomoya Yanagita, Sakriani Sakti, Satoshi Nakamura
2020InterspeechTransformer VQ-VAE for Unsupervised Unit Discovery and Speech Synthesis: ZeroSpeech 2020 Challenge.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019ASRUListening While Speaking and Visualizing: Improving ASR Through Multimodal Chain.Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019ASRUZero-Shot Code-Switching ASR and TTS with Multilingual Machine Speech Chain.Sahoko Nakayama, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019ASRUSpeech-to-Speech Translation Between Untranscribed Unknown Languages.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019ICASSPEnd-to-end Feedback Loss in Speech Chain Framework via Straight-through Estimator.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019InterspeechSequence-to-Sequence Learning via Attention Transfer for Incremental Speech Recognition.Sashi Novitasari, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2019InterspeechVQVAE Unsupervised Unit Discovery and Multi-Scale Code2Spec Inverter for Zerospeech Challenge 2019.Andros Tjandra, Berrak Sisman, Mingyang Zhang, Sakriani Sakti, Haizhou Li, Satoshi Nakamura
2018ICASSPSequence-to-Sequence Asr Optimization Via Reinforcement Learning.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2018IJCNNTensor Decomposition for Compressing Recurrent Neural Network.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2018InterspeechCompressing End-to-end ASR Networks by Tensor-Train Decomposition.Takuma Mori, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2018InterspeechMachine Speech Chain with One-shot Speaker Adaptation.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017ASRUListening while speaking: Speech chain by deep learning.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017ASRUAttention-based Wav2Text with feature transfer learning.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017IJCNLPLocal Monotonic Attention Mechanism for End-to-End Speech And Language Processing.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2017IJCNNCompressing recurrent neural network with tensor train.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura
2016IJCNNGated Recurrent Neural Tensor Network.Andros Tjandra, Sakriani Sakti, Ruli Manurung, Mirna Adriani, Satoshi Nakamura
2015ASRUStochastic Gradient Variational Bayes for deep learning-based ASR.Andros Tjandra, Sakriani Sakti, Satoshi Nakamura, Mirna Adriani
2015ICASSPCombination of two-dimensional cochleogram and spectrogram features for deep learning-based ASR.Andros Tjandra, Sakriani Sakti, Graham Neubig, Tomoki Toda, Mirna Adriani, Satoshi Nakamura