Andros Tjandra
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
36
Venues
7
Active years
2015–2025
Best venue rank
A*
Where they publish
Papers
36 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASRU | The AudioMOS Challenge 2025. | Wen-Chin Huang, Hui Wang, Cheng Liu, Yi-Chiao Wu, Andros Tjandra, Wei-Ning Hsu, Erica Cooper, Yong Qin, Tomoki Toda |
| 2025 | ASRU | Meta Audiobox Aesthetics: Unified Automatic Assessment for Speech, Music and Sound. | Andros Tjandra, Yi-Chiao Wu, Baishan Guo, John Hoffman, Brian Ellis, Apoorv Vyas, Bowen Shi, Sanyuan Chen, Matt Le, Nick Zacharov, Carleigh Wood, Ann Lee, Wei-Ning Hsu |
| 2025 | Interspeech | Audiobox TTA-RAG: Improving Zero-Shot and Few-Shot Text-To-Audio with Retrieval-Augmented Generation. | Mu Yang, Bowen Shi, Matthew Le, Wei-Ning Hsu, Andros Tjandra |
| 2024 | ICASSP | Dynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of a Multilingual ASR Model. | Jiamin Xie, Ke Li, Jinxi Guo, Andros Tjandra, Yuan Shangguan, Leda Sari, Chunyang Wu, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli |
| 2024 | ICLR | Generative Pre-training for Speech with Flow Matching. | Alexander H. Liu, Matthew Le, Apoorv Vyas, Bowen Shi, Andros Tjandra, Wei-Ning Hsu |
| 2024 | ICML | MusicFlow: Cascaded Flow Matching for Text Guided Music Generation. | K. R. Prajwal, Bowen Shi, Matthew Le, Apoorv Vyas, Andros Tjandra, Mahi Luthra, Baishan Guo, Huiyu Wang, Triantafyllos Afouras, David Kant, Wei-Ning Hsu |
| 2024 | Interspeech | Learning Fine-Grained Controllability on Speech Generation via Efficient Fine-Tuning. | Chung-Ming Chien, Andros Tjandra, Apoorv Vyas, Matt Le, Bowen Shi, Wei-Ning Hsu |
| 2023 | ICASSP | Voice-Preserving Zero-Shot Multiple Accent Conversion. | Mumin Jin, Prashant Serai, Jilong Wu, Andros Tjandra, Vimal Manohar, Qing He |
| 2023 | ICASSP | Massively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities. | Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer |
| 2023 | ICASSP | Learning ASR Pathways: A Sparse Multilingual ASR Model. | Mu Yang, Andros Tjandra, Chunxi Liu, David Zhang, Duc Le, Ozlem Kalinli |
| 2022 | ICASSP | Conformer-Based Self-Supervised Learning For Non-Speech Audio Tasks. | Sangeeta Srivastava, Yun Wang, Andros Tjandra, Anurag Kumar, Chunxi Liu, Kritika Singh, Yatharth Saraf |
| 2022 | ICASSP | Improved Language Identification Through Cross-Lingual Self-Supervised Learning. | Andros Tjandra, Diptanu Gon Choudhury, Frank Zhang, Kritika Singh, Alexis Conneau, Alexei Baevski, Assaf Sela, Yatharth Saraf, Michael Auli |
| 2022 | Interspeech | XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale. | Arun Babu, Changhan Wang, Andros Tjandra, Kushal Lakhotia, Qiantong Xu, Naman Goyal, Kritika Singh, Patrick von Platen, Yatharth Saraf, Juan Pino, Alexei Baevski, Alexis Conneau, Michael Auli |
| 2021 | Interspeech | Unsupervised Learning of Disentangled Speech Content and Style Representation. | Andros Tjandra, Ruoming Pang, Yu Zhang, Shigeki Karita |
| 2020 | ICASSP | DEJA-VU: Double Feature Presentation and Iterated Loss in Deep Transformer Networks. | Andros Tjandra, Chunxi Liu, Frank Zhang, Xiaohui Zhang, Yongqiang Wang, Gabriel Synnaeve, Satoshi Nakamura, Geoffrey Zweig |
| 2020 | ICASSP | Transformer-Based Acoustic Modeling for Hybrid Speech Recognition. | Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer |
| 2020 | Interspeech | Augmenting Images for ASR and TTS Through Single-Loop and Dual-Loop Multimodal Chain Framework. | Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2020 | Interspeech | Incremental Machine Speech Chain Towards Enabling Listening While Speaking in Real-Time. | Sashi Novitasari, Andros Tjandra, Tomoya Yanagita, Sakriani Sakti, Satoshi Nakamura |
| 2020 | Interspeech | Transformer VQ-VAE for Unsupervised Unit Discovery and Speech Synthesis: ZeroSpeech 2020 Challenge. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ASRU | Listening While Speaking and Visualizing: Improving ASR Through Multimodal Chain. | Johanes Effendi, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ASRU | Zero-Shot Code-Switching ASR and TTS with Multilingual Machine Speech Chain. | Sahoko Nakayama, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ASRU | Speech-to-Speech Translation Between Untranscribed Unknown Languages. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | ICASSP | End-to-end Feedback Loss in Speech Chain Framework via Straight-through Estimator. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | Interspeech | Sequence-to-Sequence Learning via Attention Transfer for Incremental Speech Recognition. | Sashi Novitasari, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2019 | Interspeech | VQVAE Unsupervised Unit Discovery and Multi-Scale Code2Spec Inverter for Zerospeech Challenge 2019. | Andros Tjandra, Berrak Sisman, Mingyang Zhang, Sakriani Sakti, Haizhou Li, Satoshi Nakamura |
| 2018 | ICASSP | Sequence-to-Sequence Asr Optimization Via Reinforcement Learning. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2018 | IJCNN | Tensor Decomposition for Compressing Recurrent Neural Network. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2018 | Interspeech | Compressing End-to-end ASR Networks by Tensor-Train Decomposition. | Takuma Mori, Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2018 | Interspeech | Machine Speech Chain with One-shot Speaker Adaptation. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | ASRU | Listening while speaking: Speech chain by deep learning. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | ASRU | Attention-based Wav2Text with feature transfer learning. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | IJCNLP | Local Monotonic Attention Mechanism for End-to-End Speech And Language Processing. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2017 | IJCNN | Compressing recurrent neural network with tensor train. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura |
| 2016 | IJCNN | Gated Recurrent Neural Tensor Network. | Andros Tjandra, Sakriani Sakti, Ruli Manurung, Mirna Adriani, Satoshi Nakamura |
| 2015 | ASRU | Stochastic Gradient Variational Bayes for deep learning-based ASR. | Andros Tjandra, Sakriani Sakti, Satoshi Nakamura, Mirna Adriani |
| 2015 | ICASSP | Combination of two-dimensional cochleogram and spectrogram features for deep learning-based ASR. | Andros Tjandra, Sakriani Sakti, Graham Neubig, Tomoki Toda, Mirna Adriani, Satoshi Nakamura |