Skip to content

Brian Yan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

41

Venues

10

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

41 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLHierarchical Policy Optimization for Simultaneous Translation of Unbounded Speech.Siqi Ouyang, Shuoyang Ding, Oleksii Hrinchuk, Vitaly Lavrukhin, Brian Yan, Boris Ginsburg, Lei Li
2026LRECCS-YODAS: A Mined Dataset of In-the-Wild Code-Switched Speech.Brian Yan, Qingzheng Wang, Matthew Wiesner, Anuj Diwan, Olga Iakovenko, Alexander Polok, Injy Hamed, Shuichiro Shimizu, Iris Emerman, Thomas Hain, David R. Mortensen, Peter Viechnicki, Shinji Watanabe
2025ICASSPImproving Multilingual ASR in the Wild Using Simple N-best Re-ranking.Brian Yan, Vineel Pratap, Shinji Watanabe, Michael Auli
2025ICMLOWLS: Scaling Laws for Multilingual Speech Recognition and Translation Models.William Chen, Jinchuan Tian, Yifan Peng, Brian Yan, Chao-Han Huck Yang, Shinji Watanabe
2025InterspeechCS-FLEURS: A Massively Multilingual and Code-Switched Speech Dataset.Brian Yan, Injy Hamed, Shuichiro Shimizu, Vasista Sai Lodagala, William Chen, Olga Iakovenko, Bashar Talafha, Amir Hussein, Alexander Polok, Kalvin Chang, Dominik Klement, Sara Althubaiti, Puyuan Peng, Matthew Wiesner, Thamar Solorio, Ahmed Ali, Sanjeev Khudanpur, Shinji Watanabe
2024ICASSPExploring Speech Recognition, Translation, and Understanding with Discrete Speech Units: A Comparative Study.Xuankai Chang, Brian Yan, Kwanghee Choi, Jee-Weon Jung, Yichen Lu, Soumi Maiti, Roshan S. Sharma, Jiatong Shi, Jinchuan Tian, Shinji Watanabe, Yuya Fujita, Takashi Maekaku, Pengcheng Guo, Yao-Fei Cheng, Pavel Denisov, Kohei Saijo, Hsiu-Hsuan Wang
2024ICASSPEnhancing End-to-End Conversational Speech Translation Through Target Language Context Utilization.Amir Hussein, Brian Yan, Antonios Anastasopoulos, Shinji Watanabe, Sanjeev Khudanpur
2024ICASSPSpeech Collage: Code-Switched Audio Generation by Collaging Monolingual Corpora.Amir Hussein, Dorsa Zeinali, Ondrej Klejch, Matthew Wiesner, Brian Yan, Shammur Absar Chowdhury, Ahmed Ali, Shinji Watanabe, Sanjeev Khudanpur
2024ICASSPCross-Modal Multi-Tasking for Speech-to-Text Translation via Hard Parameter Sharing.Brian Yan, Xuankai Chang, Antonios Anastasopoulos, Yuya Fujita, Shinji Watanabe
2024InterspeechOWSM v3.1: Better and Faster Open Whisper-Style Speech Models based on E-Branchformer.Yifan Peng, Jinchuan Tian, William Chen, Siddhant Arora, Brian Yan, Yui Sudo, Muhammad Shakeel, Kwanghee Choi, Jiatong Shi, Xuankai Chang, Jee-weon Jung, Shinji Watanabe
2023ACLESPnet-ST-v2: Multipurpose Spoken Language Translation Toolkit.Brian Yan, Jiatong Shi, Yun Tang, Hirofumi Inaguma, Yifan Peng, Siddharth Dalmia, Peter Polak, Patrick Fernandes, Dan Berrebbi, Tomoki Hayashi, Xiaohui Zhang, Zhaoheng Ni, Moto Hira, Soumi Maiti, Juan Pino, Shinji Watanabe
2023ASRUJoint Prediction and Denoising for Large-Scale Multilingual Self-Supervised Learning.William Chen, Jiatong Shi, Brian Yan, Dan Berrebbi, Wangyou Zhang, Yifan Peng, Xuankai Chang, Soumi Maiti, Shinji Watanabe
2023ASRUReproducing Whisper-Style Training Using An Open-Source Toolkit And Publicly Available Data.Yifan Peng, Jinchuan Tian, Brian Yan, Dan Berrebbi, Xuankai Chang, Xinjian Li, Jiatong Shi, Siddhant Arora, William Chen, Roshan S. Sharma, Wangyou Zhang, Yui Sudo, Muhammad Shakeel, Jee-Weon Jung, Soumi Maiti, Shinji Watanabe
2023EACLCTC Alignments Improve Autoregressive Translation.Brian Yan, Siddharth Dalmia, Yosuke Higuchi, Graham Neubig, Florian Metze, Alan W. Black, Shinji Watanabe
2023ICASSPJoint Modelling of Spoken Language Understanding Tasks with Integrated Dialog History.Siddhant Arora, Hayato Futami, Emiru Tsunoo, Brian Yan, Shinji Watanabe
2023ICASSPA Study on the Integration of Pipeline and E2E SLU Systems for Spoken Semantic Parsing Toward Stop Quality Challenge.Siddhant Arora, Hayato Futami, Shih-Lun Wu, Jessica Huynh, Yifan Peng, Yosuke Kashiwagi, Emiru Tsunoo, Brian Yan, Shinji Watanabe
2023ICASSPAvoid Overthinking in Self-Supervised Models for Speech Recognition.Dan Berrebbi, Brian Yan, Shinji Watanabe
2023ICASSPImproving Massively Multilingual ASR with Auxiliary CTC Objectives.William Chen, Brian Yan, Jiatong Shi, Yifan Peng, Soumi Maiti, Shinji Watanabe
2023ICASSPThe Pipeline System of ASR and NLU with MLM-based data Augmentation Toward Stop Low-Resource Challenge.Hayato Futami, Jessica Huynh, Siddhant Arora, Shih-Lun Wu, Yosuke Kashiwagi, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe
2023ICASSPE-Branchformer-Based E2E SLU Toward Stop on-Device Challenge.Yosuke Kashiwagi, Siddhant Arora, Hayato Futami, Jessica Huynh, Shih-Lun Wu, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe
2023ICASSPAlign, Write, Re-Order: Explainable End-to-End Speech Translation via Operation Sequence Generation.Motoi Omachi, Brian Yan, Siddharth Dalmia, Yuya Fujita, Shinji Watanabe
2023ICASSPTowards Zero-Shot Code-Switched Speech Recognition.Brian Yan, Matthew Wiesner, Ondrej Klejch, Preethi Jyothi, Shinji Watanabe
2023ICLRBayes Risk CTC: Controllable CTC Alignment in Sequence-to-Sequence Tasks.Jinchuan Tian, Brian Yan, Jianwei Yu, Chao Weng, Dong Yu, Shinji Watanabe
2023InterspeechIntegrating Pretrained ASR and LM to Perform Sequence Generation for Spoken Language Understanding.Siddhant Arora, Hayato Futami, Yosuke Kashiwagi, Emiru Tsunoo, Brian Yan, Shinji Watanabe
2023InterspeechExploration of Efficient End-to-End ASR using Discretized Input from Self-Supervised Learning.Xuankai Chang, Brian Yan, Yuya Fujita, Takashi Maekaku, Shinji Watanabe
2023InterspeechTensor decomposition for minimization of E2E SLU model toward on-device processing.Yosuke Kashiwagi, Siddhant Arora, Hayato Futami, Jessica Huynh, Shih-Lun Wu, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe
2023InterspeechA Comparative Study on E-Branchformer vs Conformer in Speech Recognition, Translation, and Understanding Tasks.Yifan Peng, Kwangyoun Kim, Felix Wu, Brian Yan, Siddhant Arora, William Chen, Jiyang Tang, Suwon Shon, Prashant Sridhar, Shinji Watanabe
2023InterspeechPrompting the Hidden Talent of Web-Scale Speech Models for Zero-Shot Task Generalization.Puyuan Peng, Brian Yan, Shinji Watanabe, David Harwath
2023InterspeechIncremental Blockwise Beam Search for Simultaneous Speech Translation with Controllable Quality-Latency Tradeoff.Peter Polk, Brian Yan, Shinji Watanabe, Alex Waibel, Ondrej Bojar
2023Interspeech4D ASR: Joint modeling of CTC, Attention, Transducer, and Mask-Predict decoders.Yui Sudo, Muhammad Shakeel, Brian Yan, Jiatong Shi, Shinji Watanabe
2023InterspeechBayes Risk Transducer: Transducer with Controllable Alignment Prediction.Jinchuan Tian, Jianwei Yu, Hangting Chen, Brian Yan, Chao Weng, Dong Yu, Shinji Watanabe
2022EMNLPToken-level Sequence Labeling for Spoken Language Understanding using Compositional End-to-End Models.Siddhant Arora, Siddharth Dalmia, Brian Yan, Florian Metze, Alan W. Black, Shinji Watanabe
2022EMNLPBERT Meets CTC: New Formulation of End-to-End Speech Recognition with Pre-trained Masked Language Model.Yosuke Higuchi, Brian Yan, Siddhant Arora, Tetsuji Ogawa, Tetsunori Kobayashi, Shinji Watanabe
2022ICASSPESPnet-SLU: Advancing Spoken Language Understanding Through ESPnet.Siddhant Arora, Siddharth Dalmia, Pavel Denisov, Xuankai Chang, Yushi Ueda, Yifan Peng, Yuekai Zhang, Sujay Kumar, Karthik Ganesan, Brian Yan, Ngoc Thang Vu, Alan W. Black, Shinji Watanabe
2022ICASSPJoint Modeling of Code-Switched and Monolingual ASR via Conditional Factorization.Brian Yan, Chunlei Zhang, Meng Yu, Shi-Xiong Zhang, Siddharth Dalmia, Dan Berrebbi, Chao Weng, Shinji Watanabe, Dong Yu
2022InterspeechTwo-Pass Low Latency End-to-End Spoken Language Understanding.Siddhant Arora, Siddharth Dalmia, Xuankai Chang, Brian Yan, Alan W. Black, Shinji Watanabe
2022InterspeechCombining Spectral and Self-Supervised Features for Low Resource Speech Recognition and Translation.Dan Berrebbi, Jiatong Shi, Brian Yan, Osbel Lpez-Francisco, Jonathan D. Amith, Shinji Watanabe
2022InterspeechESPnet-SE++: Speech Enhancement for Robust Speech Recognition, Translation, and Understanding.Yen-Ju Lu, Xuankai Chang, Chenda Li, Wangyou Zhang, Samuele Cornell, Zhaoheng Ni, Yoshiki Masuyama, Brian Yan, Robin Scheibler, Zhong-Qiu Wang, Yu Tsao, Yanmin Qian, Shinji Watanabe
2021ASRUFast-MD: Fast Multi-Decoder End-to-End Speech Translation with Non-Autoregressive Hidden Intermediates.Hirofumi Inaguma, Siddharth Dalmia, Brian Yan, Shinji Watanabe
2021InterspeechDifferentiable Allophone Graphs for Language-Universal Speech Recognition.Brian Yan, Siddharth Dalmia, David R. Mortensen, Florian Metze, Shinji Watanabe
2021NAACLSearchable Hidden Intermediates for End-to-End Models of Decomposable Sequence Tasks.Siddharth Dalmia, Brian Yan, Vikas Raunak, Florian Metze, Shinji Watanabe