Brian Yan
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
41
Venues
10
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
41 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Hierarchical Policy Optimization for Simultaneous Translation of Unbounded Speech. | Siqi Ouyang, Shuoyang Ding, Oleksii Hrinchuk, Vitaly Lavrukhin, Brian Yan, Boris Ginsburg, Lei Li |
| 2026 | LREC | CS-YODAS: A Mined Dataset of In-the-Wild Code-Switched Speech. | Brian Yan, Qingzheng Wang, Matthew Wiesner, Anuj Diwan, Olga Iakovenko, Alexander Polok, Injy Hamed, Shuichiro Shimizu, Iris Emerman, Thomas Hain, David R. Mortensen, Peter Viechnicki, Shinji Watanabe |
| 2025 | ICASSP | Improving Multilingual ASR in the Wild Using Simple N-best Re-ranking. | Brian Yan, Vineel Pratap, Shinji Watanabe, Michael Auli |
| 2025 | ICML | OWLS: Scaling Laws for Multilingual Speech Recognition and Translation Models. | William Chen, Jinchuan Tian, Yifan Peng, Brian Yan, Chao-Han Huck Yang, Shinji Watanabe |
| 2025 | Interspeech | CS-FLEURS: A Massively Multilingual and Code-Switched Speech Dataset. | Brian Yan, Injy Hamed, Shuichiro Shimizu, Vasista Sai Lodagala, William Chen, Olga Iakovenko, Bashar Talafha, Amir Hussein, Alexander Polok, Kalvin Chang, Dominik Klement, Sara Althubaiti, Puyuan Peng, Matthew Wiesner, Thamar Solorio, Ahmed Ali, Sanjeev Khudanpur, Shinji Watanabe |
| 2024 | ICASSP | Exploring Speech Recognition, Translation, and Understanding with Discrete Speech Units: A Comparative Study. | Xuankai Chang, Brian Yan, Kwanghee Choi, Jee-Weon Jung, Yichen Lu, Soumi Maiti, Roshan S. Sharma, Jiatong Shi, Jinchuan Tian, Shinji Watanabe, Yuya Fujita, Takashi Maekaku, Pengcheng Guo, Yao-Fei Cheng, Pavel Denisov, Kohei Saijo, Hsiu-Hsuan Wang |
| 2024 | ICASSP | Enhancing End-to-End Conversational Speech Translation Through Target Language Context Utilization. | Amir Hussein, Brian Yan, Antonios Anastasopoulos, Shinji Watanabe, Sanjeev Khudanpur |
| 2024 | ICASSP | Speech Collage: Code-Switched Audio Generation by Collaging Monolingual Corpora. | Amir Hussein, Dorsa Zeinali, Ondrej Klejch, Matthew Wiesner, Brian Yan, Shammur Absar Chowdhury, Ahmed Ali, Shinji Watanabe, Sanjeev Khudanpur |
| 2024 | ICASSP | Cross-Modal Multi-Tasking for Speech-to-Text Translation via Hard Parameter Sharing. | Brian Yan, Xuankai Chang, Antonios Anastasopoulos, Yuya Fujita, Shinji Watanabe |
| 2024 | Interspeech | OWSM v3.1: Better and Faster Open Whisper-Style Speech Models based on E-Branchformer. | Yifan Peng, Jinchuan Tian, William Chen, Siddhant Arora, Brian Yan, Yui Sudo, Muhammad Shakeel, Kwanghee Choi, Jiatong Shi, Xuankai Chang, Jee-weon Jung, Shinji Watanabe |
| 2023 | ACL | ESPnet-ST-v2: Multipurpose Spoken Language Translation Toolkit. | Brian Yan, Jiatong Shi, Yun Tang, Hirofumi Inaguma, Yifan Peng, Siddharth Dalmia, Peter Polak, Patrick Fernandes, Dan Berrebbi, Tomoki Hayashi, Xiaohui Zhang, Zhaoheng Ni, Moto Hira, Soumi Maiti, Juan Pino, Shinji Watanabe |
| 2023 | ASRU | Joint Prediction and Denoising for Large-Scale Multilingual Self-Supervised Learning. | William Chen, Jiatong Shi, Brian Yan, Dan Berrebbi, Wangyou Zhang, Yifan Peng, Xuankai Chang, Soumi Maiti, Shinji Watanabe |
| 2023 | ASRU | Reproducing Whisper-Style Training Using An Open-Source Toolkit And Publicly Available Data. | Yifan Peng, Jinchuan Tian, Brian Yan, Dan Berrebbi, Xuankai Chang, Xinjian Li, Jiatong Shi, Siddhant Arora, William Chen, Roshan S. Sharma, Wangyou Zhang, Yui Sudo, Muhammad Shakeel, Jee-Weon Jung, Soumi Maiti, Shinji Watanabe |
| 2023 | EACL | CTC Alignments Improve Autoregressive Translation. | Brian Yan, Siddharth Dalmia, Yosuke Higuchi, Graham Neubig, Florian Metze, Alan W. Black, Shinji Watanabe |
| 2023 | ICASSP | Joint Modelling of Spoken Language Understanding Tasks with Integrated Dialog History. | Siddhant Arora, Hayato Futami, Emiru Tsunoo, Brian Yan, Shinji Watanabe |
| 2023 | ICASSP | A Study on the Integration of Pipeline and E2E SLU Systems for Spoken Semantic Parsing Toward Stop Quality Challenge. | Siddhant Arora, Hayato Futami, Shih-Lun Wu, Jessica Huynh, Yifan Peng, Yosuke Kashiwagi, Emiru Tsunoo, Brian Yan, Shinji Watanabe |
| 2023 | ICASSP | Avoid Overthinking in Self-Supervised Models for Speech Recognition. | Dan Berrebbi, Brian Yan, Shinji Watanabe |
| 2023 | ICASSP | Improving Massively Multilingual ASR with Auxiliary CTC Objectives. | William Chen, Brian Yan, Jiatong Shi, Yifan Peng, Soumi Maiti, Shinji Watanabe |
| 2023 | ICASSP | The Pipeline System of ASR and NLU with MLM-based data Augmentation Toward Stop Low-Resource Challenge. | Hayato Futami, Jessica Huynh, Siddhant Arora, Shih-Lun Wu, Yosuke Kashiwagi, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe |
| 2023 | ICASSP | E-Branchformer-Based E2E SLU Toward Stop on-Device Challenge. | Yosuke Kashiwagi, Siddhant Arora, Hayato Futami, Jessica Huynh, Shih-Lun Wu, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe |
| 2023 | ICASSP | Align, Write, Re-Order: Explainable End-to-End Speech Translation via Operation Sequence Generation. | Motoi Omachi, Brian Yan, Siddharth Dalmia, Yuya Fujita, Shinji Watanabe |
| 2023 | ICASSP | Towards Zero-Shot Code-Switched Speech Recognition. | Brian Yan, Matthew Wiesner, Ondrej Klejch, Preethi Jyothi, Shinji Watanabe |
| 2023 | ICLR | Bayes Risk CTC: Controllable CTC Alignment in Sequence-to-Sequence Tasks. | Jinchuan Tian, Brian Yan, Jianwei Yu, Chao Weng, Dong Yu, Shinji Watanabe |
| 2023 | Interspeech | Integrating Pretrained ASR and LM to Perform Sequence Generation for Spoken Language Understanding. | Siddhant Arora, Hayato Futami, Yosuke Kashiwagi, Emiru Tsunoo, Brian Yan, Shinji Watanabe |
| 2023 | Interspeech | Exploration of Efficient End-to-End ASR using Discretized Input from Self-Supervised Learning. | Xuankai Chang, Brian Yan, Yuya Fujita, Takashi Maekaku, Shinji Watanabe |
| 2023 | Interspeech | Tensor decomposition for minimization of E2E SLU model toward on-device processing. | Yosuke Kashiwagi, Siddhant Arora, Hayato Futami, Jessica Huynh, Shih-Lun Wu, Yifan Peng, Brian Yan, Emiru Tsunoo, Shinji Watanabe |
| 2023 | Interspeech | A Comparative Study on E-Branchformer vs Conformer in Speech Recognition, Translation, and Understanding Tasks. | Yifan Peng, Kwangyoun Kim, Felix Wu, Brian Yan, Siddhant Arora, William Chen, Jiyang Tang, Suwon Shon, Prashant Sridhar, Shinji Watanabe |
| 2023 | Interspeech | Prompting the Hidden Talent of Web-Scale Speech Models for Zero-Shot Task Generalization. | Puyuan Peng, Brian Yan, Shinji Watanabe, David Harwath |
| 2023 | Interspeech | Incremental Blockwise Beam Search for Simultaneous Speech Translation with Controllable Quality-Latency Tradeoff. | Peter Polk, Brian Yan, Shinji Watanabe, Alex Waibel, Ondrej Bojar |
| 2023 | Interspeech | 4D ASR: Joint modeling of CTC, Attention, Transducer, and Mask-Predict decoders. | Yui Sudo, Muhammad Shakeel, Brian Yan, Jiatong Shi, Shinji Watanabe |
| 2023 | Interspeech | Bayes Risk Transducer: Transducer with Controllable Alignment Prediction. | Jinchuan Tian, Jianwei Yu, Hangting Chen, Brian Yan, Chao Weng, Dong Yu, Shinji Watanabe |
| 2022 | EMNLP | Token-level Sequence Labeling for Spoken Language Understanding using Compositional End-to-End Models. | Siddhant Arora, Siddharth Dalmia, Brian Yan, Florian Metze, Alan W. Black, Shinji Watanabe |
| 2022 | EMNLP | BERT Meets CTC: New Formulation of End-to-End Speech Recognition with Pre-trained Masked Language Model. | Yosuke Higuchi, Brian Yan, Siddhant Arora, Tetsuji Ogawa, Tetsunori Kobayashi, Shinji Watanabe |
| 2022 | ICASSP | ESPnet-SLU: Advancing Spoken Language Understanding Through ESPnet. | Siddhant Arora, Siddharth Dalmia, Pavel Denisov, Xuankai Chang, Yushi Ueda, Yifan Peng, Yuekai Zhang, Sujay Kumar, Karthik Ganesan, Brian Yan, Ngoc Thang Vu, Alan W. Black, Shinji Watanabe |
| 2022 | ICASSP | Joint Modeling of Code-Switched and Monolingual ASR via Conditional Factorization. | Brian Yan, Chunlei Zhang, Meng Yu, Shi-Xiong Zhang, Siddharth Dalmia, Dan Berrebbi, Chao Weng, Shinji Watanabe, Dong Yu |
| 2022 | Interspeech | Two-Pass Low Latency End-to-End Spoken Language Understanding. | Siddhant Arora, Siddharth Dalmia, Xuankai Chang, Brian Yan, Alan W. Black, Shinji Watanabe |
| 2022 | Interspeech | Combining Spectral and Self-Supervised Features for Low Resource Speech Recognition and Translation. | Dan Berrebbi, Jiatong Shi, Brian Yan, Osbel Lpez-Francisco, Jonathan D. Amith, Shinji Watanabe |
| 2022 | Interspeech | ESPnet-SE++: Speech Enhancement for Robust Speech Recognition, Translation, and Understanding. | Yen-Ju Lu, Xuankai Chang, Chenda Li, Wangyou Zhang, Samuele Cornell, Zhaoheng Ni, Yoshiki Masuyama, Brian Yan, Robin Scheibler, Zhong-Qiu Wang, Yu Tsao, Yanmin Qian, Shinji Watanabe |
| 2021 | ASRU | Fast-MD: Fast Multi-Decoder End-to-End Speech Translation with Non-Autoregressive Hidden Intermediates. | Hirofumi Inaguma, Siddharth Dalmia, Brian Yan, Shinji Watanabe |
| 2021 | Interspeech | Differentiable Allophone Graphs for Language-Universal Speech Recognition. | Brian Yan, Siddharth Dalmia, David R. Mortensen, Florian Metze, Shinji Watanabe |
| 2021 | NAACL | Searchable Hidden Intermediates for End-to-End Models of Decomposable Sequence Tasks. | Siddharth Dalmia, Brian Yan, Vikas Raunak, Florian Metze, Shinji Watanabe |