Skip to content

Shang-Wen Li

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

10

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLVoiceStar: Robust Zero-Shot Autoregressive TTS with Duration Control and Extrapolation.Puyuan Peng, Zhisheng Zheng, Shang-Wen Li, Abdelrahman Mohamed, David Harwath
2025ICMLSelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models.Yung-Sung Chuang, Benjamin Cohen-Wang, Zejiang Shen, Zhaofeng Wu, Hu Xu, Xi Victoria Lin, James R. Glass, Shang-Wen Li, Wen-tau Yih
2024ACLVoiceCraft: Zero-Shot Speech Editing and Text-to-Speech in the Wild.Puyuan Peng, Po-Yao Huang, Shang-Wen Li, Abdelrahman Mohamed, David Harwath
2024CVPRMoDE: CLIP Data Experts via Clustering.Jiawei Ma, Po-Yao Huang, Saining Xie, Shang-Wen Li, Luke Zettlemoyer, Shih-Fu Chang, Wen-Tau Yih, Hu Xu
2024EMNLPAltogether: Image Captioning via Re-aligning Alt-text.Hu Xu, Po-Yao Huang, Xiaoqing Ellen Tan, Ching-Feng Yeh, Jacob Kahn, Christine Jou, Gargi Ghosh, Omer Levy, Luke Zettlemoyer, Wen-tau Yih, Shang-Wen Li, Saining Xie, Christoph Feichtenhofer
2024ICASSPSD-HuBERT: Sentence-Level Self-Distillation Induces Syllabic Organization in Hubert.Cheol Jun Cho, Abdelrahman Mohamed, Shang-Wen Li, Alan W. Black, Gopala Krishna Anumanchipalli
2024ICASSPSpeechDPR: End-To-End Spoken Passage Retrieval For Open-Domain Spoken Question Answering.Chyi-Jiunn Lin, Guan-Ting Lin, Yung-Sung Chuang, Wei-Lun Wu, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Lin-Shan Lee
2024ICASSPAV-SUPERB: A Multi-Task Evaluation Benchmark for Audio-Visual Representation Models.Yuan Tseng, Layne Berry, Yiting Chen, I-Hsiang Chiu, Hsuan-Hao Lin, Max Liu, Puyuan Peng, Yi-Jen Shih, Hung-Yu Wang, Haibin Wu, Poyao Huang, Chun-Mao Lai, Shang-Wen Li, David Harwath, Yu Tsao, Abdelrahman Mohamed, Chi-Luen Feng, Hung-Yi Lee
2024ICLRDemystifying CLIP Data.Hu Xu, Saining Xie, Xiaoqing Ellen Tan, Po-Yao Huang, Russell Howes, Vasu Sharma, Shang-Wen Li, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer
2024InterspeechExploring In-Context Learning of Textless Speech Language Model for Speech Classification Tasks.Kai-Wei Chang, Ming-Hao Hsu, Shang-Wen Li, Hung-yi Lee
2024InterspeechGSQA: An End-to-End Model for Generative Spoken Question Answering.Min-Han Shih, Ho-Lam Chung, Yu-Chi Pai, Ming-Hao Hsu, Guan-Ting Lin, Shang-Wen Li, Hung-yi Lee
2023ACLExpand, Rerank, and Retrieve: Query Reranking for Open-Domain Question Answering.Yung-Sung Chuang, Wei Fang, Shang-Wen Li, Wen-tau Yih, James R. Glass
2023ACLIntroducing Semantics into Speech Encoders.Derek Xu, Shuyan Dong, Changhan Wang, Suyoun Kim, Zhaojiang Lin, Bing Liu, Akshat Shrivastava, Shang-Wen Li, Liang-Hsuan Tseng, Guan-Ting Lin, Alexei Baevski, Hung-yi Lee, Yizhou Sun, Wei Wang
2023ASRUPrompting and Adapter Tuning For Self-Supervised Encoder-Decoder Speech Model.Kai-Wei Chang, Ming-Hsin Chen, Yun-Ping Lin, Jing Neng Hsu, Paul Kuo-Ming Huang, Chien-Yu Huang, Shang-Wen Li, Hung-Yi Lee
2023ASRUFindings of the 2023 ML-Superb Challenge: Pre-Training And Evaluation Over More Languages And Beyond.Jiatong Shi, William Chen, Dan Berrebbi, Hsiu-Hsuan Wang, Wei-Ping Huang, En-Pei Hu, Ho-Lam Chuang, Xuankai Chang, Yuxun Tang, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Shinji Watanabe
2023ASRUFlap: Fast Language-Audio Pre-Training.Ching-Feng Yeh, Po-Yao Huang, Vasu Sharma, Shang-Wen Li, Gargi Ghosh
2023ICASSPDisentangled Training with Adversarial Examples for Robust Small-Footprint Keyword Spotting.Zhenyu Wang, Li Wan, Biqiao Zhang, Yiteng Huang, Shang-Wen Li, Ming Sun, Xin Lei, Zhaojun Yang
2023InterspeechSyllable Discovery and Cross-Lingual Generalization in a Visually Grounded, Self-Supervised Speech Model.Puyuan Peng, Shang-Wen Li, Okko Rsnen, Abdelrahman Mohamed, David Harwath
2023InterspeechML-SUPERB: Multilingual Speech Universal PERformance Benchmark.Jiatong Shi, Dan Berrebbi, William Chen, En-Pei Hu, Wei-Ping Huang, Ho-Lam Chung, Xuankai Chang, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Shinji Watanabe
2023InterspeechImproving Textless Spoken Language Understanding with Discrete Units as Intermediate Target.Guan-Wei Wu, Guan-Ting Lin, Shang-Wen Li, Hung-yi Lee
2022ACLSUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative Capabilities.Hsiang-Sheng Tsai, Heng-Jui Chang, Wen-Chin Huang, Zili Huang, Kushal Lakhotia, Shu-Wen Yang, Shuyan Dong, Andy T. Liu, Cheng-I Lai, Jiatong Shi, Xuankai Chang, Phil Hall, Hsuan-Jui Chen, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee
2022InterspeechAn Exploration of Prompt Tuning on Generative Spoken Language Model for Speech Processing Tasks.Kai-Wei Chang, Wei-Cheng Tseng, Shang-Wen Li, Hung-yi Lee
2022InterspeechListen, Adapt, Better WER: Source-free Single-utterance Test-time Adaptation for Automatic Speech Recognition.Guan-Ting Lin, Shang-Wen Li, Hung-yi Lee
2022InterspeechDUAL: Discrete Spoken Unit Adaptive Learning for Textless Spoken Question Answering.Guan-Ting Lin, Yung-Sung Chuang, Ho-Lam Chung, Shu-Wen Yang, Hsuan-Jui Chen, Shuyan Annie Dong, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Lin-Shan Lee
2022NAACLDiffCSE: Difference-based Contrastive Learning for Sentence Embeddings.Yung-Sung Chuang, Rumen Dangovski, Hongyin Luo, Yang Zhang, Shiyu Chang, Marin Soljacic, Shang-Wen Li, Scott Yih, Yoon Kim, James R. Glass
2022NAACLLifelong Pretraining: Continually Adapting Language Models to Emerging Corpora.Xisen Jin, Dejiao Zhang, Henghui Zhu, Wei Xiao, Shang-Wen Li, Xiaokai Wei, Andrew O. Arnold, Xiang Ren
2022NAACLMeta Learning for Natural Language Processing: A Survey.Hung-yi Lee, Shang-Wen Li, Thang Vu
2022NAACLCooperative Self-training of Machine Reading Comprehension.Hongyin Luo, Shang-Wen Li, Mingye Gao, Seunghak Yu, James R. Glass
2021EACLZero-shot Generalization in Dialog State Tracking through Generative Question Answering.Shuyang Li, Jin Cao, Mukund Sridhar, Henghui Zhu, Shang-Wen Li, Wael Hamza, Julian J. McAuley
2021EMNLPPairwise Supervised Contrastive Learning of Sentence Representations.Dejiao Zhang, Shang-Wen Li, Wei Xiao, Henghui Zhu, Ramesh Nallapati, Andrew O. Arnold, Bing Xiang
2021ICASSPSemi-Supervised Spoken Language Understanding via Self-Supervised Speech and Language Model Pretraining.Cheng-I Lai, Yung-Sung Chuang, Hung-Yi Lee, Shang-Wen Li, James R. Glass
2021InterspeechJoint Retrieval-Extraction Training for Evidence-Aware Dialog Response Selection.Hongyin Luo, James R. Glass, Garima Lalwani, Yi Zhang, Shang-Wen Li
2021InterspeechSUPERB: Speech Processing Universal PERformance Benchmark.Shu-Wen Yang, Po-Han Chi, Yung-Sung Chuang, Cheng-I Jeff Lai, Kushal Lakhotia, Yist Y. Lin, Andy T. Liu, Jiatong Shi, Xuankai Chang, Guan-Ting Lin, Tzu-Hsien Huang, Wei-Cheng Tseng, Ko-tik Lee, Da-Rong Liu, Zili Huang, Shuyan Dong, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee
2021NAACLSupporting Clustering with Contrastive Learning.Dejiao Zhang, Feng Nan, Xiaokai Wei, Shang-Wen Li, Henghui Zhu, Kathleen R. McKeown, Ramesh Nallapati, Andrew O. Arnold, Bing Xiang
2020InterspeechStyle Attuned Pre-Training and Parameter Efficient Fine-Tuning for Spoken Language Understanding.Jin Cao, Jun Wang, Wael Hamza, Kelly Vanee, Shang-Wen Li
2020InterspeechPrototypical Q Networks for Automatic Conversational Diagnosis and Few-Shot New Disease Adaption.Hongyin Luo, Shang-Wen Li, James R. Glass