Shang-Wen Li
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
36
Venues
10
Active years
2020–2026
Best venue rank
A*
Where they publish
Papers
36 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | VoiceStar: Robust Zero-Shot Autoregressive TTS with Duration Control and Extrapolation. | Puyuan Peng, Zhisheng Zheng, Shang-Wen Li, Abdelrahman Mohamed, David Harwath |
| 2025 | ICML | SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models. | Yung-Sung Chuang, Benjamin Cohen-Wang, Zejiang Shen, Zhaofeng Wu, Hu Xu, Xi Victoria Lin, James R. Glass, Shang-Wen Li, Wen-tau Yih |
| 2024 | ACL | VoiceCraft: Zero-Shot Speech Editing and Text-to-Speech in the Wild. | Puyuan Peng, Po-Yao Huang, Shang-Wen Li, Abdelrahman Mohamed, David Harwath |
| 2024 | CVPR | MoDE: CLIP Data Experts via Clustering. | Jiawei Ma, Po-Yao Huang, Saining Xie, Shang-Wen Li, Luke Zettlemoyer, Shih-Fu Chang, Wen-Tau Yih, Hu Xu |
| 2024 | EMNLP | Altogether: Image Captioning via Re-aligning Alt-text. | Hu Xu, Po-Yao Huang, Xiaoqing Ellen Tan, Ching-Feng Yeh, Jacob Kahn, Christine Jou, Gargi Ghosh, Omer Levy, Luke Zettlemoyer, Wen-tau Yih, Shang-Wen Li, Saining Xie, Christoph Feichtenhofer |
| 2024 | ICASSP | SD-HuBERT: Sentence-Level Self-Distillation Induces Syllabic Organization in Hubert. | Cheol Jun Cho, Abdelrahman Mohamed, Shang-Wen Li, Alan W. Black, Gopala Krishna Anumanchipalli |
| 2024 | ICASSP | SpeechDPR: End-To-End Spoken Passage Retrieval For Open-Domain Spoken Question Answering. | Chyi-Jiunn Lin, Guan-Ting Lin, Yung-Sung Chuang, Wei-Lun Wu, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Lin-Shan Lee |
| 2024 | ICASSP | AV-SUPERB: A Multi-Task Evaluation Benchmark for Audio-Visual Representation Models. | Yuan Tseng, Layne Berry, Yiting Chen, I-Hsiang Chiu, Hsuan-Hao Lin, Max Liu, Puyuan Peng, Yi-Jen Shih, Hung-Yu Wang, Haibin Wu, Poyao Huang, Chun-Mao Lai, Shang-Wen Li, David Harwath, Yu Tsao, Abdelrahman Mohamed, Chi-Luen Feng, Hung-Yi Lee |
| 2024 | ICLR | Demystifying CLIP Data. | Hu Xu, Saining Xie, Xiaoqing Ellen Tan, Po-Yao Huang, Russell Howes, Vasu Sharma, Shang-Wen Li, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer |
| 2024 | Interspeech | Exploring In-Context Learning of Textless Speech Language Model for Speech Classification Tasks. | Kai-Wei Chang, Ming-Hao Hsu, Shang-Wen Li, Hung-yi Lee |
| 2024 | Interspeech | GSQA: An End-to-End Model for Generative Spoken Question Answering. | Min-Han Shih, Ho-Lam Chung, Yu-Chi Pai, Ming-Hao Hsu, Guan-Ting Lin, Shang-Wen Li, Hung-yi Lee |
| 2023 | ACL | Expand, Rerank, and Retrieve: Query Reranking for Open-Domain Question Answering. | Yung-Sung Chuang, Wei Fang, Shang-Wen Li, Wen-tau Yih, James R. Glass |
| 2023 | ACL | Introducing Semantics into Speech Encoders. | Derek Xu, Shuyan Dong, Changhan Wang, Suyoun Kim, Zhaojiang Lin, Bing Liu, Akshat Shrivastava, Shang-Wen Li, Liang-Hsuan Tseng, Guan-Ting Lin, Alexei Baevski, Hung-yi Lee, Yizhou Sun, Wei Wang |
| 2023 | ASRU | Prompting and Adapter Tuning For Self-Supervised Encoder-Decoder Speech Model. | Kai-Wei Chang, Ming-Hsin Chen, Yun-Ping Lin, Jing Neng Hsu, Paul Kuo-Ming Huang, Chien-Yu Huang, Shang-Wen Li, Hung-Yi Lee |
| 2023 | ASRU | Findings of the 2023 ML-Superb Challenge: Pre-Training And Evaluation Over More Languages And Beyond. | Jiatong Shi, William Chen, Dan Berrebbi, Hsiu-Hsuan Wang, Wei-Ping Huang, En-Pei Hu, Ho-Lam Chuang, Xuankai Chang, Yuxun Tang, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Shinji Watanabe |
| 2023 | ASRU | Flap: Fast Language-Audio Pre-Training. | Ching-Feng Yeh, Po-Yao Huang, Vasu Sharma, Shang-Wen Li, Gargi Ghosh |
| 2023 | ICASSP | Disentangled Training with Adversarial Examples for Robust Small-Footprint Keyword Spotting. | Zhenyu Wang, Li Wan, Biqiao Zhang, Yiteng Huang, Shang-Wen Li, Ming Sun, Xin Lei, Zhaojun Yang |
| 2023 | Interspeech | Syllable Discovery and Cross-Lingual Generalization in a Visually Grounded, Self-Supervised Speech Model. | Puyuan Peng, Shang-Wen Li, Okko Rsnen, Abdelrahman Mohamed, David Harwath |
| 2023 | Interspeech | ML-SUPERB: Multilingual Speech Universal PERformance Benchmark. | Jiatong Shi, Dan Berrebbi, William Chen, En-Pei Hu, Wei-Ping Huang, Ho-Lam Chung, Xuankai Chang, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Shinji Watanabe |
| 2023 | Interspeech | Improving Textless Spoken Language Understanding with Discrete Units as Intermediate Target. | Guan-Wei Wu, Guan-Ting Lin, Shang-Wen Li, Hung-yi Lee |
| 2022 | ACL | SUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative Capabilities. | Hsiang-Sheng Tsai, Heng-Jui Chang, Wen-Chin Huang, Zili Huang, Kushal Lakhotia, Shu-Wen Yang, Shuyan Dong, Andy T. Liu, Cheng-I Lai, Jiatong Shi, Xuankai Chang, Phil Hall, Hsuan-Jui Chen, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee |
| 2022 | Interspeech | An Exploration of Prompt Tuning on Generative Spoken Language Model for Speech Processing Tasks. | Kai-Wei Chang, Wei-Cheng Tseng, Shang-Wen Li, Hung-yi Lee |
| 2022 | Interspeech | Listen, Adapt, Better WER: Source-free Single-utterance Test-time Adaptation for Automatic Speech Recognition. | Guan-Ting Lin, Shang-Wen Li, Hung-yi Lee |
| 2022 | Interspeech | DUAL: Discrete Spoken Unit Adaptive Learning for Textless Spoken Question Answering. | Guan-Ting Lin, Yung-Sung Chuang, Ho-Lam Chung, Shu-Wen Yang, Hsuan-Jui Chen, Shuyan Annie Dong, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Lin-Shan Lee |
| 2022 | NAACL | DiffCSE: Difference-based Contrastive Learning for Sentence Embeddings. | Yung-Sung Chuang, Rumen Dangovski, Hongyin Luo, Yang Zhang, Shiyu Chang, Marin Soljacic, Shang-Wen Li, Scott Yih, Yoon Kim, James R. Glass |
| 2022 | NAACL | Lifelong Pretraining: Continually Adapting Language Models to Emerging Corpora. | Xisen Jin, Dejiao Zhang, Henghui Zhu, Wei Xiao, Shang-Wen Li, Xiaokai Wei, Andrew O. Arnold, Xiang Ren |
| 2022 | NAACL | Meta Learning for Natural Language Processing: A Survey. | Hung-yi Lee, Shang-Wen Li, Thang Vu |
| 2022 | NAACL | Cooperative Self-training of Machine Reading Comprehension. | Hongyin Luo, Shang-Wen Li, Mingye Gao, Seunghak Yu, James R. Glass |
| 2021 | EACL | Zero-shot Generalization in Dialog State Tracking through Generative Question Answering. | Shuyang Li, Jin Cao, Mukund Sridhar, Henghui Zhu, Shang-Wen Li, Wael Hamza, Julian J. McAuley |
| 2021 | EMNLP | Pairwise Supervised Contrastive Learning of Sentence Representations. | Dejiao Zhang, Shang-Wen Li, Wei Xiao, Henghui Zhu, Ramesh Nallapati, Andrew O. Arnold, Bing Xiang |
| 2021 | ICASSP | Semi-Supervised Spoken Language Understanding via Self-Supervised Speech and Language Model Pretraining. | Cheng-I Lai, Yung-Sung Chuang, Hung-Yi Lee, Shang-Wen Li, James R. Glass |
| 2021 | Interspeech | Joint Retrieval-Extraction Training for Evidence-Aware Dialog Response Selection. | Hongyin Luo, James R. Glass, Garima Lalwani, Yi Zhang, Shang-Wen Li |
| 2021 | Interspeech | SUPERB: Speech Processing Universal PERformance Benchmark. | Shu-Wen Yang, Po-Han Chi, Yung-Sung Chuang, Cheng-I Jeff Lai, Kushal Lakhotia, Yist Y. Lin, Andy T. Liu, Jiatong Shi, Xuankai Chang, Guan-Ting Lin, Tzu-Hsien Huang, Wei-Cheng Tseng, Ko-tik Lee, Da-Rong Liu, Zili Huang, Shuyan Dong, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee |
| 2021 | NAACL | Supporting Clustering with Contrastive Learning. | Dejiao Zhang, Feng Nan, Xiaokai Wei, Shang-Wen Li, Henghui Zhu, Kathleen R. McKeown, Ramesh Nallapati, Andrew O. Arnold, Bing Xiang |
| 2020 | Interspeech | Style Attuned Pre-Training and Parameter Efficient Fine-Tuning for Spoken Language Understanding. | Jin Cao, Jun Wang, Wael Hamza, Kelly Vanee, Shang-Wen Li |
| 2020 | Interspeech | Prototypical Q Networks for Automatic Conversational Diagnosis and Few-Shot New Disease Adaption. | Hongyin Luo, Shang-Wen Li, James R. Glass |