| 2026 | ACL | DR-HM: Distill-then-Reinforce Training with Cognition-Aware Data Synthesis for Harmful Meme Detection. | Zihan Cheng, Jianxiang Ma, Xiaocui Yang, Peidong Wang, Wen Zhang, Shi Feng, Daling Wang, Yifei Zhang, Mingfu Zhang |
| 2026 | ACL | NEAT: Neuron-Based Early Exit for Large Reasoning Models. | Kang Liu, YongKang Liu, Xiaocui Yang, Peidong Wang, Wen Zhang, Shi Feng, Yifei Zhang, Daling Wang |
| 2026 | ACL | SAFE-QAQ: End-to-End Slow-Thinking Audio-Text Fraud Detection via Reinforcement Learning. | Peidong Wang, Zhiming Ma, Xin Dai, Yongkang Liu, Shi Feng, Xiaocui Yang, Wenxing Hu, Zhihao Wang, Mingjun Pan, Li Yuan, Daling Wang |
| 2025 | ACL | AnnaAgent: Dynamic Evolution Agent System with Multi-Session Memory for Realistic Seeker Simulation. | Ming Wang, Peidong Wang, Lin Wu, Xiaocui Yang, Daling Wang, Shi Feng, Yuxin Chen, Bixuan Wang, Yifei Zhang |
| 2025 | ACL | Failing Forward: Improving Generative Error Correction for ASR with Synthetic Data and Retrieval Augmentation. | Sreyan Ghosh, Mohammad Sadegh Rasooli, Michael Levit, Peidong Wang, Jian Xue, Dinesh Manocha, Jinyu Li |
| 2025 | EMNLP | Language Models as Continuous Self-Evolving Data Engineers. | Peidong Wang, Ming Wang, Zhiming Ma, Xiaocui Yang, Shi Feng, Daling Wang, Yifei Zhang, Kaisong Song |
| 2024 | ACL | STICKERCONV: Generating Multimodal Empathetic Responses from Scratch. | Yiqun Zhang, Fanheng Kong, Peidong Wang, Shuang Sun, Lingshuai Wang, Shi Feng, Daling Wang, Yifei Zhang, Kaisong Song |
| 2024 | COLING | TIGER: A Unified Generative Model Framework for Multimodal Dialogue Response Generation. | Fanheng Kong, Peidong Wang, Shi Feng, Daling Wang, Yifei Zhang |
| 2024 | ICASSP | Leveraging Timestamp Information for Serialized Joint Streaming Recognition and Translation. | Sara Papi, Peidong Wang, Jun-Kun Chen, Jian Xue, Naoyuki Kanda, Jinyu Li, Yashesh Gaur |
| 2024 | ICASSP | Diarist: Streaming Speech Translation with Speaker Diarization. | Mu Yang, Naoyuki Kanda, Xiaofei Wang, Jun-Kun Chen, Peidong Wang, Jian Xue, Jinyu Li, Takuya Yoshioka |
| 2024 | Interspeech | Soft Language Identification for Language-Agnostic Many-to-One End-to-End Speech Translation. | Peidong Wang, Jian Xue, Jinyu Li, Jun-Kun Chen, Aswin Shanmugam Subramanian |
| 2023 | ASRU | Improving Stability in Simultaneous Speech Translation: A Revision-Controllable Decoding Approach. | Jun-Kun Chen, Jian Xue, Peidong Wang, Jing Pan, Jinyu Li |
| 2023 | ASRU | Token-Level Serialized Output Training for Joint Streaming ASR and ST Leveraging Textual Alignments. | Sara Papi, Peidong Wang, Jun-Kun Chen, Jian Xue, Jinyu Li, Yashesh Gaur |
| 2023 | ASRU | Building High-Accuracy Multilingual ASR With Gated Language Experts and Curriculum Training. | Eric Sun, Jinyu Li, Yuxuan Hu, Yimeng Zhu, Long Zhou, Jian Xue, Peidong Wang, Linquan Liu, Shujie Liu, Edward Lin, Yifan Gong |
| 2023 | ASRU | A Weakly-Supervised Streaming Multilingual Speech Model with Truly Zero-Shot Capability. | Jian Xue, Peidong Wang, Jinyu Li, Eric Sun |
| 2023 | ICASSP | Self-Supervised Learning with Bi-Label Masked Speech Prediction for Streaming Multi-Talker Speech Recognition. | Zili Huang, Zhuo Chen, Naoyuki Kanda, Jian Wu, Yiming Wang, Jinyu Li, Takuya Yoshioka, Xiaofei Wang, Peidong Wang |
| 2023 | ICASSP | DATA2VEC-SG: Improving Self-Supervised Learning Representations for Speech Generation Tasks. | Heming Wang, Yao Qian, Hemin Yang, Naoyuki Kanda, Peidong Wang, Takuya Yoshioka, Xiaofei Wang, Yiming Wang, Shujie Liu, Zhuo Chen, DeLiang Wang, Michael Zeng |
| 2023 | Interspeech | LAMASSU: A Streaming Language-Agnostic Multilingual Speech Recognition and Translation Model Using Neural Transducers. | Peidong Wang, Eric Sun, Jian Xue, Yu Wu, Long Zhou, Yashesh Gaur, Shujie Liu, Jinyu Li |
| 2022 | ICASSP | Continuous Speech Separation with Recurrent Selective Attention Network. | Yixuan Zhang, Zhuo Chen, Jian Wu, Takuya Yoshioka, Peidong Wang, Zhong Meng, Jinyu Li |
| 2022 | Interspeech | Why does Self-Supervised Learning for Speech Recognition Benefit Speaker Recognition? | Sanyuan Chen, Yu Wu, Chengyi Wang, Shujie Liu, Zhuo Chen, Peidong Wang, Gang Liu, Jinyu Li, Jian Wu, Xiangzhan Yu, Furu Wei |
| 2022 | Interspeech | Large-Scale Streaming End-to-End Speech Translation with Neural Transducers. | Jian Xue, Peidong Wang, Jinyu Li, Matt Post, Yashesh Gaur |
| 2021 | ICCV | FloW: A Dataset and Benchmark for Floating Waste Detection in Inland Waters. | Yuwei Cheng, Jiannan Zhu, Mengxin Jiang, Jie Fu, Changsong Pang, Peidong Wang, Kris Sankaran, Olawale Onabola, Yimin Liu, Dianbo Liu, Yoshua Bengio |
| 2021 | Interspeech | Multitask Training with Text Data for End-to-End Speech Recognition. | Peidong Wang, Tara N. Sainath, Ron J. Weiss |
| 2019 | ASRU | Speech Separation Using Speaker Inventory. | Peidong Wang, Zhuo Chen, Xiong Xiao, Zhong Meng, Takuya Yoshioka, Tianyan Zhou, Liang Lu, Jinyu Li |
| 2019 | ICASSP | Improving Speech Recognition Error Prediction for Modern and Off-the-shelf Speech Recognizers. | Prashant Serai, Peidong Wang, Eric Fosler-Lussier |
| 2019 | ICASSP | Token-wise Training for Attention Based End-to-end Speech Recognition. | Peidong Wang, Jia Cui, Chao Weng, Dong Yu |
| 2019 | Interspeech | Large Margin Training for Attention Based End-to-End Speech Recognition. | Peidong Wang, Jia Cui, Chao Weng, Dong Yu |
| 2019 | Interspeech | Bridging the Gap Between Monaural Speech Enhancement and Recognition with Distortion-Independent Acoustic Modeling. | Peidong Wang, Ke Tan, DeLiang Wang |
| 2019 | Interspeech | Enhanced Spectral Features for Distortion-Independent Acoustic Modeling. | Peidong Wang, DeLiang Wang |
| 2018 | ICASSP | Utterance-Wise Recurrent Dropout and Iterative Speaker Adaptation for Robust Monaural Speech Recognition. | Peidong Wang, DeLiang Wang |
| 2018 | ICASSP | Filter-and-Convolve: A Cnn Based Multichannel Complex Concatenation Acoustic Model. | Peidong Wang, DeLiang Wang |