| 2026 | ACL | v-HUB: A Benchmark for Video Humor Understanding from Vision and Sound. | Zhengpeng Shi, Yanpeng Zhao, Jianqun Zhou, Yuxuan Wang, Qinrong Cui, Wei Bi, Song-Chun Zhu, Bo Zhao, Zilong Zheng |
| 2025 | CCS | AgentSentinel: An End-to-End and Real-Time Security Defense Framework for Computer-Use Agents. | Haitao Hu, Peng Chen, Yanpeng Zhao, Yuqi Chen |
| 2024 | ICLR | DynaVol: Unsupervised Learning for Dynamic Scenes through Object-Centric Voxelization. | Yanpeng Zhao, Siyu Gao, Yunbo Wang, Xiaokang Yang |
| 2023 | EMNLP | On the Transferability of Visually Grounded PCFGs. | Yanpeng Zhao, Ivan Titov |
| 2022 | CVPR | MERLOT RESERVE: Neural Script Knowledge through Vision and Language and Sound. | Rowan Zellers, Jiasen Lu, Ximing Lu, Youngjae Yu, Yanpeng Zhao, Mohammadreza Salehi, Aditya Kusupati, Jack Hessel, Ali Farhadi, Yejin Choi |
| 2022 | NAACL | Connecting the Dots between Audio and Text without Parallel Data through Visual Knowledge Transfer. | Yanpeng Zhao, Jack Hessel, Youngjae Yu, Ximing Lu, Rowan Zellers, Yejin Choi |
| 2021 | ACL | Neural Bi-Lexicalized PCFG Induction. | Songlin Yang, Yanpeng Zhao, Kewei Tu |
| 2021 | EACL | Unsupervised Natural Language Parsing (Introductory Tutorial). | Kewei Tu, Yong Jiang, Wenjuan Han, Yanpeng Zhao |
| 2021 | NAACL | PCFGs Can Do Better: Inducing Probabilistic Context-Free Grammars with Many Symbols. | Songlin Yang, Yanpeng Zhao, Kewei Tu |
| 2020 | EMNLP | Visually Grounded Compound PCFGs. | Yanpeng Zhao, Ivan Titov |
| 2018 | ACL | Gaussian Mixture Latent Vector Grammars. | Yanpeng Zhao, Liwen Zhang, Kewei Tu |
| 2017 | ICCV | Structured Attentions for Visual Question Answering. | Chen Zhu, Yanpeng Zhao, Shuaiyi Huang, Kewei Tu, Yi Ma |
| 2015 | ACML | Curriculum Learning of Bayesian Network Structures. | Yanpeng Zhao, Yetian Chen, Kewei Tu, Jin Tian |