| 2025 | CogSci | From Observation to Attribution: How Event Features Shape Responsibility Judgments in Real-World Traffic Videos. | Yiyuan Zhang, Liane Young, Stefano Anzellotti |
| 2025 | ICCV | FairGen: Enhancing Fairness in Text-to-Image Diffusion Models via Self-Discovering Latent Directions. | Yilei Jiang, Wei-Hong Li, Yiyuan Zhang, Minghong Cai, Xiangyu Yue |
| 2025 | ICCV | Breaking the Encoder Barrier for Seamless Video-Language Understanding. | Handong Li, Yiyuan Zhang, Longteng Guo, Xiangyu Yue, Jing Liu |
| 2025 | ICCV | MUG: Pseudo Labeling Augmented Audio-Visual Mamba Network for Audio-Visual Video Parsing. | Langyu Wang, Bingke Zhu, Yingying Chen, Yiyuan Zhang, Ming Tang, Jinqiao Wang |
| 2025 | ICCV | Learning Beyond Still Frames: Scaling Vision-Language Models with Video. | Yiyuan Zhang, Handong Jing, Jing Liu, Xiangyu Yue |
| 2025 | ICCV | Scaling Omni-Modal Pretraining with Multimodal Context: Advancing Universal Representation Learning Across Modalities. | Yiyuan Zhang, Handong Li, Jing Liu, Xiangyu Yue |
| 2025 | ICIG | Dual-Chain Reasoning: Enhancing Multimodal Document VQA Through Positive and Negative Reasoning Paths. | Yiyuan Zhang, Hanxiao Wu, Zhaopeng Gu, Dong Yi, Guibo Zhu, Jinqiao Wang |
| 2024 | CVPR | Text-to-3D Generation with Bidirectional Diffusion Using Both 2D and 3D Priors. | Lihe Ding, Shaocong Dong, Zhanpeng Huang, Zibin Wang, Yiyuan Zhang, Kaixiong Gong, Dan Xu, Tianfan Xue |
| 2024 | CVPR | UniRepLKNet: A Universal Perception Large-Kernel ConvNet for Audio, Video, Point Cloud, Time-Series and Image Recognition. | Xiaohan Ding, Yiyuan Zhang, Yixiao Ge, Sijie Zhao, Lin Song, Xiangyu Yue, Ying Shan |
| 2024 | CVPR | OneLLM: One Framework to Align All Modalities with Language. | Jiaming Han, Kaixiong Gong, Yiyuan Zhang, Jiaqi Wang, Kaipeng Zhang, Dahua Lin, Yu Qiao, Peng Gao, Xiangyu Yue |
| 2024 | CVPR | Multimodal Pathway: Improve Transformers with Irrelevant Data from Other Modalities. | Yiyuan Zhang, Xiaohan Ding, Kaixiong Gong, Yixiao Ge, Ying Shan, Xiangyu Yue |
| 2024 | ECCV | Online Vectorized HD Map Construction Using Geometry. | Zhixin Zhang, Yiyuan Zhang, Xiaohan Ding, Fusheng Jin, Xiangyu Yue |
| 2024 | ICRA | Human-Robot Interactive Creation of Artistic Portrait Drawings. | Fei Gao, Lingna Dai, Jingjie Zhu, Mei Du, Yiyuan Zhang, Maoying Qiao, Chenghao Xia, Nannan Wang, Peng Li |
| 2022 | ECCV | Modality Synergy Complement Learning with Cascaded Aggregation for Visible-Infrared Person Re-Identification. | Yiyuan Zhang, Sanyuan Zhao, Yuhao Kang, Jianbing Shen |
| 2022 | IPEC | Improved model for knowledge representation: TransMR. | Xuyang Wang, Yiyuan Zhang |