| 2025 | CVPR | Adaptive Unimodal Regulation for Balanced Multimodal Information Acquisition. | Chengxiang Huang, Yake Wei, Zequn Yang, Di Hu |
| 2025 | CVPR | Patch Matters: Training-free Fine-grained Image Caption Enhancement via Local Perception. | Ruotian Peng, Haiying He, Yake Wei, Yandong Wen, Di Hu |
| 2025 | ICML | RollingQ: Reviving the Cooperation Dynamics in Multimodal Transformer. | Haotian Ni, Yake Wei, Hang Liu, Gong Chen, Chong Peng, Hao Lin, Di Hu |
| 2024 | CVPR | Enhancing Multimodal Cooperation via Sample-Level Modality Valuation. | Yake Wei, Ruoxuan Feng, Zihe Wang, Di Hu |
| 2024 | ECCV | Diagnosing and Re-learning for Balanced Multimodal Learning. | Yake Wei, Siwei Li, Ruoxuan Feng, Di Hu |
| 2024 | ICLR | Quantifying and Enhancing Multi-modal Robustness with Modality Preference. | Zequn Yang, Yake Wei, Ce Liang, Di Hu |
| 2024 | ICML | MMPareto: Boosting Multimodal Learning with Innocent Unimodal Assistance. | Yake Wei, Di Hu |
| 2022 | CVPR | Learning to Answer Questions in Dynamic Audio-Visual Scenarios. | Guangyao Li, Yake Wei, Yapeng Tian, Chenliang Xu, Ji-Rong Wen, Di Hu |
| 2022 | CVPR | Balanced Multimodal Learning via On-the-fly Gradient Modulation. | Xiaokang Peng, Yake Wei, Andong Deng, Dong Wang, Di Hu |