| 2025 | CVPR | Insight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models. | Yuhao Dong, Zuyan Liu, Hai-Long Sun, Jingkang Yang, Winston Hu, Yongming Rao, Ziwei Liu |
| 2025 | ICCV | SparseMM: Head Sparsity Emerges from Visual Concept Responses in MLLMs. | Jiahui Wang, Zuyan Liu, Yongming Rao, Jiwen Lu |
| 2025 | ICLR | Oryx MLLM: On-Demand Spatial-Temporal Understanding at Arbitrary Resolution. | Zuyan Liu, Yuhao Dong, Ziwei Liu, Winston Hu, Jiwen Lu, Yongming Rao |
| 2024 | ECCV | Efficient Inference of Vision Instruction-Following Models with Elastic Cache. | Zuyan Liu, Benlin Liu, Jiahui Wang, Yuhao Dong, Guangyi Chen, Yongming Rao, Ranjay Krishna, Jiwen Lu |
| 2023 | CVPR | DiffSwap: High-Fidelity and Controllable Face Swapping via 3D-Aware Masked Diffusion. | Wenliang Zhao, Yongming Rao, Weikang Shi, Zuyan Liu, Jie Zhou, Jiwen Lu |
| 2023 | ICCV | Unleashing Text-to-Image Diffusion Models for Visual Perception. | Wenliang Zhao, Yongming Rao, Zuyan Liu, Benlin Liu, Jie Zhou, Jiwen Lu |
| 2021 | ICCV | PoinTr: Diverse Point Cloud Completion with Geometry-Aware Transformers. | Xumin Yu, Yongming Rao, Ziyi Wang, Zuyan Liu, Jiwen Lu, Jie Zhou |