| 2025 | CVPR | Argus: Vision-Centric Reasoning with Grounded Chain-of-Thought. | Yunze Man, De-An Huang, Guilin Liu, Shiwei Sheng, Shilong Liu, Liang-Yan Gui, Jan Kautz, Yu-Xiong Wang, Zhiding Yu |
| 2025 | CVPR | Floating No More: Object-Ground Reconstruction from a Single Image. | Yunze Man, Yichen Sheng, Jianming Zhang, Liang-Yan Gui, Yu-Xiong Wang |
| 2025 | CVPR | RandAR: Decoder-only Autoregressive Visual Generation in Random Orders. | Ziqi Pang, Tianyuan Zhang, Fujun Luan, Yunze Man, Hao Tan, Kai Zhang, William T. Freeman, Yu-Xiong Wang |
| 2024 | CVPR | Situational Awareness Matters in 3D Vision Language Reasoning. | Yunze Man, Liang-Yan Gui, Yu-Xiong Wang |
| 2024 | ICLR | Frozen Transformers in Language Models Are Effective Visual Encoder Layers. | Ziqi Pang, Ziyang Xie, Yunze Man, Yu-Xiong Wang |
| 2023 | CVPR | BEV-Guided Multi-Modality Fusion for Driving Perception. | Yunze Man, Liang-Yan Gui, Yu-Xiong Wang |
| 2023 | IROS | DualCross: Cross-Modality Cross-Domain Adaptation for Monocular BEV Perception. | Yunze Man, Liangyan Gui, Yu-Xiong Wang |
| 2022 | AAAI | Fast Graph Neural Tangent Kernel via Kronecker Sketching. | Shunhua Jiang, Yunze Man, Zhao Song, Zheng Yu, Danyang Zhuo |
| 2021 | BMVC | Multi-Modality Task Cascade for 3D Object Detection. | Jinhyung Park, Xinshuo Weng, Yunze Man, Kris Kitani |
| 2021 | ICCV | Multi-Echo LiDAR for 3D Object Detection. | Yunze Man, Xinshuo Weng, Prasanna Kumar Sivakumar, Matthew O'Toole, Kris Kitani |
| 2020 | CVPR | GNN3DMOT: Graph Neural Network for 3D Multi-Object Tracking With 2D-3D Multi-Feature Learning. | Xinshuo Weng, Yongxin Wang, Yunze Man, Kris M. Kitani |