| 2025 | ICLR | Language-Image Models with 3D Understanding. | Jang Hyun Cho, Boris Ivanovic, Yulong Cao, Edward Schmerling, Yue Wang, Xinshuo Weng, Boyi Li, Yurong You, Philipp Krhenbhl, Yan Wang, Marco Pavone |
| 2025 | ICRA | Gen-Drive: Enhancing Diffusion Generative Driving Policies with Reward Modeling and Reinforcement Learning Fine-Tuning. | Zhiyu Huang, Xinshuo Weng, Maximilian Igl, Yuxiao Chen, Yulong Cao, Boris Ivanovic, Marco Pavone, Chen Lv |
| 2024 | CoRL | Promptable Closed-loop Traffic Simulation. | Shuhan Tan, Boris Ivanovic, Yuxiao Chen, Boyi Li, Xinshuo Weng, Yulong Cao, Philipp Krhenbhl, Marco Pavone |
| 2024 | CoRL | Tokenize the World into Object-level Knowledge to Address Long-tail Events in Autonomous Driving. | Ran Tian, Boyi Li, Xinshuo Weng, Yuxiao Chen, Edward Schmerling, Yue Wang, Boris Ivanovic, Marco Pavone |
| 2024 | CVPR | PARA-Drive: Parallelized Architecture for Real-Time Autonomous Driving. | Xinshuo Weng, Boris Ivanovic, Yan Wang, Yue Wang, Marco Pavone |
| 2024 | ICLR | EmerNeRF: Emergent Spatial-Temporal Scene Decomposition via Self-Supervision. | Jiawei Yang, Boris Ivanovic, Or Litany, Xinshuo Weng, Seung Wook Kim, Boyi Li, Tong Che, Danfei Xu, Sanja Fidler, Marco Pavone, Yue Wang |
| 2024 | ICRA | Augmenting Lane Perception and Topology Understanding with Standard Definition Navigation Maps. | Katie Z. Luo, Xinshuo Weng, Yan Wang, Shuang Wu, Jie Li, Kilian Q. Weinberger, Yue Wang, Marco Pavone |
| 2023 | CoRL | Language Conditioned Traffic Generation. | Shuhan Tan, Boris Ivanovic, Xinshuo Weng, Marco Pavone, Philipp Krhenbhl |
| 2023 | CVPR | Observation-Centric SORT: Rethinking SORT for Robust Multi-Object Tracking. | Jinkun Cao, Jiangmiao Pang, Xinshuo Weng, Rawal Khirodkar, Kris Kitani |
| 2023 | ICRA | Tree-structured Policy Planning with Learned Behavior Models. | Yuxiao Chen, Pter Karkus, Boris Ivanovic, Xinshuo Weng, Marco Pavone |
| 2022 | CoRL | Robust Trajectory Prediction against Adversarial Attacks. | Yulong Cao, Danfei Xu, Xinshuo Weng, Zhuoqing Mao, Anima Anandkumar, Chaowei Xiao, Marco Pavone |
| 2022 | CVPR | Whose Track Is It Anyway? Improving Robustness to Tracking Errors with Affinity-based Trajectory Prediction. | Xinshuo Weng, Boris Ivanovic, Kris Kitani, Marco Pavone |
| 2022 | ECCV | S2Net: Stochastic Sequential Pointcloud Forecasting. | Xinshuo Weng, Junyu Nan, Kuan-Hui Lee, Rowan McAllister, Adrien Gaidon, Nicholas Rhinehart, Kris M. Kitani |
| 2021 | BMVC | Multi-Modality Task Cascade for 3D Object Detection. | Jinhyung Park, Xinshuo Weng, Yunze Man, Kris Kitani |
| 2021 | CVPR | Wide-Baseline Multi-Camera Calibration Using Person Re-Identification. | Yan Xu, Yu-Jhe Li, Xinshuo Weng, Kris Kitani |
| 2021 | ICCV | AgentFormer: Agent-Aware Transformers for Socio-Temporal Multi-Agent Forecasting. | Ye Yuan, Xinshuo Weng, Yanglan Ou, Kris Kitani |
| 2021 | ICCV | Visio-Temporal Attention for Multi-Camera Multi-Target Association. | Yu-Jhe Li, Xinshuo Weng, Yan Xu, Kris Kitani |
| 2021 | ICCV | Multi-Echo LiDAR for 3D Object Detection. | Yunze Man, Xinshuo Weng, Prasanna Kumar Sivakumar, Matthew O'Toole, Kris Kitani |
| 2021 | ICRA | Joint Object Detection and Multi-Object Tracking with Graph Neural Networks. | Yongxin Wang, Kris Kitani, Xinshuo Weng |
| 2021 | WACV | Learning Shape Representations for Person Re-Identification under Clothing Change. | Yu-Jhe Li, Xinshuo Weng, Kris M. Kitani |
| 2020 | CoRL | Inverting the Pose Forecasting Pipeline with SPF2: Sequential Pointcloud Forecasting for Sequential Pose Forecasting. | Xinshuo Weng, Jianren Wang, Sergey Levine, Kris Kitani, Nicholas Rhinehart |
| 2020 | CVPR | GNN3DMOT: Graph Neural Network for 3D Multi-Object Tracking With 2D-3D Multi-Feature Learning. | Xinshuo Weng, Yongxin Wang, Yunze Man, Kris M. Kitani |
| 2020 | IROS | When We First Met: Visual-Inertial Person Localization for Co-Robot Rendezvous. | Xi Sun, Xinshuo Weng, Kris Kitani |
| 2020 | IROS | 3D Multi-Object Tracking: A Baseline and New Evaluation Metrics. | Xinshuo Weng, Jianren Wang, David Held, Kris Kitani |
| 2019 | BMVC | Learning Spatio-Temporal Features with Two-Stream Deep 3D CNNs for Lipreading. | Xinshuo Weng, Kris Kitani |
| 2019 | IROS | Forecasting Time-to-Collision from Monocular Video: Feasibility, Dataset, and Challenges. | Aashi Manglik, Xinshuo Weng, Eshed Ohn-Bar, Kris M. Kitani |
| 2018 | CVPR | Supervision-by-Registration: An Unsupervised Approach to Improve the Precision of Facial Landmark Detectors. | Xuanyi Dong, Shoou-I Yu, Xinshuo Weng, Shih-En Wei, Yi Yang, Yaser Sheikh |
| 2018 | WACV | Rotational Rectification Network: Enabling Pedestrian Detection for Mobile Vision. | Xinshuo Weng, Shangxuan Wu, Fares Beainy, Kris M. Kitani |