| 2025 | AAAI | TIV-Diffusion: Towards Object-Centric Movement for Text-driven Image to Video Generation. | Xingrui Wang, Xin Li, Yaosi Hu, Hanxin Zhu, Chen Hou, Cuiling Lan, Zhibo Chen |
| 2025 | CVPR | Spatial457: A Diagnostic Benchmark for 6D Spatial Reasoning of Large Mutimodal Models. | Xingrui Wang, Wufei Ma, Tiezheng Zhang, Celso M. de Melo, Jieneng Chen, Alan L. Yuille |
| 2025 | ICLR | Compositional 4D Dynamic Scenes Understanding with Physics Priors for Video Question Answering. | Xingrui Wang, Wufei Ma, Angtian Wang, Shuo Chen, Adam Kortylewski, Alan L. Yuille |
| 2024 | ECCV | MoE-DiffIR: Task-Customized Diffusion Priors for Universal Compressed Image Restoration. | Yulin Ren, Xin Li, Bingchen Li, Xingrui Wang, Mengxi Guo, Shijie Zhao, Li Zhang, Zhibo Chen |
| 2023 | CVPR | Super-CLEVR: A Virtual Benchmark to Diagnose Domain Robustness in Visual Reasoning. | Zhuowan Li, Xingrui Wang, Elias Stengel-Eskin, Adam Kortylewski, Wufei Ma, Benjamin Van Durme, Alan L. Yuille |
| 2022 | ECCV | Contributions of Shape, Texture, and Color in Visual Recognition. | Yunhao Ge, Yao Xiao, Zhi Xu, Xingrui Wang, Laurent Itti |
| 2022 | IJCNN | Exploring Coarse-grained Pre-guided Attention to Assist Fine-grained Attention Reinforcement Learning Agents. | Haoyu Liu, Yang Liu, Xingrui Wang, Hanfang Yang |