| 2024 | ECCV | Goldfish: Vision-Language Understanding of Arbitrarily Long Videos. | Kirolos Ataallah, Xiaoqian Shen, Eslam Abdelrahman, Essam Sleiman, Mingchen Zhuge, Jian Ding, Deyao Zhu, Jrgen Schmidhuber, Mohamed Elhoseiny |
| 2024 | ICLR | MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models. | Deyao Zhu, Jun Chen, Xiaoqian Shen, Xiang Li, Mohamed Elhoseiny |
| 2023 | ICCV | Exploring Open-Vocabulary Semantic Segmentation from CLIP Vision Encoder Distillation Only. | Jun Chen, Deyao Zhu, Guocheng Qian, Bernard Ghanem, Zhicheng Yan, Chenchen Zhu, Fanyi Xiao, Sean Chang Culatana, Mohamed Elhoseiny |
| 2023 | ICLR | Value Memory Graph: A Graph-Structured World Model for Offline Reinforcement Learning. | Deyao Zhu, Li Erran Li, Mohamed Elhoseiny |
| 2022 | CVPR | RelTransformer: A Transformer-Based Long-Tail Visual Relationship Recognition. | Jun Chen, Aniket Agarwal, Sherif Abdelkarim, Deyao Zhu, Mohamed Elhoseiny |
| 2022 | ECCV | Social-Implicit: Rethinking Trajectory Prediction Evaluation and The Effectiveness of Implicit Maximum Likelihood Estimation. | Abduallah A. Mohamed, Deyao Zhu, Warren Vu, Mohamed Elhoseiny, Christian G. Claudel |
| 2021 | CoRL | Motion Forecasting with Unlikelihood Training in Continuous Space. | Deyao Zhu, Mohamed Zahran, Li Erran Li, Mohamed Elhoseiny |
| 2021 | ICLR | HalentNet: Multimodal Trajectory Forecasting with Hallucinative Intents. | Deyao Zhu, Mohamed Zahran, Li Erran Li, Mohamed Elhoseiny |