| 2026 | ACL | PRInTS: Reward Modeling for Long-Horizon Information Seeking. | Jaewoo Lee, Archiki Prasad, Justin Chih-Yao Chen, Zaid Khan, Elias Stengel-Eskin, Mohit Bansal |
| 2025 | ICCV | DWIM: Towards Tool-Aware Visual Reasoning via Discrepancy-Aware Workflow Generation & Instruct-Masking Tuning. | Fucai Ke, Vijay Kumar B. G, Xingjian Leng, Zhixi Cai, Zaid Khan, Weiqing Wang, Pari Delir Haghighi, Hamid Rezatofighi, Manmohan Chandraker |
| 2025 | ICLR | DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback. | Zaid Khan, Elias Stengel-Eskin, Jaemin Cho, Mohit Bansal |
| 2024 | CVPR | Consistency and Uncertainty: Identifying Unreliable Responses From Black-Box Vision-Language Models for Selective Visual Question Answering. | Zaid Khan, Yun Fu |
| 2024 | CVPR | Self-Training Large Language Models for Improved Visual Program Synthesis With Visual Reinforcement. | Zaid Khan, Vijay Kumar B. G, Samuel Schulter, Yun Fu, Manmohan Chandraker |
| 2023 | CVPR | Q: How to Specialize Large Vision-Language Models to Data-Scarce VQA Tasks? A: Self-Train on Unlabeled Images! | Zaid Khan, B. G. Vijay Kumar, Samuel Schulter, Xiang Yu, Yun Fu, Manmohan Chandraker |
| 2023 | ICLR | Contrastive Alignment of Vision to Language Through Parameter-Efficient Transfer Learning. | Zaid Khan, Yun Fu |
| 2022 | BIBE | Attention-based Automated Chest CT Image Segmentation Method of COVID-19 Lung Infection. | Beom J. Lee, Sarkis T. Martirosyan, Zaid Khan, Han Y. Chiu, Zun Wang, Wenqi Shi, Felipe O. Giuste, Yishan Zhong, Jimin Sun, May Dongmei Wang |
| 2022 | ECCV | Single-Stream Multi-level Alignment for Vision-Language Pretraining. | Zaid Khan, B. G. Vijay Kumar, Xiang Yu, Samuel Schulter, Manmohan Chandraker, Yun Fu |
| 2020 | VTC | Pilot Spacing Adaptation in OFDM for a Flexible Next Generation Waveform. | Zaid Khan, Muhammad Danish Nisar |