| 2024 | CVPR | Leveraging Large Language Models for Multimodal Search. | Oriol Barbany, Michael Huang, Xinliang Zhu, Arnab Dhua |
| 2024 | CVPR | De-noised Vision-language Fusion Guided by Visual Cues for E-commerce Product Search. | Zhizhang Hu, Shasha Li, Ming Du, Arnab Dhua, Douglas Gray |
| 2024 | KDD | Bringing Multimodality to Amazon Visual Search System. | Xinliang Zhu, Sheng-Wei Huang, Han Ding, Jinyu Yang, Kelvin Chen, Tao Zhou, Tal Neiman, Ouye Xie, Son Tran, Benjamin Z. Yao, Douglas Gray, Anuj Bindal, Arnab Dhua |
| 2024 | SIGIR | Multimodal Representation and Retrieval [MRR 2024]. | Xinliang Zhu, Arnab Dhua, Douglas Gray, I. Zeki Yalniz, Tan Yu, Mohamed Elhoseiny, Bryan A. Plummer |
| 2024 | WACV | ProcSim: Proxy-based Confidence for Robust Similarity Learning. | Oriol Barbany, Xiaofan Lin, Muhammet Bastan, Arnab Dhua |
| 2006 | ICPR | Hierarchical, Generic to Specific Multi-class Object Recognition. | Arnab Dhua, Florin Cutzu |
| 2005 | BMVC | Computing Disparity on Demand: Disparity based Classification using Error-Tolerant Decision Tree Ensembles. | Arnab Dhua, Florin Cutzu, John Bailey |
| 2005 | IJCAI | Inferring Image Templates from Classification Decisions. | Arnab Dhua, Florin Cutzu |