Irfan Essa
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
42
Venues
17
Active years
2017–2025
Best venue rank
A*
Where they publish
Papers
42 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | AAAI | Limitations in Employing Natural Language Supervision for Sensor-Based Human Activity Recognition - And Ways to Overcome Them. | Harish Haresamudram, Apoorva Beedu, Mashfiqui Rabbi, Sankalita Saha, Irfan Essa, Thomas Ploetz |
| 2025 | ACL | AfriMed-QA: A Pan-African, Multi-Specialty, Medical Question-Answering Benchmark Dataset. | Charles Nimo, Tobi Olatunji, Abraham Toluwase Owodunni, Tassallah Abdullahi, Emmanuel Ayodele, Mardhiyah Sanni, Ezinwanne C. Aka, Folafunmi Omofoye, Foutse Yuehgoh, Timothy Faniran, Bonaventure F. P. Dossou, Moshood O. Yekini, Jonas Kemp, Katherine A. Heller, Jude Chidubem Omeke, Chidi Asuzu MD, Naome A. Etori, Aimrou Ndiaye, Ifeoma Okoh, Evans Doe Ocansey, Wendy Kinara, Michael L. Best, Irfan Essa, Stephen Edward Moore, Chris Fourie, Mercy Nyamewaa Asiedu |
| 2025 | CVPR | Cropper: Vision-Language Model for Image Cropping through In-Context Learning. | Seung Hyun Lee, Jijun Jiang, Yiran Xu, Zhuofang Li, Junjie Ke, Yinxiao Li, Junfeng He, Steven Hickson, Katie Datsenko, Sangpil Kim, Ming-Hsuan Yang, Irfan Essa, Feng Yang |
| 2025 | CVPR | Calibrated Multi-Preference Optimization for Aligning Diffusion Models. | Kyungmin Lee, Xiahong Li, Qifei Wang, Junfeng He, Junjie Ke, Ming-Hsuan Yang, Irfan Essa, Jinwoo Shin, Feng Yang, Yinxiao Li |
| 2025 | EMNLP | Africa Health Check: Probing Cultural Bias in Medical LLMs. | Charles Nimo, Shuheng Liu, Irfan Essa, Michael L. Best |
| 2025 | ICASSP | Mamba Fusion: Learning Actions Through Questioning. | Apoorva Beedu, Zhikang Dong, Jason Sheinkopf, Irfan Essa |
| 2025 | ICASSP | Text Descriptions of Actions and Objects Improve Action Anticipation. | Apoorva Beedu, Harish Haresamudram, Irfan Essa |
| 2025 | ICIP | Enabling Controllable, Identity Preserving, Non-Rigid Edits in Human-Centric Images. | Nikolai Warner, Jack Kolb, Meera Hahn, Jonathan Huang, Vighnesh Birodkar, Irfan Essa |
| 2024 | CVPR | SLAIM: Robust Dense Neural SLAM for Online Tracking and Mapping. | Vincent Cartillier, Grant Schindler, Irfan Essa |
| 2024 | CVPR | Prompt-Free Diffusion: Taking "Text" Out of Text-to-Image Diffusion Models. | Xingqian Xu, Jiayi Guo, Zhangyang Wang, Gao Huang, Irfan Essa, Humphrey Shi |
| 2024 | ECCV | Photorealistic Video Generation with Diffusion Models. | Agrim Gupta, Lijun Yu, Kihyuk Sohn, Xiuye Gu, Meera Hahn, Fei-Fei Li, Irfan Essa, Lu Jiang, Jos Lezama |
| 2024 | ECCV | Parrot: Pareto-Optimal Multi-reward Reinforcement Learning Framework for Text-to-Image Generation. | Seung Hyun Lee, Yinxiao Li, Junjie Ke, Innfarn Yoo, Han Zhang, Jiahui Yu, Qifei Wang, Fei Deng, Glenn Entis, Junfeng He, Gang Li, Sangpil Kim, Irfan Essa, Feng Yang |
| 2024 | ICLR | Language Model Beats Diffusion - Tokenizer is key to visual generation. | Lijun Yu, Jos Lezama, Nitesh Bharadwaj Gundavarapu, Luca Versari, Kihyuk Sohn, David Minnen, Yong Cheng, Agrim Gupta, Xiuye Gu, Alexander G. Hauptmann, Boqing Gong, Ming-Hsuan Yang, Irfan Essa, David A. Ross, Lu Jiang |
| 2024 | ICML | VideoPoet: A Large Language Model for Zero-Shot Video Generation. | Dan Kondratyuk, Lijun Yu, Xiuye Gu, Jos Lezama, Jonathan Huang, Grant Schindler, Rachel Hornung, Vighnesh Birodkar, Jimmy Yan, Ming-Chang Chiu, Krishna Somandepalli, Hassan Akbari, Yair Alon, Yong Cheng, Joshua V. Dillon, Agrim Gupta, Meera Hahn, Anja Hauth, David Hendon, Alonso Martinez, David Minnen, Mikhail Sirotenko, Kihyuk Sohn, Xuan Yang, Hartwig Adam, Ming-Hsuan Yang, Irfan Essa, Huisheng Wang, David A. Ross, Bryan Seybold, Lu Jiang |
| 2024 | IROS | BayRnTune: Adaptive Bayesian Domain Randomization via Strategic Fine-tuning. | Tianle Huang, Nitish Sontakke, K. Niranjan Kumar, Irfan Essa, Stefanos Nikolaidis, Dennis W. Hong, Sehoon Ha |
| 2023 | BMVC | Text and Click inputs for unambiguous open vocabulary instance segmentation. | Vighnesh Birodkar, Jonathan Huang, Meera Hahn, Irfan Essa, Nikolai Warner |
| 2023 | CHI | Slide Gestalt: Automatic Structure Extraction in Slide Decks for Non-Visual Access. | Yi-Hao Peng, Peggy Chi, Anjuli Kannan, Meredith Ringel Morris, Irfan Essa |
| 2023 | CVPR | MaskSketch: Unpaired Structure-guided Masked Image Generation. | Dina Bashkirova, Jos Lezama, Kihyuk Sohn, Kate Saenko, Irfan Essa |
| 2023 | CVPR | Visual Prompt Tuning for Generative Transfer Learning. | Kihyuk Sohn, Huiwen Chang, Jos Lezama, Luisa Polania, Han Zhang, Yuan Hao, Irfan Essa, Lu Jiang |
| 2023 | CVPR | MAGVIT: Masked Generative Video Transformer. | Lijun Yu, Yong Cheng, Kihyuk Sohn, Jos Lezama, Han Zhang, Huiwen Chang, Alexander G. Hauptmann, Ming-Hsuan Yang, Yuan Hao, Irfan Essa, Lu Jiang |
| 2023 | ICLR | Discrete Predictor-Corrector Diffusion Models for Image Synthesis. | Jos Lezama, Tim Salimans, Lu Jiang, Huiwen Chang, Jonathan Ho, Irfan Essa |
| 2023 | ICLR | Emergence of Maps in the Memories of Blind Navigation Agents. | Erik Wijmans, Manolis Savva, Irfan Essa, Stefan Lee, Ari S. Morcos, Dhruv Batra |
| 2023 | PERCOM | Investigating Enhancements to Contrastive Predictive Coding for Human Activity Recognition. | Harish Haresamudram, Irfan Essa, Thomas Pltz |
| 2022 | ECCV | BLT: Bidirectional Layout Transformer for Controllable Layout Generation. | Xiang Kong, Lu Jiang, Huiwen Chang, Han Zhang, Yuan Hao, Haifeng Gong, Irfan Essa |
| 2022 | ECCV | Improved Masked Image Generation with Token-Critic. | Jos Lezama, Huiwen Chang, Lu Jiang, Irfan Essa |
| 2022 | ICLR | Discrete Representations Strengthen Vision Transformer Robustness. | Chengzhi Mao, Lu Jiang, Mostafa Dehghani, Carl Vondrick, Rahul Sukthankar, Irfan Essa |
| 2022 | ICRA | Graph-based Cluttered Scene Generation and Interactive Exploration using Deep Reinforcement Learning. | K. Niranjan Kumar, Irfan Essa, Sehoon Ha |
| 2022 | ICTD | Tackling Hate Speech in Low-resource Languages with Context Experts. | Daniel Nkemelu, Harshil Shah, Michael L. Best, Irfan Essa |
| 2022 | UIST | Synthesis-Assisted Video Prototyping From a Document. | Peggy Chi, Tao Dong, Christian Frh, Brian Colonna, Vivek Kwatra, Irfan Essa |
| 2021 | AAAI | Semantic MapNet: Building Allocentric Semantic Maps and Representations from Egocentric Views. | Vincent Cartillier, Zhile Ren, Neha Jain, Stefan Lee, Irfan Essa, Dhruv Batra |
| 2021 | BMVC | Unsupervised Discovery of Actions in Instructional Videos. | A. J. Piergiovanni, Anelia Angelova, Michael S. Ryoo, Irfan Essa |
| 2021 | CHI | Automatic Generation of Two-Level Hierarchical Tutorials from Instructional Makeup Videos. | Anh Truong, Peggy Chi, David Salesin, Irfan Essa, Maneesh Agrawala |
| 2021 | UIST | Automatic Instructional Video Creation from a Markdown-Formatted Tutorial. | Peggy Chi, Nathan Frey, Katrina Panovich, Irfan Essa |
| 2020 | ECCV | Neural Design Network: Graphic Layout Generation with Constraints. | Hsin-Ying Lee, Lu Jiang, Irfan Essa, Phuong B. Le, Haifeng Gong, Ming-Hsuan Yang, Weilong Yang |
| 2020 | ICLR | DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion Frames. | Erik Wijmans, Abhishek Kadian, Ari Morcos, Stefan Lee, Irfan Essa, Devi Parikh, Manolis Savva, Dhruv Batra |
| 2020 | UIST | Automatic Video Creation From a Web Page. | Peggy Chi, Zheng Sun, Katrina Panovich, Irfan Essa |
| 2019 | CVPR | Audio Visual Scene-Aware Dialog. | Huda AlAmri, Vincent Cartillier, Abhishek Das, Jue Wang, Anoop Cherian, Irfan Essa, Dhruv Batra, Tim K. Marks, Chiori Hori, Peter Anderson, Stefan Lee, Devi Parikh |
| 2019 | CVPR | Embodied Question Answering in Photorealistic Environments With Point Cloud Perception. | Erik Wijmans, Samyak Datta, Oleksandr Maksymets, Abhishek Das, Georgia Gkioxari, Stefan Lee, Irfan Essa, Devi Parikh, Dhruv Batra |
| 2019 | ICASSP | End-to-end Audio Visual Scene-aware Dialog Using Multimodal Attention-based Video Features. | Chiori Hori, Huda AlAmri, Jue Wang, Gordon Wichern, Takaaki Hori, Anoop Cherian, Tim K. Marks, Vincent Cartillier, Raphael Gontijo Lopes, Abhishek Das, Irfan Essa, Dhruv Batra, Devi Parikh |
| 2019 | ICRA | A Data-Driven Predictive Model of Individual-Specific Effects of FES on Human Gait Dynamics. | Luke Drnach, Jessica L. Allen, Irfan Essa, Lena H. Ting |
| 2018 | NDSS | rtCaptcha: A Real-Time CAPTCHA Based Liveness Detection System. | Erkam Uzun, Simon Pak Ho Chung, Irfan Essa, Wenke Lee |
| 2017 | BMVC | One-Shot Learning for Semantic Segmentation. | Amirreza Shaban, Shray Bansal, Zhen Liu, Irfan Essa, Byron Boots |