Skip to content

Alireza Fathi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

31

Venues

6

Active years

2007–2025

Best venue rank

A*

Where they publish

Papers

31 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRFirePlace: Geometric Refinements of LLM Common Sense Reasoning for 3D Object Placement.Ian Huang, Yanan Bao, Karen Truong, Howard Zhou, Cordelia Schmid, Leonidas J. Guibas, Alireza Fathi
2025CVPRVisual Lexicon: Rich Image Features in Language Space.Xudong Wang, Xingyi Zhou, Alireza Fathi, Trevor Darrell, Cordelia Schmid
2025CVPRLanguage-Guided Image Tokenization for Generation.Kaiwen Zha, Lijun Yu, Alireza Fathi, David A. Ross, Cordelia Schmid, Dina Katabi, Xiuye Gu
2024CVPRA Generative Approach for Wikipedia-Scale Visual Entity Recognition.Mathilde Caron, Ahmet Iscen, Alireza Fathi, Cordelia Schmid
2024ICLRRetrieval-Enhanced Contrastive Vision-Text Models.Ahmet Iscen, Mathilde Caron, Alireza Fathi, Cordelia Schmid
2024ICMLSceneCraft: An LLM Agent for Synthesizing 3D Scenes as Blender Code.Ziniu Hu, Ahmet Iscen, Aashi Jain, Thomas Kipf, Yisong Yue, David A. Ross, Cordelia Schmid, Alireza Fathi
2023CVPRReveal: Retrieval-Augmented Visual-Language Pre-Training with Multi-Source Multimodal Knowledge Memory.Ziniu Hu, Ahmet Iscen, Chen Sun, Zirui Wang, Kai-Wei Chang, Yizhou Sun, Cordelia Schmid, David A. Ross, Alireza Fathi
2023CVPRImproving Image Recognition by Retrieving from Web-Scale Image-Text Data.Ahmet Iscen, Alireza Fathi, Cordelia Schmid
2022BMVCA Memory Transformer Network for Incremental Learning.Ahmet Iscen, Thomas Bird, Mathilde Caron, Alireza Fathi, Cordelia Schmid
2022CVPRPanoptic Neural Fields: A Semantic Object-Aware Neural Scene Representation.Abhijit Kundu, Kyle Genova, Xiaoqi Yin, Alireza Fathi, Caroline Pantofaru, Leonidas J. Guibas, Andrea Tagliasacchi, Frank Dellaert, Thomas A. Funkhouser
2022ECCVPreTraM: Self-supervised Pre-training via Connecting Trajectory and Map.Chenfeng Xu, Tian Li, Chen Tang, Lingfeng Sun, Kurt Keutzer, Masayoshi Tomizuka, Alireza Fathi, Wei Zhan
2020CVPR3D-MPA: Multi-Proposal Aggregation for 3D Semantic Instance Segmentation.Francis Engelmann, Martin Bokeloh, Alireza Fathi, Bastian Leibe, Matthias Niener
2020CVPRDOPS: Learning to Detect 3D Objects and Predict Their 3D Shapes.Mahyar Najibi, Guangda Lai, Abhijit Kundu, Zhichao Lu, Vivek Rathod, Thomas A. Funkhouser, Caroline Pantofaru, David A. Ross, Larry S. Davis, Alireza Fathi
2020ECCVAn LSTM Approach to Temporal 3D Object Detection in LiDAR Point Clouds.Rui Huang, Wanyue Zhang, Abhijit Kundu, Caroline Pantofaru, David A. Ross, Thomas A. Funkhouser, Alireza Fathi
2020ECCVVirtual Multi-view Fusion for 3D Semantic Segmentation.Abhijit Kundu, Xiaoqi Yin, Alireza Fathi, David A. Ross, Brian Brewington, Thomas A. Funkhouser, Caroline Pantofaru
2020ECCVPillar-Based Object Detection for Autonomous Driving.Yue Wang, Alireza Fathi, Abhijit Kundu, David A. Ross, Caroline Pantofaru, Thomas A. Funkhouser, Justin Solomon
2018CVPRInstance Embedding Transfer to Unsupervised Video Object Segmentation.Siyang Li, Bryan Seybold, Alexey Vorobyov, Alireza Fathi, Qin Huang, C.-C. Jay Kuo
2018ECCVTracking Emerges by Colorizing Videos.Carl Vondrick, Abhinav Shrivastava, Alireza Fathi, Sergio Guadarrama, Kevin Murphy
2017BMVCThe Devil is in the Decoder.Zbigniew Wojna, Jasper R. R. Uijlings, Sergio Guadarrama, Nathan Silberman, Liang-Chieh Chen, Alireza Fathi, Vittorio Ferrari
2017CVPRSpeed/Accuracy Trade-Offs for Modern Convolutional Object Detectors.Jonathan Huang, Vivek Rathod, Chen Sun, Menglong Zhu, Anoop Korattikara, Alireza Fathi, Ian Fischer, Zbigniew Wojna, Yang Song, Sergio Guadarrama, Kevin Murphy
2014CVPRAn Introduction to the 3rd Workshop on Egocentric (First-Person) Vision.Steve Mann, Kris M. Kitani, Yong Jae Lee, Michael S. Ryoo, Alireza Fathi
2014ECCVReasoning about Object Affordances in a Knowledge Base Representation.Yuke Zhu, Alireza Fathi, Li Fei-Fei
2013CVPRModeling Actions through State Changes.Alireza Fathi, James M. Rehg
2013ICCVLearning to Predict Gaze in Egocentric Video.Yin Li, Alireza Fathi, James M. Rehg
2012CVPRSocial interactions: A first-person perspective.Alireza Fathi, Jessica K. Hodgins, James M. Rehg
2012ECCVLearning to Recognize Daily Actions Using Gaze.Alireza Fathi, Yin Li, James M. Rehg
2011BMVCCombining Self Training and Active Learning for Video Segmentation.Alireza Fathi, Maria-Florina Balcan, Xiaofeng Ren, James M. Rehg
2011CVPRLearning to recognize objects in egocentric activities.Alireza Fathi, Xiaofeng Ren, James M. Rehg
2011ICCVUnderstanding egocentric activities.Alireza Fathi, Ali Farhadi, James M. Rehg
2008CVPRAction recognition by learning mid-level motion features.Alireza Fathi, Greg Mori
2007ICCVHuman Pose Estimation using Motion Exemplars.Alireza Fathi, Greg Mori