Skip to content

Lorenzo Torresani

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

80

Venues

15

Active years

2001–2026

Best venue rank

A*

Where they publish

Papers

80 indexed papers, newest first.

YearVenueTitleAuthors
2026WACVTimeRefine: Temporal Grounding with Time Refining Video LLM.Xizi Wang, Feng Cheng, Ziyang Wang, Huiyu Wang, Md Mohaiminul Islam, Lorenzo Torresani, Mohit Bansal, Gedas Bertasius, David Crandall
2025CVPRBIMBA: Selective-Scan Compression for Long-Range Video Question Answering.Md Mohaiminul Islam, Tushar Nagarajan, Huiyu Wang, Gedas Bertasius, Lorenzo Torresani
2025CVPRVITED: Video Temporal Evidence Distillation.Yujie Lu, Yale Song, William Wang, Lorenzo Torresani, Tushar Nagarajan
2025ICCVEnrich and Detect: Video Temporal Grounding With Multimodal Llms.Shraman Pramanick, Effrosyni Mavroudi, Yale Song, Rama Chellappa, Lorenzo Torresani, Triantafyllos Afouras
2024CVPREgo-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives.Kristen Grauman, Andrew Westbury, Lorenzo Torresani, Kris Kitani, Jitendra Malik, Triantafyllos Afouras, Kumar Ashutosh, Vijay Baiyya, Siddhant Bansal, Bikram Boote, Eugene Byrne, Zachary Chavis, Joya Chen, Feng Cheng, Fu-Jen Chu, Sean Crane, Avijit Dasgupta, Jing Dong, Mara Escobar, Cristhian Forigua, Abrham Gebreselasie, Sanjay Haresh, Jing Huang, Md Mohaiminul Islam, Suyog Dutt Jain, Rawal Khirodkar, Devansh Kukreja, Kevin J. Liang, Jia-Wei Liu, Sagnik Majumder, Yongsen Mao, Miguel Martin, Effrosyni Mavroudi, Tushar Nagarajan, Francesco Ragusa, Santhosh Kumar Ramakrishnan, Luigi Seminara, Arjun Somayazulu, Yale Song, Shan Su, Zihui Xue, Edward Zhang, Jinxu Zhang, Angela Castillo, Changan Chen, Xinzhu Fu, Ryosuke Furuta, Cristina Gonzlez, Prince Gupta, Jiabo Hu, Yifei Huang, Yiming Huang, Weslie Khoo, Anush Kumar, Robert Kuo, Sach Lakhavani, Miao Liu, Mi Luo, Zhengyi Luo, Brighid Meredith, Austin Miller, Oluwatumininu Oguntola, Xiaqing Pan, Penny Peng, Shraman Pramanick, Merey Ramazanova, Fiona Ryan, Wei Shan, Kiran K. Somasundaram, Chenan Song, Audrey Southerland, Masatoshi Tateno, Huiyu Wang, Yuchen Wang, Takuma Yagi, Mingfei Yan, Xitong Yang, Zecheng Yu, Shengxin Cindy Zha, Chen Zhao, Ziwei Zhao, Zhifan Zhu, Jeff Zhuo, Pablo Arbelez, Gedas Bertasius, Dima Damen, Jakob J. Engel, Giovanni Maria Farinella, Antonino Furnari, Bernard Ghanem, Judy Hoffman, C. V. Jawahar, Richard A. Newcombe, Hyun Soo Park, James M. Rehg, Yoichi Sato, Manolis Savva, Jianbo Shi, Mike Zheng Shout, Michael Wray
2024CVPRVideo ReCap: Recursive Captioning of Hour-Long Videos.Md Mohaiminul Islam, Ngan Ho, Xitong Yang, Tushar Nagarajan, Lorenzo Torresani, Gedas Bertasius
2024CVPROpen-world Instance Segmentation: Top-down Learning with Bottom-up Supervision.Tarun Kalluri, Weiyao Wang, Heng Wang, Manmohan Chandraker, Lorenzo Torresani, Du Tran
2024CVPRStep Differences in Instructional Video.Tushar Nagarajan, Lorenzo Torresani
2024CVPRLearning to Segment Referred Objects from Narrated Egocentric Videos.Yuhan Shen, Huiyu Wang, Xitong Yang, Matt Feiszli, Ehsan Elhamifar, Lorenzo Torresani, Effrosyni Mavroudi
2024ECCV4DIFF: 3D-Aware Diffusion Model for Third-to-First Viewpoint Translation.Feng Cheng, Mi Luo, Huiyu Wang, Alex Dimakis, Lorenzo Torresani, Gedas Bertasius, Kristen Grauman
2024EMNLPUNICORN: A Unified Causal Video-Oriented Language-Modeling Framework for Temporal Video-Language Tasks.Yuanhao Xiong, Yixin Nie, Haotian Liu, Boxin Wang, Jun Chen, Rong Jin, Cho-Jui Hsieh, Lorenzo Torresani, Jie Lei
2023CVPRHierVL: Learning Hierarchical Video-Language Embeddings.Kumar Ashutosh, Rohit Girdhar, Lorenzo Torresani, Kristen Grauman
2023CVPREgocentric Video Task Translation.Zihui Xue, Yale Song, Kristen Grauman, Lorenzo Torresani
2023CVPRRelational Space-Time Query in Long-Form Videos.Xitong Yang, Fu-Jen Chu, Matt Feiszli, Raghav Goyal, Lorenzo Torresani, Du Tran
2023ICCVLearning to Ground Instructional Articles in Videos through Narrations.Effrosyni Mavroudi, Triantafyllos Afouras, Lorenzo Torresani
2023ICCVEgo-Only: Egocentric Action Detection without Exocentric Transferring.Huiyu Wang, Mitesh Kumar Singh, Lorenzo Torresani
2022AAAILabel Hallucination for Few-Shot Classification.Yiren Jian, Lorenzo Torresani
2022AIMECalibrating Histopathology Image Classifiers Using Label Smoothing.Jerry W. Wei, Lorenzo Torresani, Jason Wei, Saeed Hassanpour
2022CVPRLearning To Recognize Procedural Activities with Distant Supervision.Xudong Lin, Fabio Petroni, Gedas Bertasius, Marcus Rohrbach, Shih-Fu Chang, Lorenzo Torresani
2022CVPREgo4D: Around the World in 3, 000 Hours of Egocentric Video.Kristen Grauman, Andrew Westbury, Eugene Byrne, Zachary Chavis, Antonino Furnari, Rohit Girdhar, Jackson Hamburger, Hao Jiang, Miao Liu, Xingyu Liu, Miguel Martin, Tushar Nagarajan, Ilija Radosavovic, Santhosh Kumar Ramakrishnan, Fiona Ryan, Jayant Sharma, Michael Wray, Mengmeng Xu, Eric Zhongcong Xu, Chen Zhao, Siddhant Bansal, Dhruv Batra, Vincent Cartillier, Sean Crane, Tien Do, Morrie Doulaty, Akshay Erapalli, Christoph Feichtenhofer, Adriano Fragomeni, Qichen Fu, Abrham Gebreselasie, Cristina Gonzlez, James Hillis, Xuhua Huang, Yifei Huang, Wenqi Jia, Weslie Khoo, Jchym Kolr, Satwik Kottur, Anurag Kumar, Federico Landini, Chao Li, Yanghao Li, Zhenqiang Li, Karttikeya Mangalam, Raghava Modhugu, Jonathan Munro, Tullie Murrell, Takumi Nishiyasu, Will Price, Paola Ruiz Puentes, Merey Ramazanova, Leda Sari, Kiran K. Somasundaram, Audrey Southerland, Yusuke Sugano, Ruijie Tao, Minh Vo, Yuchen Wang, Xindi Wu, Takuma Yagi, Ziwei Zhao, Yunyi Zhu, Pablo Arbelez, David Crandall, Dima Damen, Giovanni Maria Farinella, Christian Fuegen, Bernard Ghanem, Vamsi Krishna Ithapu, C. V. Jawahar, Hanbyul Joo, Kris Kitani, Haizhou Li, Richard A. Newcombe, Aude Oliva, Hyun Soo Park, James M. Rehg, Yoichi Sato, Jianbo Shi, Mike Zheng Shou, Antonio Torralba, Lorenzo Torresani, Mingfei Yan, Jitendra Malik
2022CVPRLong-Short Temporal Contrastive Learning of Video Transformers.Jue Wang, Gedas Bertasius, Du Tran, Lorenzo Torresani
2022CVPRDeformable Video Transformer.Jue Wang, Lorenzo Torresani
2021AIMEA Petri Dish for Histopathology Image Analysis.Jerry W. Wei, Arief A. Suriawinata, Bing Ren, Xiaoying Liu, Mikhail Lisovsky, Louis J. Vaickus, Charles Brown, Michael Baker, Naofumi Tomita, Lorenzo Torresani, Jason Wei, Saeed Hassanpour
2021CVPRVx2Text: End-to-End Learning of Video-Based Text Generation From Multimodal Inputs.Xudong Lin, Gedas Bertasius, Jue Wang, Shih-Fu Chang, Devi Parikh, Lorenzo Torresani
2021CVPRBeyond Short Clips: End-to-End Video-Level Learning With Collaborative Memories.Xitong Yang, Haoqi Fan, Lorenzo Torresani, Larry S. Davis, Heng Wang
2021ICASSPA Multi-View Approach to Audio-Visual Speaker Verification.Leda Sari, Kritika Singh, Jiatong Zhou, Lorenzo Torresani, Nayan Singhal, Yatharth Saraf
2021ICMLSlot Machines: Discovering Winning Combinations of Random Weights in Neural Networks.Maxwell Mbabilla Aladago, Lorenzo Torresani
2021ICMLIs Space-Time Attention All You Need for Video Understanding?Gedas Bertasius, Heng Wang, Lorenzo Torresani
2021WACVOnly Time Can Tell: Discovering Temporal Data for Temporal Modeling.Laura Sevilla-Lara, Shengxin Zha, Zhicheng Yan, Vedanuj Goswami, Matt Feiszli, Lorenzo Torresani
2021WACVSupervoxel Attention Graphs for Long-Range Video Modeling.Yang Wang, Gedas Bertasius, Tae-Hyun Oh, Abhinav Gupta, Minh Hoai, Lorenzo Torresani
2021WACVLearn like a Pathologist: Curriculum Learning by Annotator Agreement for Histopathology Image Classification.Jerry W. Wei, Arief A. Suriawinata, Bing Ren, Xiaoying Liu, Mikhail Lisovsky, Louis J. Vaickus, Charles Brown, Michael Baker, Mustafa Nasir-Moin, Naofumi Tomita, Lorenzo Torresani, Jason Wei, Saeed Hassanpour
2020AISTATSStein Variational Inference for Discrete Distributions.Jun Han, Fan Ding, Xianglong Liu, Lorenzo Torresani, Jian Peng, Qiang Liu
2020BMVCAttentive Action and Context Factorization.Yang Wang, Vinh Tran, Gedas Bertasius, Lorenzo Torresani, Minh Hoai Nguyen
2020CVPRClassifying, Segmenting, and Tracking Object Instances in Video with Mask Propagation.Gedas Bertasius, Lorenzo Torresani
2020CVPRListen to Look: Action Recognition by Previewing Audio.Ruohan Gao, Tae-Hyun Oh, Kristen Grauman, Lorenzo Torresani
2020CVPRVideo Modeling With Correlation Networks.Heng Wang, Du Tran, Lorenzo Torresani, Matt Feiszli
2020ECCVGeneralized Many-Way Few-Shot Video Classification.Yongqin Xian, Bruno Korbar, Matthijs Douze, Bernt Schiele, Zeynep Akata, Lorenzo Torresani
2019CVPRLeveraging the Present to Anticipate the Future in Videos.Antoine Miech, Ivan Laptev, Josef Sivic, Heng Wang, Lorenzo Torresani, Du Tran
2019ICCVDistInit: Learning Video Representations Without a Single Labeled Video.Rohit Girdhar, Du Tran, Lorenzo Torresani, Deva Ramanan
2019ICCVSCSampler: Sampling Salient Clips From Video for Efficient Action Recognition.Bruno Korbar, Du Tran, Lorenzo Torresani
2019ICCVVideo Classification With Channel-Separated Convolutional Networks.Du Tran, Heng Wang, Matt Feiszli, Lorenzo Torresani
2019ICCVHACS: Human Action Clips and Segments Dataset for Recognition and Temporal Localization.Hang Zhao, Antonio Torralba, Lorenzo Torresani, Zhicheng Yan
2018BMVCSelf-Supervised Feature Learning for Semantic Segmentation of Overhead Imagery.Suriya Singh, Anil Batra, Guan Pang, Lorenzo Torresani, Saikat Basu, Manohar Paluri, C. V. Jawahar
2018CVPRDetect-and-Track: Efficient Pose Estimation in Videos.Rohit Girdhar, Georgia Gkioxari, Lorenzo Torresani, Manohar Paluri, Du Tran
2018CVPRWhat Makes a Video a Video: Analyzing Temporal Information in Video Understanding Models and Datasets.De-An Huang, Vignesh Ramanathan, Dhruv Mahajan, Lorenzo Torresani, Manohar Paluri, Li Fei-Fei, Juan Carlos Niebles
2018CVPRA Closer Look at Spatiotemporal Convolutions for Action Recognition.Du Tran, Heng Wang, Lorenzo Torresani, Jamie Ray, Yann LeCun, Manohar Paluri
2018ECCVMaskConnect: Connectivity Learning by Gradient Descent.Karim Ahmed, Lorenzo Torresani
2018ECCVObject Detection in Video with Spatiotemporal Sampling Networks.Gedas Bertasius, Lorenzo Torresani, Jianbo Shi
2018ECCVScenes-Objects-Actions: A Multi-task, Multi-label Video Dataset.Jamie Ray, Heng Wang, Du Tran, Yufei Wang, Matt Feiszli, Lorenzo Torresani, Manohar Paluri
2018WACVBranchConnect: Image Categorization with Learned Branch Connections.Karim Ahmed, Lorenzo Torresani
2017AISTATSLocal Perturb-and-MAP for Structured Prediction.Gedas Bertasius, Qiang Liu, Lorenzo Torresani, Jianbo Shi
2017CVPRConvolutional Random Walk Networks for Semantic Image Segmentation.Gedas Bertasius, Lorenzo Torresani, Stella X. Yu, Jianbo Shi
2017CVPRLooking Under the Hood: Deep Neural Network Visualization to Interpret Whole-Slide Image Analysis Outcomes for Colorectal Polyps.Bruno Korbar, Andrea M. Olofson, Allen P. Miraflor, Catherine M. Nicka, Matthew A. Suriawinata, Lorenzo Torresani, Arief A. Suriawinata, Saeed Hassanpour
2017ICLRRecurrent Mixture Density Network for Spatiotemporal Visual Attention.Loris Bazzani, Hugo Larochelle, Lorenzo Torresani
2016CVPRSemantic Segmentation with Boundary Neural Fields.Gedas Bertasius, Jianbo Shi, Lorenzo Torresani
2016CVPRDeep End2End Voxel2Voxel Prediction.Du Tran, Lubomir D. Bourdev, Rob Fergus, Lorenzo Torresani, Manohar Paluri
2016ECCVNetwork of Experts for Large-Scale Image Categorization.Karim Ahmed, Mohammad Haris Baig, Lorenzo Torresani
2016WACVCoupled depth learning.Mohammad Haris Baig, Lorenzo Torresani
2016WACVSelf-taught object localization with deep networks.Loris Bazzani, Alessandro Bergamo, Dragomir Anguelov, Lorenzo Torresani
2015CVPRDeepEdge: A multi-scale bifurcated deep network for top-down contour detection.Gedas Bertasius, Jianbo Shi, Lorenzo Torresani
2015ICCVHigh-for-Low and Low-for-High: Efficient Boundary Detection from Deep Object Features and Its Applications to High-Level Vision.Gedas Bertasius, Jianbo Shi, Lorenzo Torresani
2015ICCVLearning Spatiotemporal Features with 3D Convolutional Networks.Du Tran, Lubomir D. Bourdev, Rob Fergus, Lorenzo Torresani, Manohar Paluri
2014CBMIImproving tag transfer for image annotation using visual and semantic information.Sergio Rodrguez-Vaamonde, Lorenzo Torresani, Koldo Espinosa, Estbaliz Garrote
2014WACVAutoCaption: Automatic caption generation for personal photos.Krishnan Ramnath, Simon Baker, Lucy Vanderwende, Motaz Ahmad El-Saban, Sudipta N. Sinha, Anitha Kannan, Noran Hassan, Michel Galley, Yi Yang, Deva Ramanan, Alessandro Bergamo, Lorenzo Torresani
2013CVPRLeveraging Structure from Motion to Learn Discriminative Codebooks for Scalable Landmark Classification.Alessandro Bergamo, Sudipta N. Sinha, Lorenzo Torresani
2013MobisysCarSafe app: alerting drowsy and distracted drivers using dual cameras on smartphones.Chuang-Wen You, Nicholas D. Lane, Fanglin Chen, Rui Wang, Zhenyu Chen, Thomas J. Bao, Martha Montes-de-Oca, Yuting Cheng, Mu Lin, Lorenzo Torresani, Andrew T. Campbell
2013MobisysCarSafe app: alerting drowsy and distracted drivers using dual cameras on smartphones.Chuang-Wen You, Nicholas D. Lane, Fanglin Chen, Rui Wang, Zhenyu Chen, Thomas J. Bao, Martha Montes-de-Oca, Yuting Cheng, Mu Lin, Lorenzo Torresani, Andrew T. Campbell
2013SIGIRWhat can pictures tell us about web pages?: improving document search using images.Sergio Rodrguez-Vaamonde, Lorenzo Torresani, Andrew W. Fitzgibbon
2012CVPRMeta-class features for large-scale object categorization on a budget.Alessandro Bergamo, Lorenzo Torresani
2012ECCVMeasuring Image Distances via Embedding in a Semantic Manifold.Chen Fang, Lorenzo Torresani
2011ICCVScalable object-class retrieval with approximate and top-k ranking.Mohammad Rastegari, Chen Fang, Lorenzo Torresani
2010CVPRSimultaneous point matching and 3D deformable surface reconstruction.Appu Shaji, Aydin Varol, Lorenzo Torresani, Pascal Fua
2010ECCVEfficient Object Category Recognition Using Classemes.Lorenzo Torresani, Martin Szummer, Andrew W. Fitzgibbon
2009CVPRLearning query-dependent prefilters for scalable image retrieval.Lorenzo Torresani, Martin Szummer, Andrew W. Fitzgibbon
2009ICCVWeakly supervised discriminative localization and classification: a joint learning process.Minh Hoai Nguyen, Lorenzo Torresani, Lorenzo de la Torre, Carsten Rother
2009ICMLUnsupervised hierarchical modeling of locomotion styles.Wei Pan, Lorenzo Torresani
2008ECCVFeature Correspondence Via Graph Matching: Models and Global Optimization.Lorenzo Torresani, Vladimir Kolmogorov, Carsten Rother
2004ECCVAutomatic Non-rigid 3D Modeling from Video.Lorenzo Torresani, Aaron Hertzmann
2002ECCVSpace-Time Tracking.Lorenzo Torresani, Christoph Bregler
2001CVPRTracking and Modeling Non-Rigid Objects with Rank Constraints.Lorenzo Torresani, Danny B. Yang, Eugene J. Alexander, Christoph Bregler