Lorenzo Torresani
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
80
Venues
15
Active years
2001–2026
Best venue rank
A*
Where they publish
Papers
80 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | WACV | TimeRefine: Temporal Grounding with Time Refining Video LLM. | Xizi Wang, Feng Cheng, Ziyang Wang, Huiyu Wang, Md Mohaiminul Islam, Lorenzo Torresani, Mohit Bansal, Gedas Bertasius, David Crandall |
| 2025 | CVPR | BIMBA: Selective-Scan Compression for Long-Range Video Question Answering. | Md Mohaiminul Islam, Tushar Nagarajan, Huiyu Wang, Gedas Bertasius, Lorenzo Torresani |
| 2025 | CVPR | VITED: Video Temporal Evidence Distillation. | Yujie Lu, Yale Song, William Wang, Lorenzo Torresani, Tushar Nagarajan |
| 2025 | ICCV | Enrich and Detect: Video Temporal Grounding With Multimodal Llms. | Shraman Pramanick, Effrosyni Mavroudi, Yale Song, Rama Chellappa, Lorenzo Torresani, Triantafyllos Afouras |
| 2024 | CVPR | Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives. | Kristen Grauman, Andrew Westbury, Lorenzo Torresani, Kris Kitani, Jitendra Malik, Triantafyllos Afouras, Kumar Ashutosh, Vijay Baiyya, Siddhant Bansal, Bikram Boote, Eugene Byrne, Zachary Chavis, Joya Chen, Feng Cheng, Fu-Jen Chu, Sean Crane, Avijit Dasgupta, Jing Dong, Mara Escobar, Cristhian Forigua, Abrham Gebreselasie, Sanjay Haresh, Jing Huang, Md Mohaiminul Islam, Suyog Dutt Jain, Rawal Khirodkar, Devansh Kukreja, Kevin J. Liang, Jia-Wei Liu, Sagnik Majumder, Yongsen Mao, Miguel Martin, Effrosyni Mavroudi, Tushar Nagarajan, Francesco Ragusa, Santhosh Kumar Ramakrishnan, Luigi Seminara, Arjun Somayazulu, Yale Song, Shan Su, Zihui Xue, Edward Zhang, Jinxu Zhang, Angela Castillo, Changan Chen, Xinzhu Fu, Ryosuke Furuta, Cristina Gonzlez, Prince Gupta, Jiabo Hu, Yifei Huang, Yiming Huang, Weslie Khoo, Anush Kumar, Robert Kuo, Sach Lakhavani, Miao Liu, Mi Luo, Zhengyi Luo, Brighid Meredith, Austin Miller, Oluwatumininu Oguntola, Xiaqing Pan, Penny Peng, Shraman Pramanick, Merey Ramazanova, Fiona Ryan, Wei Shan, Kiran K. Somasundaram, Chenan Song, Audrey Southerland, Masatoshi Tateno, Huiyu Wang, Yuchen Wang, Takuma Yagi, Mingfei Yan, Xitong Yang, Zecheng Yu, Shengxin Cindy Zha, Chen Zhao, Ziwei Zhao, Zhifan Zhu, Jeff Zhuo, Pablo Arbelez, Gedas Bertasius, Dima Damen, Jakob J. Engel, Giovanni Maria Farinella, Antonino Furnari, Bernard Ghanem, Judy Hoffman, C. V. Jawahar, Richard A. Newcombe, Hyun Soo Park, James M. Rehg, Yoichi Sato, Manolis Savva, Jianbo Shi, Mike Zheng Shout, Michael Wray |
| 2024 | CVPR | Video ReCap: Recursive Captioning of Hour-Long Videos. | Md Mohaiminul Islam, Ngan Ho, Xitong Yang, Tushar Nagarajan, Lorenzo Torresani, Gedas Bertasius |
| 2024 | CVPR | Open-world Instance Segmentation: Top-down Learning with Bottom-up Supervision. | Tarun Kalluri, Weiyao Wang, Heng Wang, Manmohan Chandraker, Lorenzo Torresani, Du Tran |
| 2024 | CVPR | Step Differences in Instructional Video. | Tushar Nagarajan, Lorenzo Torresani |
| 2024 | CVPR | Learning to Segment Referred Objects from Narrated Egocentric Videos. | Yuhan Shen, Huiyu Wang, Xitong Yang, Matt Feiszli, Ehsan Elhamifar, Lorenzo Torresani, Effrosyni Mavroudi |
| 2024 | ECCV | 4DIFF: 3D-Aware Diffusion Model for Third-to-First Viewpoint Translation. | Feng Cheng, Mi Luo, Huiyu Wang, Alex Dimakis, Lorenzo Torresani, Gedas Bertasius, Kristen Grauman |
| 2024 | EMNLP | UNICORN: A Unified Causal Video-Oriented Language-Modeling Framework for Temporal Video-Language Tasks. | Yuanhao Xiong, Yixin Nie, Haotian Liu, Boxin Wang, Jun Chen, Rong Jin, Cho-Jui Hsieh, Lorenzo Torresani, Jie Lei |
| 2023 | CVPR | HierVL: Learning Hierarchical Video-Language Embeddings. | Kumar Ashutosh, Rohit Girdhar, Lorenzo Torresani, Kristen Grauman |
| 2023 | CVPR | Egocentric Video Task Translation. | Zihui Xue, Yale Song, Kristen Grauman, Lorenzo Torresani |
| 2023 | CVPR | Relational Space-Time Query in Long-Form Videos. | Xitong Yang, Fu-Jen Chu, Matt Feiszli, Raghav Goyal, Lorenzo Torresani, Du Tran |
| 2023 | ICCV | Learning to Ground Instructional Articles in Videos through Narrations. | Effrosyni Mavroudi, Triantafyllos Afouras, Lorenzo Torresani |
| 2023 | ICCV | Ego-Only: Egocentric Action Detection without Exocentric Transferring. | Huiyu Wang, Mitesh Kumar Singh, Lorenzo Torresani |
| 2022 | AAAI | Label Hallucination for Few-Shot Classification. | Yiren Jian, Lorenzo Torresani |
| 2022 | AIME | Calibrating Histopathology Image Classifiers Using Label Smoothing. | Jerry W. Wei, Lorenzo Torresani, Jason Wei, Saeed Hassanpour |
| 2022 | CVPR | Learning To Recognize Procedural Activities with Distant Supervision. | Xudong Lin, Fabio Petroni, Gedas Bertasius, Marcus Rohrbach, Shih-Fu Chang, Lorenzo Torresani |
| 2022 | CVPR | Ego4D: Around the World in 3, 000 Hours of Egocentric Video. | Kristen Grauman, Andrew Westbury, Eugene Byrne, Zachary Chavis, Antonino Furnari, Rohit Girdhar, Jackson Hamburger, Hao Jiang, Miao Liu, Xingyu Liu, Miguel Martin, Tushar Nagarajan, Ilija Radosavovic, Santhosh Kumar Ramakrishnan, Fiona Ryan, Jayant Sharma, Michael Wray, Mengmeng Xu, Eric Zhongcong Xu, Chen Zhao, Siddhant Bansal, Dhruv Batra, Vincent Cartillier, Sean Crane, Tien Do, Morrie Doulaty, Akshay Erapalli, Christoph Feichtenhofer, Adriano Fragomeni, Qichen Fu, Abrham Gebreselasie, Cristina Gonzlez, James Hillis, Xuhua Huang, Yifei Huang, Wenqi Jia, Weslie Khoo, Jchym Kolr, Satwik Kottur, Anurag Kumar, Federico Landini, Chao Li, Yanghao Li, Zhenqiang Li, Karttikeya Mangalam, Raghava Modhugu, Jonathan Munro, Tullie Murrell, Takumi Nishiyasu, Will Price, Paola Ruiz Puentes, Merey Ramazanova, Leda Sari, Kiran K. Somasundaram, Audrey Southerland, Yusuke Sugano, Ruijie Tao, Minh Vo, Yuchen Wang, Xindi Wu, Takuma Yagi, Ziwei Zhao, Yunyi Zhu, Pablo Arbelez, David Crandall, Dima Damen, Giovanni Maria Farinella, Christian Fuegen, Bernard Ghanem, Vamsi Krishna Ithapu, C. V. Jawahar, Hanbyul Joo, Kris Kitani, Haizhou Li, Richard A. Newcombe, Aude Oliva, Hyun Soo Park, James M. Rehg, Yoichi Sato, Jianbo Shi, Mike Zheng Shou, Antonio Torralba, Lorenzo Torresani, Mingfei Yan, Jitendra Malik |
| 2022 | CVPR | Long-Short Temporal Contrastive Learning of Video Transformers. | Jue Wang, Gedas Bertasius, Du Tran, Lorenzo Torresani |
| 2022 | CVPR | Deformable Video Transformer. | Jue Wang, Lorenzo Torresani |
| 2021 | AIME | A Petri Dish for Histopathology Image Analysis. | Jerry W. Wei, Arief A. Suriawinata, Bing Ren, Xiaoying Liu, Mikhail Lisovsky, Louis J. Vaickus, Charles Brown, Michael Baker, Naofumi Tomita, Lorenzo Torresani, Jason Wei, Saeed Hassanpour |
| 2021 | CVPR | Vx2Text: End-to-End Learning of Video-Based Text Generation From Multimodal Inputs. | Xudong Lin, Gedas Bertasius, Jue Wang, Shih-Fu Chang, Devi Parikh, Lorenzo Torresani |
| 2021 | CVPR | Beyond Short Clips: End-to-End Video-Level Learning With Collaborative Memories. | Xitong Yang, Haoqi Fan, Lorenzo Torresani, Larry S. Davis, Heng Wang |
| 2021 | ICASSP | A Multi-View Approach to Audio-Visual Speaker Verification. | Leda Sari, Kritika Singh, Jiatong Zhou, Lorenzo Torresani, Nayan Singhal, Yatharth Saraf |
| 2021 | ICML | Slot Machines: Discovering Winning Combinations of Random Weights in Neural Networks. | Maxwell Mbabilla Aladago, Lorenzo Torresani |
| 2021 | ICML | Is Space-Time Attention All You Need for Video Understanding? | Gedas Bertasius, Heng Wang, Lorenzo Torresani |
| 2021 | WACV | Only Time Can Tell: Discovering Temporal Data for Temporal Modeling. | Laura Sevilla-Lara, Shengxin Zha, Zhicheng Yan, Vedanuj Goswami, Matt Feiszli, Lorenzo Torresani |
| 2021 | WACV | Supervoxel Attention Graphs for Long-Range Video Modeling. | Yang Wang, Gedas Bertasius, Tae-Hyun Oh, Abhinav Gupta, Minh Hoai, Lorenzo Torresani |
| 2021 | WACV | Learn like a Pathologist: Curriculum Learning by Annotator Agreement for Histopathology Image Classification. | Jerry W. Wei, Arief A. Suriawinata, Bing Ren, Xiaoying Liu, Mikhail Lisovsky, Louis J. Vaickus, Charles Brown, Michael Baker, Mustafa Nasir-Moin, Naofumi Tomita, Lorenzo Torresani, Jason Wei, Saeed Hassanpour |
| 2020 | AISTATS | Stein Variational Inference for Discrete Distributions. | Jun Han, Fan Ding, Xianglong Liu, Lorenzo Torresani, Jian Peng, Qiang Liu |
| 2020 | BMVC | Attentive Action and Context Factorization. | Yang Wang, Vinh Tran, Gedas Bertasius, Lorenzo Torresani, Minh Hoai Nguyen |
| 2020 | CVPR | Classifying, Segmenting, and Tracking Object Instances in Video with Mask Propagation. | Gedas Bertasius, Lorenzo Torresani |
| 2020 | CVPR | Listen to Look: Action Recognition by Previewing Audio. | Ruohan Gao, Tae-Hyun Oh, Kristen Grauman, Lorenzo Torresani |
| 2020 | CVPR | Video Modeling With Correlation Networks. | Heng Wang, Du Tran, Lorenzo Torresani, Matt Feiszli |
| 2020 | ECCV | Generalized Many-Way Few-Shot Video Classification. | Yongqin Xian, Bruno Korbar, Matthijs Douze, Bernt Schiele, Zeynep Akata, Lorenzo Torresani |
| 2019 | CVPR | Leveraging the Present to Anticipate the Future in Videos. | Antoine Miech, Ivan Laptev, Josef Sivic, Heng Wang, Lorenzo Torresani, Du Tran |
| 2019 | ICCV | DistInit: Learning Video Representations Without a Single Labeled Video. | Rohit Girdhar, Du Tran, Lorenzo Torresani, Deva Ramanan |
| 2019 | ICCV | SCSampler: Sampling Salient Clips From Video for Efficient Action Recognition. | Bruno Korbar, Du Tran, Lorenzo Torresani |
| 2019 | ICCV | Video Classification With Channel-Separated Convolutional Networks. | Du Tran, Heng Wang, Matt Feiszli, Lorenzo Torresani |
| 2019 | ICCV | HACS: Human Action Clips and Segments Dataset for Recognition and Temporal Localization. | Hang Zhao, Antonio Torralba, Lorenzo Torresani, Zhicheng Yan |
| 2018 | BMVC | Self-Supervised Feature Learning for Semantic Segmentation of Overhead Imagery. | Suriya Singh, Anil Batra, Guan Pang, Lorenzo Torresani, Saikat Basu, Manohar Paluri, C. V. Jawahar |
| 2018 | CVPR | Detect-and-Track: Efficient Pose Estimation in Videos. | Rohit Girdhar, Georgia Gkioxari, Lorenzo Torresani, Manohar Paluri, Du Tran |
| 2018 | CVPR | What Makes a Video a Video: Analyzing Temporal Information in Video Understanding Models and Datasets. | De-An Huang, Vignesh Ramanathan, Dhruv Mahajan, Lorenzo Torresani, Manohar Paluri, Li Fei-Fei, Juan Carlos Niebles |
| 2018 | CVPR | A Closer Look at Spatiotemporal Convolutions for Action Recognition. | Du Tran, Heng Wang, Lorenzo Torresani, Jamie Ray, Yann LeCun, Manohar Paluri |
| 2018 | ECCV | MaskConnect: Connectivity Learning by Gradient Descent. | Karim Ahmed, Lorenzo Torresani |
| 2018 | ECCV | Object Detection in Video with Spatiotemporal Sampling Networks. | Gedas Bertasius, Lorenzo Torresani, Jianbo Shi |
| 2018 | ECCV | Scenes-Objects-Actions: A Multi-task, Multi-label Video Dataset. | Jamie Ray, Heng Wang, Du Tran, Yufei Wang, Matt Feiszli, Lorenzo Torresani, Manohar Paluri |
| 2018 | WACV | BranchConnect: Image Categorization with Learned Branch Connections. | Karim Ahmed, Lorenzo Torresani |
| 2017 | AISTATS | Local Perturb-and-MAP for Structured Prediction. | Gedas Bertasius, Qiang Liu, Lorenzo Torresani, Jianbo Shi |
| 2017 | CVPR | Convolutional Random Walk Networks for Semantic Image Segmentation. | Gedas Bertasius, Lorenzo Torresani, Stella X. Yu, Jianbo Shi |
| 2017 | CVPR | Looking Under the Hood: Deep Neural Network Visualization to Interpret Whole-Slide Image Analysis Outcomes for Colorectal Polyps. | Bruno Korbar, Andrea M. Olofson, Allen P. Miraflor, Catherine M. Nicka, Matthew A. Suriawinata, Lorenzo Torresani, Arief A. Suriawinata, Saeed Hassanpour |
| 2017 | ICLR | Recurrent Mixture Density Network for Spatiotemporal Visual Attention. | Loris Bazzani, Hugo Larochelle, Lorenzo Torresani |
| 2016 | CVPR | Semantic Segmentation with Boundary Neural Fields. | Gedas Bertasius, Jianbo Shi, Lorenzo Torresani |
| 2016 | CVPR | Deep End2End Voxel2Voxel Prediction. | Du Tran, Lubomir D. Bourdev, Rob Fergus, Lorenzo Torresani, Manohar Paluri |
| 2016 | ECCV | Network of Experts for Large-Scale Image Categorization. | Karim Ahmed, Mohammad Haris Baig, Lorenzo Torresani |
| 2016 | WACV | Coupled depth learning. | Mohammad Haris Baig, Lorenzo Torresani |
| 2016 | WACV | Self-taught object localization with deep networks. | Loris Bazzani, Alessandro Bergamo, Dragomir Anguelov, Lorenzo Torresani |
| 2015 | CVPR | DeepEdge: A multi-scale bifurcated deep network for top-down contour detection. | Gedas Bertasius, Jianbo Shi, Lorenzo Torresani |
| 2015 | ICCV | High-for-Low and Low-for-High: Efficient Boundary Detection from Deep Object Features and Its Applications to High-Level Vision. | Gedas Bertasius, Jianbo Shi, Lorenzo Torresani |
| 2015 | ICCV | Learning Spatiotemporal Features with 3D Convolutional Networks. | Du Tran, Lubomir D. Bourdev, Rob Fergus, Lorenzo Torresani, Manohar Paluri |
| 2014 | CBMI | Improving tag transfer for image annotation using visual and semantic information. | Sergio Rodrguez-Vaamonde, Lorenzo Torresani, Koldo Espinosa, Estbaliz Garrote |
| 2014 | WACV | AutoCaption: Automatic caption generation for personal photos. | Krishnan Ramnath, Simon Baker, Lucy Vanderwende, Motaz Ahmad El-Saban, Sudipta N. Sinha, Anitha Kannan, Noran Hassan, Michel Galley, Yi Yang, Deva Ramanan, Alessandro Bergamo, Lorenzo Torresani |
| 2013 | CVPR | Leveraging Structure from Motion to Learn Discriminative Codebooks for Scalable Landmark Classification. | Alessandro Bergamo, Sudipta N. Sinha, Lorenzo Torresani |
| 2013 | Mobisys | CarSafe app: alerting drowsy and distracted drivers using dual cameras on smartphones. | Chuang-Wen You, Nicholas D. Lane, Fanglin Chen, Rui Wang, Zhenyu Chen, Thomas J. Bao, Martha Montes-de-Oca, Yuting Cheng, Mu Lin, Lorenzo Torresani, Andrew T. Campbell |
| 2013 | Mobisys | CarSafe app: alerting drowsy and distracted drivers using dual cameras on smartphones. | Chuang-Wen You, Nicholas D. Lane, Fanglin Chen, Rui Wang, Zhenyu Chen, Thomas J. Bao, Martha Montes-de-Oca, Yuting Cheng, Mu Lin, Lorenzo Torresani, Andrew T. Campbell |
| 2013 | SIGIR | What can pictures tell us about web pages?: improving document search using images. | Sergio Rodrguez-Vaamonde, Lorenzo Torresani, Andrew W. Fitzgibbon |
| 2012 | CVPR | Meta-class features for large-scale object categorization on a budget. | Alessandro Bergamo, Lorenzo Torresani |
| 2012 | ECCV | Measuring Image Distances via Embedding in a Semantic Manifold. | Chen Fang, Lorenzo Torresani |
| 2011 | ICCV | Scalable object-class retrieval with approximate and top-k ranking. | Mohammad Rastegari, Chen Fang, Lorenzo Torresani |
| 2010 | CVPR | Simultaneous point matching and 3D deformable surface reconstruction. | Appu Shaji, Aydin Varol, Lorenzo Torresani, Pascal Fua |
| 2010 | ECCV | Efficient Object Category Recognition Using Classemes. | Lorenzo Torresani, Martin Szummer, Andrew W. Fitzgibbon |
| 2009 | CVPR | Learning query-dependent prefilters for scalable image retrieval. | Lorenzo Torresani, Martin Szummer, Andrew W. Fitzgibbon |
| 2009 | ICCV | Weakly supervised discriminative localization and classification: a joint learning process. | Minh Hoai Nguyen, Lorenzo Torresani, Lorenzo de la Torre, Carsten Rother |
| 2009 | ICML | Unsupervised hierarchical modeling of locomotion styles. | Wei Pan, Lorenzo Torresani |
| 2008 | ECCV | Feature Correspondence Via Graph Matching: Models and Global Optimization. | Lorenzo Torresani, Vladimir Kolmogorov, Carsten Rother |
| 2004 | ECCV | Automatic Non-rigid 3D Modeling from Video. | Lorenzo Torresani, Aaron Hertzmann |
| 2002 | ECCV | Space-Time Tracking. | Lorenzo Torresani, Christoph Bregler |
| 2001 | CVPR | Tracking and Modeling Non-Rigid Objects with Rank Constraints. | Lorenzo Torresani, Danny B. Yang, Eugene J. Alexander, Christoph Bregler |