Skip to content

Alexander Toshev

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

33

Venues

9

Active years

2006–2025

Best venue rank

A*

Where they publish

Papers

33 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRMultimodal Autoregressive Pre-training of Large Vision Encoders.Enrico Fini, Mustafa Shukor, Xiujun Li, Philipp Dufter, Michal Klein, David Haldimann, Sai Aitharaju, Victor G. Turrisi da Costa, Louis Bthune, Zhe Gan, Alexander Toshev, Marcin Eichner, Moin Nabi, Yinfei Yang, Joshua M. Susskind, Alaaeldin El-Nouby
2025CVPRFrom Multimodal LLMs to Generalist Embodied Agents: Methods and Lessons.Andrew Szot, Bogdan Mazoure, Omar Attia, Aleksei Timofeev, Harsh Agrawal, R. Devon Hjelm, Zhe Gan, Zsolt Kira, Alexander Toshev
2025CVPRWorld-consistent Video Diffusion with Explicit 3D Modeling.Qihang Zhang, Shuangfei Zhai, Miguel ngel Bautista Martin, Kevin Miao, Alexander Toshev, Joshua M. Susskind, Jiatao Gu
2025ICCVUINavBench: A Framework for Comprehensive Evaluation of Interactive Digital Agents.Harsh Agrawal, Eldon Schoop, Xinlei Pan, Anuj Mahajan, Ari Seff, Di Feng, Ruijia Cheng, Andres Romero Mier Y. Teran, Esteban Gomez, Abhishek Sundararajan, Forrest Huang, Amanda Swearngin, Mohana Prasad Sathya Moorthy, Jeffrey Nichols, Alexander Toshev
2024ECCVMM1: Methods, Analysis and Insights from Multimodal LLM Pre-training.Brandon McKinzie, Zhe Gan, Jean-Philippe Fauconnier, Sam Dodge, Bowen Zhang, Philipp Dufter, Dhruti Shah, Xianzhi Du, Futang Peng, Anton Belyi, Haotian Zhang, Karanjeet Singh, Doug Kang, Hongyu H, Max Schwarzer, Tom Gunter, Xiang Kong, Aonan Zhang, Jianyu Wang, Chong Wang, Nan Du, Tao Lei, Sam Wiseman, Mark Lee, Zirui Wang, Ruoming Pang, Peter Grasch, Alexander Toshev, Yinfei Yang
2024EMNLPPre-trained Language Models Do Not Help Auto-regressive Text-to-Image Generation.Yuhui Zhang, Brandon McKinzie, Zhe Gan, Vaishaal Shankar, Alexander Toshev
2023EMNLPSTAIR: Learning Sparse Text and Image Representation in Grounded Tokens.Chen Chen, Bowen Zhang, Liangliang Cao, Jiguang Shen, Tom Gunter, Albin Madappally Jose, Alexander Toshev, Yantao Zheng, Jonathon Shlens, Ruoming Pang, Yinfei Yang
2023ICCVPerceptual Grouping in Contrastive Vision-Language Models.Kanchana Ranasinghe, Brandon McKinzie, Sachin Ravi, Yinfei Yang, Alexander Toshev, Jonathon Shlens
2022CoRLDo As I Can, Not As I Say: Grounding Language in Robotic Affordances.Brian Ichter, Anthony Brohan, Yevgen Chebotar, Chelsea Finn, Karol Hausman, Alexander Herzog, Daniel Ho, Julian Ibarz, Alex Irpan, Eric Jang, Ryan Julian, Dmitry Kalashnikov, Sergey Levine, Yao Lu, Carolina Parada, Kanishka Rao, Pierre Sermanet, Alexander Toshev, Vincent Vanhoucke, Fei Xia, Ted Xiao, Peng Xu, Mengyuan Yan, Noah Brown, Michael Ahn, Omar Cortes, Nicolas Sievers, Clayton Tan, Sichun Xu, Diego Reyes, Jarek Rettinghouse, Jornell Quiambao, Peter Pastor, Linda Luu, Kuang-Huei Lee, Yuheng Kuang, Sally Jesmonth, Nikhil J. Joshi, Kyle Jeffrey, Rosario Jauregui Ruano, Jasmine Hsu, Keerthana Gopalakrishnan, Byron David, Andy Zeng, Chuyuan Kelly Fu
2022ICLRValue Function Spaces: Skill-Centric State Abstractions for Long-Horizon Reasoning.Dhruv Shah, Peng Xu, Yao Lu, Ted Xiao, Alexander Toshev, Sergey Levine, Brian Ichter
2021ICRAReLMoGen: Integrating Motion Generation in Reinforcement Learning for Mobile Manipulation.Fei Xia, Chengshu Li, Roberto Martn-Martn, Or Litany, Alexander Toshev, Silvio Savarese
2020CoRLModeling Long-horizon Tasks as Sequential Interaction Landscapes.Sren Pirk, Karol Hausman, Alexander Toshev, Mohi Khansari
2020CoRLLearning Object-conditioned Exploration using Distributed Soft Actor Critic.Ayzaan Wahid, Austin Stone, Kevin Chen, Brian Ichter, Alexander Toshev
2020ECCVAdversarial Generative Grammars for Human Activity Prediction.A. J. Piergiovanni, Anelia Angelova, Alexander Toshev, Michael S. Ryoo
2019CVPRScene Memory Transformer for Embodied Agents in Long-Horizon Tasks.Kuan Fang, Alexander Toshev, Li Fei-Fei, Silvio Savarese
2019ICCVEvolving Space-Time Neural Architectures for Videos.A. J. Piergiovanni, Anelia Angelova, Alexander Toshev, Michael S. Ryoo
2019ICRAVisual Representations for Semantic Target Driven Navigation.Arsalan Mousavian, Alexander Toshev, Marek Fiser, Jana Koseck, Ayzaan Wahid, James Davidson
2019IROSLong Range Neural Navigation Policies for the Real World.Ayzaan Wahid, Alexander Toshev, Marek Fiser, Tsang-Wei Edward Lee
2018CVPRSim2Real Viewpoint Invariant Visual Servoing by Recurrent Control.Fereshteh Sadeghi, Alexander Toshev, Eric Jang, Sergey Levine
2017CVPRTowards Accurate Multi-person Pose Estimation in the Wild.George Papandreou, Tyler Zhu, Nori Kanazawa, Alexander Toshev, Jonathan Tompson, Chris Bregler, Kevin Murphy
2017ICCVNo Fuss Distance Metric Learning Using Proxies.Yair Movshovitz-Attias, Alexander Toshev, Thomas K. Leung, Sergey Ioffe, Saurabh Singh
2016CVPRGeneration and Comprehension of Unambiguous Object Descriptions.Junhua Mao, Jonathan Huang, Alexander Toshev, Oana Camburu, Alan L. Yuille, Kevin Murphy
2016ECCVChained Predictions Using Convolutional Neural Networks.Georgia Gkioxari, Alexander Toshev, Navdeep Jaitly
2016ECCVThe Unreasonable Effectiveness of Noisy Data for Fine-Grained Recognition.Jonathan Krause, Benjamin Sapp, Andrew Howard, Howard Zhou, Alexander Toshev, Tom Duerig, James Philbin, Li Fei-Fei
2015CVPRShow and tell: A neural image caption generator.Oriol Vinyals, Alexander Toshev, Samy Bengio, Dumitru Erhan
2014CVPRScalable Object Detection Using Deep Neural Networks.Dumitru Erhan, Christian Szegedy, Alexander Toshev, Dragomir Anguelov
2014CVPRDeepPose: Human Pose Estimation via Deep Neural Networks.Alexander Toshev, Christian Szegedy
2010CVPRDetecting and parsing architecture at city scale from range data.Alexander Toshev, Philippos Mordohai, Ben Taskar
2010CVPRObject detection via boundary structure segmentation.Alexander Toshev, Ben Taskar, Kostas Daniilidis
2010ECCVCascaded Models for Articulated Pose Estimation.Benjamin Sapp, Alexander Toshev, Ben Taskar
2009CVPRShape-based object recognition in videos using 3D synthetic object models.Alexander Toshev, Ameesh Makadia, Kostas Daniilidis
2007CVPRImage Matching via Saliency Region Correspondences.Alexander Toshev, Jianbo Shi, Kostas Daniilidis
2006ICVSAn APRIORI-based Method for Frequent Composite Event Discovery in Videos.Alexander Toshev, Franois Brmond, Monique Thonnat