Skip to content

Thomas Kollar

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

41

Venues

14

Active years

2006–2025

Best venue rank

A*

Where they publish

Papers

41 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRLanguage models scale reliably with over-training and on downstream tasks.Samir Yitzhak Gadre, Georgios Smyrnis, Vaishaal Shankar, Suchin Gururangan, Mitchell Wortsman, Rulin Shao, Jean Mercat, Alex Fang, Jeffrey Li, Sedrick Keh, Rui Xin, Marianna Nezhurina, Igor Vasiljevic, Luca Soldaini, Jenia Jitsev, Alex Dimakis, Gabriel Ilharco, Pang Wei Koh, Shuran Song, Thomas Kollar, et al.
2025ICLRShould VLMs be Pre-trained with Image Data?Sedrick Keh, Jean Mercat, Samir Yitzhak Gadre, Kushal Arora, Igor Vasiljevic, Benjamin Burchfiel, Shuran Song, Russ Tedrake, Thomas Kollar, Ludwig Schmidt, Achal Dave
2025ICMLUnderstanding Complexity in VideoQA via Visual Program Generation.Cristbal Eyzaguirre, Igor Vasiljevic, Achal Dave, Jiajun Wu, Rares Andrei Ambrus, Thomas Kollar, Juan Carlos Niebles, Pavel Tokmakov
2025ICRAGHIL-Glue: Hierarchical Control with Filtered Subgoal Images.Kyle Beltran Hatch, Ashwin Balakrishna, Oier Mees, Suraj Nair, Seohong Park, Blake Wulfe, Masha Itkina, Benjamin Eysenbach, Sergey Levine, Thomas Kollar, Benjamin Burchfiel
2024CoRLOpenVLA: An Open-Source Vision-Language-Action Model.Moo Jin Kim, Karl Pertsch, Siddharth Karamcheti, Ted Xiao, Ashwin Balakrishna, Suraj Nair, Rafael Rafailov, Ethan Paul Foster, Pannag R. Sanketi, Quan Vuong, Thomas Kollar, Benjamin Burchfiel, Russ Tedrake, Dorsa Sadigh, Sergey Levine, Percy Liang, Chelsea Finn
2024ICMLPrismatic VLMs: Investigating the Design Space of Visually-Conditioned Language Models.Siddharth Karamcheti, Suraj Nair, Ashwin Balakrishna, Percy Liang, Thomas Kollar, Dorsa Sadigh
2024ICRAOpen X-Embodiment: Robotic Learning Datasets and RT-X Models : Open X-Embodiment Collaboration.Abby O'Neill, Abdul Rehman, Abhiram Maddukuri, Abhishek Gupta, Abhishek Padalkar, Abraham Lee, Acorn Pooley, Agrim Gupta, Ajay Mandlekar, Ajinkya Jain, Albert Tung, Alex Bewley, Alexander Herzog, Alex Irpan, Alexander Khazatsky, Anant Rai, Anchit Gupta, Andrew E. Wang, Anikait Singh, Animesh Garg, Aniruddha Kembhavi, Annie Xie, Anthony Brohan, Antonin Raffin, Archit Sharma, Arefeh Yavary, Arhan Jain, Ashwin Balakrishna, Ayzaan Wahid, Ben Burgess-Limerick, Beomjoon Kim, Bernhard Schlkopf, Blake Wulfe, Brian Ichter, Cewu Lu, Charles Xu, Charlotte Le, Chelsea Finn, Chen Wang, Chenfeng Xu, Cheng Chi, Chenguang Huang, Christine Chan, Christopher Agia, Chuer Pan, Chuyuan Fu, Coline Devin, Danfei Xu, Daniel Morton, Danny Driess, Daphne Chen, Deepak Pathak, Dhruv Shah, Dieter Bchler, Dinesh Jayaraman, Dmitry Kalashnikov, Dorsa Sadigh, Edward Johns, Ethan Paul Foster, Fangchen Liu, Federico Ceola, Fei Xia, Feiyu Zhao, Freek Stulp, Gaoyue Zhou, Gaurav S. Sukhatme, Gautam Salhotra, Ge Yan, Gilbert Feng, Giulio Schiavi, Glen Berseth, Gregory Kahn, Guanzhi Wang, Hao Su, Haoshu Fang, Haochen Shi, Henghui Bao, Heni Ben Amor, Henrik I. Christensen, Hiroki Furuta, Homer Walke, Hongjie Fang, Huy Ha, Igor Mordatch, Ilija Radosavovic, Isabel Leal, Jacky Liang, Jad Abou-Chakra, Jaehyung Kim, Jaimyn Drake, Jan Peters, Jan Schneider, Jasmine Hsu, Jeannette Bohg, Jeffrey T. Bingham, Jeffrey Wu, Jensen Gao, Jiaheng Hu, Jiajun Wu, Jialin Wu, Jiankai Sun, Jianlan Luo, Jiayuan Gu, Jie Tan, Jihoon Oh, Jimmy Wu, Jingpei Lu, Jingyun Yang, Jitendra Malik, Joo Silvrio, Joey Hejna, Jonathan Booher, Jonathan Tompson, Jonathan Yang, Jordi Salvador, Joseph J. Lim, Junhyek Han, Kaiyuan Wang, Kanishka Rao, Karl Pertsch, Karol Hausman, Keegan Go, Keerthana Gopalakrishnan, Ken Goldberg, Kendra Byrne, Kenneth Oslund, Kento Kawaharazuka, Kevin Black, Kevin Lin, Kevin Zhang, Kiana Ehsani, Kiran Lekkala, Kirsty Ellis, Krishan Rana, Krishnan Srinivasan, Kuan Fang, Kunal Pratap Singh, Kuo-Hao Zeng, Kyle Hatch, Kyle Hsu, Laurent Itti, Lawrence Yunliang Chen, Lerrel Pinto, Li Fei-Fei, Liam Tan, Linxi Jim Fan, Lionel Ott, Lisa Lee, Luca Weihs, Magnum Chen, Marion Lepert, Marius Memmel, Masayoshi Tomizuka, Masha Itkina, Mateo Guaman Castro, Max Spero, Maximilian Du, Michael Ahn, Michael C. Yip, Mingtong Zhang, Mingyu Ding, Minho Heo, Mohan Kumar Srirama, Mohit Sharma, Moo Jin Kim, Naoaki Kanazawa, Nicklas Hansen, Nicolas Heess, Nikhil J. Joshi, Niko Snderhauf, Ning Liu, Norman Di Palo, Nur Muhammad (Mahi) Shafiullah, Oier Mees, Oliver Kroemer, Osbert Bastani, Pannag R. Sanketi, Patrick Tree Miller, Patrick Yin, Paul Wohlhart, Peng Xu, Peter David Fagan, Peter Mitrano, Pierre Sermanet, Pieter Abbeel, Priya Sundaresan, Qiuyu Chen, Quan Vuong, Rafael Rafailov, Ran Tian, Ria Doshi, Roberto Martn-Martn, Rohan Baijal, Rosario Scalise, Rose Hendrix, Roy Lin, Runjia Qian, Ruohan Zhang, Russell Mendonca, Rutav Shah, Ryan Hoque, Ryan Julian, Samuel Bustamante-Gomez, Sean Kirmani, Sergey Levine, Shan Lin, Sherry Moore, Shikhar Bahl, Shivin Dass, Shubham D. Sonawani, Shuran Song, Sichun Xu, Siddhant Haldar, Siddharth Karamcheti, Simeon Adebola, Simon Guist, Soroush Nasiriany, Stefan Schaal, Stefan Welker, Stephen Tian, Subramanian Ramamoorthy, Sudeep Dasari, Suneel Belkhale, Sungjae Park, Suraj Nair, Suvir Mirchandani, Takayuki Osa, Tanmay Gupta, Tatsuya Harada, Tatsuya Matsushima, Ted Xiao, Thomas Kollar, Tianhe Yu, Tianli Ding, Todor Davchev, Tony Z. Zhao, Travis Armstrong, Trevor Darrell, Trinity Chung, Vidhi Jain, Vincent Vanhoucke, Wei Zhan, Wenxuan Zhou, Wolfram Burgard, Xi Chen, Xiaolong Wang, Xinghao Zhu, Xinyang Geng, Xiyuan Liu, Liangwei Xu, Xuanlin Li, Yao Lu, Yecheng Jason Ma, Yejin Kim, Yevgen Chebotar, Yifan Zhou, Yifeng Zhu, Yilin Wu, Ying Xu, Yixuan Wang, Yonatan Bisk, Yoonyoung Cho, Youngwoon Lee, Yuchen Cui, Yue Cao, Yueh-Hua Wu, Yujin Tang, Yuke Zhu, Yunchu Zhang, Yunfan Jiang, Yunshuang Li, Yunzhu Li, Yusuke Iwasawa, Yutaka Matsuo, Zehan Ma, Zhuo Xu, Zichen Jeff Cui, Zichen Zhang, Zipeng Lin
2024IROSMulti-Modal Representation Learning with Tactile Data.Hyung-Gun Chi, Jose A. Barreiros, Jean Mercat, Karthik Ramani, Thomas Kollar
2024IROSLanguage-Embedded Gaussian Splats (LEGS): Incrementally Building Room-Scale Representations with a Mobile Robot.Justin Yu, Kush Hari, Kishore Srinivas, Karim El-Refai, Adam Rashid, Chung Min Kim, Justin Kerr, Richard Cheng, Muhammad Zubair Irshad, Ashwin Balakrishna, Thomas Kollar, Ken Goldberg
2024IROSMANIP: A Modular Architecture for Integrating Interactive Perception for Robot Manipulation.Justin Yu, Tara Sadjadpour, Abby O'Neill, Mehdi Khfifi, Lawrence Yunliang Chen, Richard Cheng, Muhammad Zubair Irshad, Ashwin Balakrishna, Thomas Kollar, Ken Goldberg
2023CoRLHANDLOOM: Learned Tracing of One-Dimensional Objects for Inspection and Manipulation.Vainavi Viswanath, Kaushik Shivakumar, Mallika Parulekar, Jainil Ajmera, Justin Kerr, Jeffrey Ichnowski, Richard Cheng, Thomas Kollar, Ken Goldberg
2023CVPRCARTO: Category and Joint Agnostic Reconstruction of ARTiculated Objects.Nick Heppert, Muhammad Zubair Irshad, Sergey Zakharov, Katherine Liu, Rares Andrei Ambrus, Jeannette Bohg, Abhinav Valada, Thomas Kollar
2023ICCVNeO 360: Neural Fields for Sparse View Synthesis of Outdoor Scenes.Muhammad Zubair Irshad, Sergey Zakharov, Katherine Liu, Vitor Guizilini, Thomas Kollar, Adrien Gaidon, Zsolt Kira, Rares Ambrus
2023ICRAAutoBag: Learning to Open Plastic Bags and Insert Objects.Lawrence Yunliang Chen, Baiyu Shi, Daniel Seita, Richard Cheng, Thomas Kollar, David Held, Ken Goldberg
2023IROSBagging by Learning to Singulate Layers Using Interactive Perception.Lawrence Yunliang Chen, Baiyu Shi, Roy Lin, Daniel Seita, Ayah Ahmad, Richard Cheng, Thomas Kollar, David Held, Ken Goldberg
2023ICRASGTM 2.0: Autonomously Untangling Long Cables using Interactive Perception.Kaushik Shivakumar, Vainavi Viswanath, Anrui Gu, Yahav Avigal, Justin Kerr, Jeffrey Ichnowski, Richard Cheng, Thomas Kollar, Ken Goldberg
2022ECCVShAPO: Implicit Representations for Multi-object Shape, Appearance, and Pose Optimization.Muhammad Zubair Irshad, Sergey Zakharov, Rares Ambrus, Thomas Kollar, Zsolt Kira, Adrien Gaidon
2022ICRACenterSnap: Single-Shot Multi-Object 3D Shape Reconstruction and Categorical 6D Pose and Size Estimation.Muhammad Zubair Irshad, Thomas Kollar, Michael Laskey, Kevin Stone, Zsolt Kira
2022ISRREfficiently Learning Single-Arm Fling Motions to Smooth Garments.Lawrence Yunliang Chen, Huang Huang, Ellen R. Novoseller, Daniel Seita, Jeffrey Ichnowski, Michael Laskey, Richard Cheng, Thomas Kollar, Ken Goldberg
2021CoRLSimNet: Enabling Robust Unknown Object Manipulation from Pure Synthetic Data via Stereo.Thomas Kollar, Michael Laskey, Kevin Stone, Brijen Thananjeyan, Mark Tjersland
2020ICRAA Mobile Manipulation System for One-Shot Teaching of Complex Tasks in Homes.Max Bajracharya, James Borders, Daniel M. Helmick, Thomas Kollar, Michael Laskey, John Leichty, Jeremy Ma, Umashankar Nagarajan, Akiyoshi Ochiai, Josh Petersen, Krishna Shankar, Kevin Stone, Yutaka Takaoka
2018AAAIMulti-Task Learning For Parsing The Alexa Meaning Representation Language.Vittorio Perera, Tagyoung Chung, Thomas Kollar, Emma Strubell
2018NAACLThe Alexa Meaning Representation Language.Thomas Kollar, Danielle Berry, Lauren Stuart, Karolina Owczarzak, Tagyoung Chung, Lambert Mathias, Michael Kayser, Bradford Snow, Spyros Matsoukas
2013ICRAImitation learning for natural language direction following through unknown environments.Felix Duvallet, Thomas Kollar, Anthony Stentz
2013ICRALearning environmental knowledge from task-based human-robot dialog.Thomas Kollar, Vittorio Perera, Daniele Nardi, Manuela M. Veloso
2012AAAIUsing the Web to Interactively Learn to Find Objects.Mehdi Samadi, Thomas Kollar, Manuela M. Veloso
2012AAMASEnabling robots to find and fetch objects by querying the web.Thomas Kollar, Mehdi Samadi, Manuela M. Veloso
2012IROSCoBots: Collaborative robots servicing multi-floor buildings.Manuela M. Veloso, Joydeep Biswas, Brian Coltin, Stephanie Rosenthal, Thomas Kollar, etin Merili, Mehdi Samadi, Susana Brando, Rodrigo Ventura
2011AAAIUnderstanding Natural Language Commands for Robotic Navigation and Mobile Manipulation.Stefanie Tellex, Thomas Kollar, Steven Dickerson, Matthew R. Walter, Ashis Gopal Banerjee, Seth J. Teller, Nicholas Roy
2011HRIHRI pioneers workshop 2011.Thomas Kollar, Astrid Weiss, Jason Monast, Anja Austermann, David Lu, Mitesh Patel, Elena Gribovskaya, Chandan Datta, Richard Kelley, Hirotaka Osawa, Lanny Lin
2011ICRAFollowing and interpreting narrated guided tours.Sachithra Hemachandra, Thomas Kollar, Nicholas Roy, Seth J. Teller
2010HRIToward understanding natural language directions.Thomas Kollar, Stefanie Tellex, Deb Roy, Nicholas Roy
2010ICMIGrounding spatial language for video search.Stefanie Tellex, Thomas Kollar, George Shaw, Nicholas Roy, Deb Roy
2010ICRAIndoor scene recognition through object detection.Pablo Espinace, Thomas Kollar, Alvaro Soto, Nicholas Roy
2010IROSNatural language command of an autonomous micro-air vehicle.Albert S. Huang, Stefanie Tellex, Abraham Bachrach, Thomas Kollar, Deb Roy, Nicholas Roy
2009ICRAUtilizing object-object and object-scene context when planning to find things.Thomas Kollar, Nicholas Roy
2009ICRAWhere to go: Interpreting natural directions using global inference.Yuan Wei, Emma Brunskill, Thomas Kollar, Nicholas Roy
2008AAAIEfficient Optimization of Information-Theoretic Exploration in SLAM.Thomas Kollar, Nicholas Roy
2007IROSTopological mapping using spectral clustering and classification.Emma Brunskill, Thomas Kollar, Nicholas Roy
2007IROSCollision detection in legged locomotion using supervised learning.Finale Doshi, Emma Brunskill, Alexander C. Shkolnik, Thomas Kollar, Khashayar Rohanimanesh, Russ Tedrake, Nicholas Roy
2006ICRAUsing Reinforcement Learning to Improve Exploration Trajectories for Error Minimization.Thomas Kollar, Nicholas Roy