Skip to content

From Thousands to Billions: 3D Visual Language Grounding via Render-Supervised Distillation from 2D VLMs.

Ang Cao, Sergio Arnaud, Oleksandr Maksymets, Jianing Yang, Ayush Jain, Ada Martin, Vincent-Pierre Berges, Paul McVay, Ruslan Partsey, Aravind Rajeswaran, Franziska Meier, Justin Johnson, Jeong Joon Park, Alexander Sax

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.