Skip to content

VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers.

Yating Wang, Haoyi Zhu, Mingyu Liu, Jiange Yang, Haoshu Fang, Tong He

VenueA*ICCV
Year2025
ProceedingsICCV

Browse the full ICCV paper archive.