Skip to content

ST-VLM: A Spatial-to-Image Multimodal Spatial-Temporal Prediction Framework with Vision-Language Model.

Tong Zhao, Junping Du, Zhe Xue, Meiyu Liang, Aijing Li, Xiaolong Meng, Dandan Liu

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.