Skip to content

R-AVST: Empowering Video-LLMs with Fine-Grained Spatio-Temporal Reasoning in Complex Audio-Visual Scenarios.

Lu Zhu, Tiantian Geng, Yangye Chen, Teng Wang, Ping Luo, Feng Zheng

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.