VGDIFFZERO: Text-To-Image Diffusion Models Can Be Zero-Shot Visual Grounders.
Xuyang Liu, Siteng Huang, Yachen Kang, Honggang Chen, Donglin Wang
Browse the full ICASSP paper archive.
Xuyang Liu, Siteng Huang, Yachen Kang, Honggang Chen, Donglin Wang
Browse the full ICASSP paper archive.