Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models.
Qin Liu, Chao Shang, Ling Liu, Nikolaos Pappas, Jie Ma, Neha Anna John, Srikanth Doss, Llus Mrquez, Miguel Ballesteros, Yassine Benajiba
Browse the full ACL paper archive.