When Safe Models Merge Into Danger: Exploiting Latent Vulnerabilities in LLM Fusion.
Jiaqing Li, Zhibo Zhang, Shide Zhou, Yuxi Li, Tianlong Yu, Kailong Wang
Browse the full ICPR paper archive.
Jiaqing Li, Zhibo Zhang, Shide Zhou, Yuxi Li, Tianlong Yu, Kailong Wang
Browse the full ICPR paper archive.