Skip to content

Weak-to-Strong Jailbreaking on Large Language Models.

Xuandong Zhao, Xianjun Yang, Tianyu Pang, Chao Du, Lei Li, Yu-Xiang Wang, William Yang Wang

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.