Skip to content

Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking.

Junda Zhu, Lingyong Yan, Shuaiqiang Wang, Dawei Yin, Lei Sha

VenueA*EMNLP
Year2025
ProceedingsEMNLP

Browse the full EMNLP paper archive.