Skip to content

Defending Large Language Models against Jailbreak Attacks via Semantic Smoothing.

Jiabao Ji, Bairu Hou, Alexander Robey, George J. Pappas, Hamed Hassani, Yang Zhang, Eric Wong, Shiyu Chang

VenueBIJCNLP
Year2025
ProceedingsIJCNLP-AACL (Short Papers)

Browse the full IJCNLP paper archive.