Skip to content

Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective.

Tianlong Li, Zhenghua Wang, Wenhao Liu, Muling Wu, Shihan Dou, Changze Lv, Xiaohua Wang, Xiaoqing Zheng, Xuanjing Huang

VenueBCOLING
Year2025
ProceedingsCOLING

Browse the full COLING paper archive.