Knowledge Graph Unlearning to Defend Language Model Against Jailbreak Attack.
Peihua Mai, Hao Jiang, Ran Yan, Youjia Yang, Zhe Huang, Yan Pang
Browse the full ICLR paper archive.
Peihua Mai, Hao Jiang, Ran Yan, Youjia Yang, Zhe Huang, Yan Pang
Browse the full ICLR paper archive.