Are Large Language Models Really Bias-Free? Jailbreak Prompts for Assessing Adversarial Robustness to Bias Elicitation.
Riccardo Cantini, Giada Cosenza, Alessio Orsino, Domenico Talia
Browse the full DIS paper archive.
Riccardo Cantini, Giada Cosenza, Alessio Orsino, Domenico Talia
Browse the full DIS paper archive.