DarkBench: Benchmarking Dark Patterns in Large Language Models.
Esben Kran, Jord Nguyen, Akash Kundu, Sami Jawhar, Jinsuk Park, Mateusz Maria Jurewicz
Browse the full ICLR paper archive.
Esben Kran, Jord Nguyen, Akash Kundu, Sami Jawhar, Jinsuk Park, Mateusz Maria Jurewicz
Browse the full ICLR paper archive.