LieCraft: A Multi-Agent Framework for Evaluating Deceptive Capabilities in Language Models.
Matthew Lyle Olson, Neale Ratzlaff, Musashi Hinck, Tri Nguyen, Vasudev Lal, Joseph Campbell, Simon Stepputtis, Shao-Yen Tseng
Browse the full AAAI paper archive.