Information-Guided Identification of Training Data Imprint in (Proprietary) Large Language Models.
Abhilasha Ravichander, Jillian Fisher, Taylor Sorensen, Ximing Lu, Maria Antoniak, Bill Yuchen Lin, Niloofar Mireshghallah, Chandra Bhagavatula, Yejin Choi
Browse the full NAACL paper archive.