Skip to content

Emergent Misalignment via In-Context Learning: Narrow in-context examples can produce broadly misaligned LLMs.

Nikita Afonin, Nikita Andriyanov, Vahagn Hovhannisyan, Nikhil Bageshpura, Kyle Liu, Kevin Zhu, Sunishchal Dev, Ashwinee Panda, Oleg Rogov, Elena Tutubalina, Alexander Panchenko, Mikhail Seleznyov

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.