Skip to content

STAR-1: Safer Alignment of Reasoning LLMs with 1K Data.

Zijun Wang, Haoqin Tu, Yuhan Wang, Juncheng Wu, Yanqing Liu, Jieru Mei, Brian R. Bartoldson, Bhavya Kailkhura, Cihang Xie

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.