Skip to content

On Calibration of LLM-based Guard Models for Reliable Content Moderation.

Hongfu Liu, Hengguan Huang, Xiangming Gu, Hao Wang, Ye Wang

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.