Skip to content

Mitigating Content Effects on Reasoning in Language Models Through Fine-Grained Activation Steering.

Marco Valentino, Geonhee Kim, Dhairya Dalal, Zhixue Zhao, Andr Freitas

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.