CiPO: Counterfactual Unlearning for Large Reasoning Models through Iterative Preference Optimization.
Junyi Li, Yongqiang Chen, Ningning Ding
Browse the full ACL paper archive.
Junyi Li, Yongqiang Chen, Ningning Ding
Browse the full ACL paper archive.