Back to papers
April 17, 2026cs.CL

CiPO: Counterfactual Unlearning for Large Reasoning Models through Iterative Preference Optimization

Categories

cs.CL