Back to papers
August 10, 2026cs.LGcs.AIcs.CR

Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs

Categories

cs.LG, cs.AI, cs.CR