Back to papers
April 28, 2026cs.LGcs.AIstat.ML

When Errors Can Be Beneficial: A Categorization of Imperfect Rewards for Policy Gradient

Categories

cs.LG, cs.AI, stat.ML