Back to papers
April 29, 2026cs.CLcs.AIcs.LG

TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models

Categories

cs.CL, cs.AI, cs.LG