Back to papers
July 23, 2026cs.LG

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment

Categories

cs.LG