Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
July 30, 2026
cs.LG
$β$-OPSD: Deriving with Policy Optimization, Training with Self-Distillation
Jiawei Xu
,
Minghui Liu
,
Juzheng Zhang
,
Tom Goldstein
,
Furong Huang
Original Abstract
Read on arXiv
Download PDF
HF Upvotes
21
Categories
cs.LG