Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
April 14, 2026
cs.CL
Token-Level Policy Optimization: Linking Group-Level Rewards to Token-Level Aggregation via Sequence-Level Likelihood
Xingyu Lin
,
Yilin Wen
,
Du Su
,
Jinchang Hou
,
En Wang
,
Wenbin Liu
,
Chenfu Bao
,
Zhonghou Lv
Original Abstract
Read on arXiv
Download PDF
Categories
cs.CL