Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
April 30, 2026
cs.LG
cs.CL
Latent-GRPO: Group Relative Policy Optimization for Latent Reasoning
Jingcheng Deng
,
Zihao Wei
,
Liang Pang
,
Junhong Wu
,
Shicheng Xu
,
Zenghao Duan
,
Huawei Shen
Original Abstract
Read on arXiv
Download PDF
Categories
cs.LG, cs.CL