Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
July 30, 2026
cs.AI
cs.CL
cs.LG
WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning
Haozhe Hu
,
Hao Wu
,
Peiran Yin
,
Chao Han
,
Yunpu Ma
,
Xiaoyu Shen
Original Abstract
Read on arXiv
Download PDF
Categories
cs.AI, cs.CL, cs.LG