Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
June 17, 2026
cs.LG
cs.AI
cs.CL
STARE: Surprisal-Guided Token-Level Advantage Reweighting for Policy Entropy Stability
Haipeng Luo
,
Qingfeng Sun
,
Songli Wu
,
Can Xu
,
Wenfeng Deng
,
Han Hu
,
Yansong Tang
Original Abstract
Read on arXiv
Download PDF
HF Upvotes
8
Categories
cs.LG, cs.AI, cs.CL