Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
May 20, 2026
cs.CL
LamPO: A Lambda Style Policy Optimization for Reasoning Language Models
Zhe Yuan
,
Yipeng Zhou
,
Jinghan Li
,
Xinyuan Chen
,
Bowen Deng
,
Zhiqian Chen
,
Liang Zhao
Original Abstract
Read on arXiv
Download PDF
Categories
cs.CL