Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
April 15, 2026
cs.LG
cs.AI
cs.CL
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
Yuqiao Tan
,
Minzheng Wang
,
Bo Liu
,
Zichen Liu
,
Tian Liang
,
Shizhu He
,
Jun Zhao
,
Kang Liu
Original Abstract
Read on arXiv
Download PDF
HF Upvotes
26
Categories
cs.LG, cs.AI, cs.CL