Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
August 21, 2026
cs.RO
cs.LG
Beyond Imitation: Self-Improving Robot Policies via Off-Policy Q-Planning
Varun Giridhar
,
Anant Khandelwal
,
Jeremy A. Collins
,
Ignat Georgiev
,
Animesh Garg
Original Abstract
Read on arXiv
Download PDF
Categories
cs.RO, cs.LG