Back to papers
May 14, 2026cs.LGcs.AIcs.CL

Boosting Reinforcement Learning with Verifiable Rewards via Randomly Selected Few-Shot Guidance

HF Upvotes

1

Categories

cs.LG, cs.AI, cs.CL