Back to papers
April 30, 2026cs.CVcs.AIcs.CL

PRISM: Pre-alignment via Black-box On-policy Distillation for Multimodal Reinforcement Learning

HF Upvotes

38

Categories

cs.CV, cs.AI, cs.CL