Back to papers
July 6, 2026cs.AI

Reason, Reward, Refine: Step-Level Errors Corrections with Structured Feedback for Physics Reasoning in Small Language Models

Categories

cs.AI