Back to papers
April 24, 2026cs.AI

Rethinking Math Reasoning Evaluation: A Robust LLM-as-a-Judge Framework Beyond Symbolic Rigidity

Categories

cs.AI