Back to papers
April 9, 2026cs.AI

Aligning Agents via Planning: A Benchmark for Trajectory-Level Reward Modeling

Categories

cs.AI