Back to papers
August 18, 2026cs.LGcs.AI

Policy-Invariant Reward Shaping from LLM Feedback: A Framework for Hybrid RL Agents

Categories

cs.LG, cs.AI