Back to papers
August 31, 2026cs.LGcs.CL

One Policy Is Enough: Single-Agent Reinforcement Learning Outperforms Tree Search for Chemistry Tool Learning

Categories

cs.LG, cs.CL