Back to papers
April 15, 2026cs.LGcs.AI

Soft $Q(λ)$: A multi-step off-policy method for entropy regularised reinforcement learning using eligibility traces

Categories

cs.LG, cs.AI