QV(λ)-learning: A New On-policy Reinforcement Learning Algorithm
Marco Wiering · 2005
Reinforcement learning algorithms (Sutton & Barto, 1998; Kaelbling et al., 1996) are very suitable for learning to control an agent by letting it interact with an environment. Currently, there are three well-known