10 min de lectureApprentissage par renforcement
L’apprentissage par renforcement et le Q-learning
Apprendre à bien agir sans modèle du monde : mises à jour par différence temporelle, la règle du Q-learning, exploration contre exploitation, et une exécution qui retrouve l’optimum planifié à partir de la seule expérience.
Apprentissage par renforcementApprentissage automatiqueIntelligence artificielle