Apprentissage par renforcement
September 3, 2026
Q-Learning et DQN — De la table Q à l'apprentissage par renforcement profond
L'apprentissage par renforcement (Q-learning) met à jour les valeurs des actions en fonction de l'optimalité de Bellman. Ce guide retrace le cheminement d'une table Q classique à un réseau de neurones profond (Deep Q Network), en expliquant la réutilisation de l'expérience, les réseaux cibles, la surestimation et le placement sûr dans une pile de robots.
Fundamentals · 7 min de lecture