Pembelajaran penguatan
September 3, 2026
Q-Learning dan DQN — Dari Q-Table ke Deep Reinforcement Learning
Q-learning memperbarui nilai aksi dengan target optimalitas Bellman. Panduan ini mengikuti jalur dari tabel Q-table ke Deep Q-Network, menjelaskan pengalaman replay, jaringan target, estimasi berlebih, dan penempatan yang aman dalam tumpukan robot.
Fundamentals · 5 menit baca