Lessons
Q-Learning: Model Free Reinforcement Learning and Temporal Difference Learning
يشرح ستيف برونتون خوارزمية Q-Learning الأساسية في التعلم المعزز، مع أساسيات التعلم بالفروق الزمنية لتعلم الاستراتيجيات من التفاعل.
Watch video — Steve Brunton