Hugging Face Blog·· 2022-05-18AI 评分13
Hugging Face 深度强化学习课程:Q-Learning 入门(第 1 部分)
An Introduction to Q-Learning Part 1
AI 导读
Hugging Face 推出深度强化学习免费课程,本文作为第一部分深入讲解基于价值的方法及 Q-Learning 算法。内容涵盖状态价值函数、动作价值函数、贝尔曼方程以及蒙特卡洛与时间差分学习的区别,并介绍从零实现 Q-Learning 智能体。该智能体将在 Frozen-Lake-v1 和出租车导航环境中进行训练,为后续学习 Deep Q-Learning 奠定基础。
来源:Hugging Face Blog · huggingface.co