Hugging Face Blog·· 2022-06-07AI 评分13
Hugging Face 深度强化学习课程:使用 Deep Q-Learning 训练 Space Invaders
Deep Q-Learning with Space Invaders
AI 导读
Hugging Face 发布深度强化学习课程第三单元,讲解 Deep Q-Learning 算法。该算法使用神经网络替代 Q-table 处理 Atari 游戏的大状态空间,通过堆叠 4 帧输入解决时间局限性,并采用 Experience Replay 和 Fixed Q-Target 稳定训练。
来源:Hugging Face Blog · huggingface.co