跳到正文
原文
Hugging Face Blog·· 2022-06-07AI 评分22

Hugging Face 深度强化学习课程:用 Deep Q-Learning 玩 Space Invaders

Deep Q-Learning with Space Invaders

AI 导读

Hugging Face 深度强化学习课程第三单元讲解 Deep Q-Learning:不再维护 Q-table,而是用神经网络根据状态逼近每个动作的 Q 值,并训练智能体玩 Space Invaders 等 Atari 环境。输入为 4 帧堆叠、缩放至 84x84 的灰度画面,经三层卷积和全连接层输出各动作 Q 值,训练借助基于 Stable-Baselines 的 RL-Zoo 完成。

来源:Hugging Face Blog · huggingface.co