OpenAI News·· 2017-07-20精选AI 评分75
OpenAI 发布强化学习算法 PPO
Proximal Policy Optimization
AI 导读
OpenAI 发布一类新的强化学习算法 Proximal Policy Optimization(PPO),其表现与当时最先进方法相当或更好,同时实现和调参都更简单。PPO 因易用且性能良好,已成为 OpenAI 的默认强化学习算法。
推荐理由
OpenAI 发布 PPO 强化学习算法,读者可了解它为何成为 OpenAI 默认算法及相比已有方法的简化之处。
来源:OpenAI News · openai.com