OpenAI 发布 API,开放其新 AI 模型的访问接口
OpenAI 发布 API,用于访问 OpenAI 开发的新 AI 模型。
推荐理由:OpenAI 官方发布 API,读者可了解其模型首次以接口形式对外开放这一节点。
OpenAI 发布 API,用于访问 OpenAI 开发的新 AI 模型。
推荐理由:OpenAI 官方发布 API,读者可了解其模型首次以接口形式对外开放这一节点。
OpenAI 推出 Microscope,一个收录八个视觉"模式生物"模型中每个重要层与神经元可视化的工具集。它让研究者更易分析这些神经网络内部形成的特征,以推动对复杂系统的理解。
OpenAI 发布 Safety Gym,一套用于衡量强化学习智能体在训练中遵守安全约束进展的环境与工具。该套件面向在训练过程中尊重安全约束的强化学习智能体,提供相应的环境和工具来度量其进展。
OpenAI 发布强化学习游戏平台 Gym Retro 的完整版,公开游戏数量从约 70 款 Atari 游戏和 30 款 Sega 游戏扩展到覆盖多种模拟器的 1000 多款游戏。同时发布的还有用于向该平台添加新游戏的工具。
推荐理由:OpenAI 把强化学习游戏平台从约百款扩展到 1000 多款,并公开添加新游戏的工具,可据此判断其覆盖范围与可扩展性。
OpenAI Baselines 发布 ACKTR 和 A2C 两个新实现。A2C 是 A3C 的同步确定性变体,性能与之相当;ACKTR 比 TRPO 和 A2C 更具样本效率,每次更新仅比 A2C 略多计算量。
OpenAI 开源了 RL-Teacher,这是其通过偶尔的人类反馈而非手工设计奖励函数来训练 AI 的接口实现。该技术为迈向安全 AI 系统而开发,也适用于奖励难以明确指定的强化学习问题。
OpenAI 开源了一个基于 MuJoCo 引擎的高性能 Python 机器人仿真库,该库在其过去一年的机器人研究中开发完成。
OpenAI 开源内部项目 OpenAI Baselines,目标是以与已发表结果相当的性能复现强化学习算法。首批发布包含 DQN 及其三个变体,其余算法将在接下来几个月内陆续放出。
推荐理由:OpenAI 开源内部强化学习复现项目 Baselines,首批放出 DQN 及三个变体,可了解其复现思路与后续发布节奏。
OpenAI 发布开源机器人仿真软件 Roboschool,并已集成到 OpenAI Gym 中。
OpenAI 发布 Universe,一个用于衡量和训练 AI 通用智能的软件平台,覆盖全球范围内的游戏、网站及其他应用。
推荐理由:OpenAI 发布 Universe 平台,读者可了解其用游戏与网站训练和衡量 AI 通用智能的定位。
OpenAI 发布 OpenAI Gym 公测版,这是一个用于开发和对比强化学习(RL)算法的工具包。它包含一套持续扩充的环境(从模拟机器人到 Atari 游戏),以及一个用于对比和复现结果的站点。
推荐理由:OpenAI 公开了强化学习算法开发与对比工具包的测试版,读者可了解其环境套件与结果复现入口。