跳到正文
原文
OpenAI News·· 2019-09-17精选AI 评分62

OpenAI 在多智能体交互中观察到涌现式工具使用

Emergent tool use from multi-agent interaction

AI 导读

OpenAI 在模拟捉迷藏环境中训练智能体,观察到它们逐步学会使用更复杂的工具,并形成六种不同的策略与反策略,其中一些是该环境原本未设计支持的。OpenAI 认为,这种在简单环境中自监督涌现出的复杂性,说明多智能体共同适应未来可能产生极其复杂且智能的行为。

推荐理由

OpenAI 在多智能体捉迷藏环境中观察到智能体自发形成六种策略与反策略,可了解涌现式工具使用的实验设定。

来源:OpenAI News · openai.com