跳到正文
原文
OpenAI News·· 2017-09-14AI 评分26

OpenAI 发布 LOLA 算法:在迭代囚徒困境中建模他方学习

Learning to model other minds

AI 导读

OpenAI 发布 Learning with Opponent-Learning Awareness(LOLA)算法,该算法在建模时考虑其他智能体也在学习,从而在迭代囚徒困境中发现"以牙还牙"这类既自利又合作的策略。OpenAI 称这是迈向能够建模他方心智的智能体的一小步。

来源:OpenAI News · openai.com