OpenAI News·· 2017-09-14AI 评分26
OpenAI 发布 LOLA 算法:在迭代囚徒困境中建模他方学习
Learning to model other minds
AI 导读
OpenAI 发布 Learning with Opponent-Learning Awareness(LOLA)算法,该算法在建模时考虑其他智能体也在学习,从而在迭代囚徒困境中发现"以牙还牙"这类既自利又合作的策略。OpenAI 称这是迈向能够建模他方心智的智能体的一小步。
来源:OpenAI News · openai.com