跳到正文
OpenAI:官网动态·· 2019-09-17精选AI 评分62

OpenAI 在多智能体躲猫猫游戏中观察到自发工具使用

Emergent tool use from multi-agent interaction

AI 导读

OpenAI 报告在新构建的模拟躲猫猫环境中,智能体通过多智能体对抗训练自发学会逐步复杂的工具使用。智能体形成了六种不同的策略与反策略,其中一些是团队事先不知道环境支持的。作者认为这种自监督涌现的复杂性表明,多智能体共同适应未来可能产生极复杂且智能的行为。

推荐理由

原文记录了多智能体在躲猫猫环境中自发形成的六种策略与反策略,可帮助读者理解多智能体协同如何催生复杂行为。

来源:OpenAI:官网动态 · openai.com